具体日期、时间与会场确认后将在此补充。
本次演讲回顾 GLM 与 SGLang、vLLM 等推理框架社区的深度协作,涵盖模型发布日适配、投机解码、量化、Prefill–Decode 分离、精度对齐和性能调优,并介绍如何通过上游贡献、开放模型权重与技术报告,让高性能推理实践惠及更广泛的开源生态。
讲师