具体日期、时间与会场确认后将在此补充。
KTransformers 通过利用 CPU-GPU 异构计算,在消费级硬件上实现了 1T 级 MoE 模型的高效本地推理。它支持从微调到推理的完整闭环,允许模型服务、反馈收集和部署回系统。这种方法使小型团队和研究人员能够在不需高昂硬件成本的情况下研究、服务和迭代大型模型。
讲师