KVCDN 工作坊

使用 FlexKV 实现大模型 KV Cache 池化的最佳实践

具体日期、时间与会场确认后将在此补充。

活动简介

本工作坊介绍 FlexKV 如何统一管理和压缩 GPU 显存、CPU 内存、SSD 与分布式存储中的 KV Cache,涵盖跨节点池化、异步传输、Namespace 隔离,以及与 vLLM、SGLang、TensorRT-LLM 和 Dynamo 的集成,并分享企业级落地实践。