2026NVIDIA中国开发者日将于10月15日至16日在苏州举行。作为年度技术领域的盛会,本次将汇聚来自全国的开发者、行业专家及科技爱好者,共同探索前沿技术趋势。大会还将设AI基础设施专场,欢迎报名注册并到场交流!
2026年10月16日(星期五)
13:30–17:00分论坛四—
AI基础设施专场
苏州金鸡湖国际会议中心A馆
AI 基础设施专场日程安排
13:30–14:05NVIDIA KV Cache卸载框架
王斌|NVIDIA解决方案架构师
介绍NVIDIA最新的KV Cache卸载方案,梳理KVCR整套框架如何协同工作,以支撑更长上下文与更高吞吐的推理服务。
14:05–14:40NIXL框架及其在推理中的用法
王璟珣|NVIDIA解决方案架构师
介绍如何用NIXL实现接近硬件上限的KVCache传输与权重同步,如何灵活搭建多层KVCache存储,以及NIXL近期新增的能力如何服务推理系统。
14:40–15:15NVIDIA DSX:为下一代AI工厂最大化每瓦Token
彭少丽|NVIDIA解决方案架构师
从 AI工厂面临的能效与吞吐挑战出发,介绍NVIDIA DSX的架构、蓝图与软件栈,以及它能为客户带来的价值与落地路径,目标是提升下一代AI工厂的每瓦Token。
15:15–15:50智能体基础设施:DOCA Vault与DOCA Argus
杨雪|NVIDIA解决方案架构师
介绍面向智能体的DOCA基础设施:Argus在BlueField DPU上做无代理运行时安全与数据路径隔离;Vault以零信任方式保护智能体文件访问。
15:50–16:25在大语言模型和生成式推荐中使用FlexKV缓存和重用KV Cache
胡琳|NVIDIA解决方案架构师
介绍FlexKV作为一个多层级的分布式KV Cache管理框架,如何高效支持LLM和生成式推荐的场景中KV Cache在不同层级之间的索引和传输的操作,以及在实际业务场景中的性能表现。
16:25–17:00SGLang中的KV Cache:缓存复用与分离式推理
杨雨豪|SGLang社区核心开发者
介绍SGLang如何用RadixAttention在请求间复用共享前缀的KV Cache,如何在PD分离架构下高效传输KV Cache并结合NVIDIA Dynamo完成服务编排,以及HiCache如何把KV Cache从GPU显存扩展到主机内存与分布式外部存储。
