2026 NVIDIA 中国开发者日,AI 基础设施专场等你报名中性

2026-09-29 18:08:13
作者:NVIDIA
分享

2026NVIDIA中国开发者日将于10月15日至16日在苏州举行。作为年度技术领域的盛会,本次将汇聚来自全国的开发者、行业专家及科技爱好者,共同探索前沿技术趋势。大会还将设AI基础设施专场,欢迎报名注册并到场交流!

2026年10月16日(星期五)

13:30–17:00分论坛四—

AI基础设施专场

苏州金鸡湖国际会议中心A馆

AI 基础设施专场日程安排

13:30–14:05NVIDIA KV Cache卸载框架

王斌|NVIDIA解决方案架构师

介绍NVIDIA最新的KV Cache卸载方案,梳理KVCR整套框架如何协同工作,以支撑更长上下文与更高吞吐的推理服务。

14:05–14:40NIXL框架及其在推理中的用法

王璟珣|NVIDIA解决方案架构师

介绍如何用NIXL实现接近硬件上限的KVCache传输与权重同步,如何灵活搭建多层KVCache存储,以及NIXL近期新增的能力如何服务推理系统。

14:40–15:15NVIDIA DSX:为下一代AI工厂最大化每瓦Token

彭少丽|NVIDIA解决方案架构师

从 AI工厂面临的能效与吞吐挑战出发,介绍NVIDIA DSX的架构、蓝图与软件栈,以及它能为客户带来的价值与落地路径,目标是提升下一代AI工厂的每瓦Token。

15:15–15:50智能体基础设施:DOCA Vault与DOCA Argus

杨雪|NVIDIA解决方案架构师

介绍面向智能体的DOCA基础设施:Argus在BlueField DPU上做无代理运行时安全与数据路径隔离;Vault以零信任方式保护智能体文件访问。

15:50–16:25在大语言模型和生成式推荐中使用FlexKV缓存和重用KV Cache

胡琳|NVIDIA解决方案架构师

介绍FlexKV作为一个多层级的分布式KV Cache管理框架,如何高效支持LLM和生成式推荐的场景中KV Cache在不同层级之间的索引和传输的操作,以及在实际业务场景中的性能表现。

16:25–17:00SGLang中的KV Cache:缓存复用与分离式推理

杨雨豪|SGLang社区核心开发者

介绍SGLang如何用RadixAttention在请求间复用共享前缀的KV Cache,如何在PD分离架构下高效传输KV Cache并结合NVIDIA Dynamo完成服务编排,以及HiCache如何把KV Cache从GPU显存扩展到主机内存与分布式外部存储。

参会指南

1

免责声明:风险提示:本文内容仅供参考,不代表同花顺观点。同花顺各类信息服务基于人工智能算法,如有出入请以证监会指定上市公司信息披露平台为准。如有投资者据此操作,风险自担,同花顺对此不承担任何责任。
homeBack返回首页
不良信息举报与个人信息保护咨询专线:10100571违法和不良信息涉企侵权举报涉算法推荐举报专区涉青少年不良信息举报专区

浙江同花顺互联信息技术有限公司版权所有

网站备案号:浙ICP备18032105号
证券投资咨询服务提供:浙江同花顺云软件有限公司 (中国证监会核发证书编号:ZX0050)
AIME