2026 NVIDIA 中国开发者日将于 10 月 15 日至 16 日在苏州举行。作为年度技术领域的盛会,本次将汇聚来自全国的开发者、行业专家及科技爱好者,共同探索前沿技术趋势。大会还将设 AI 基础设施专场,欢迎报名注册并到场交流!

2026 年 10 月 16 日(星期五)
13:30 – 17:00 分论坛四 —
AI 基础设施专场

苏州金鸡湖国际会议中心 A 馆
AI 基础设施专场日程安排
13:30 – 14:05 NVIDIA KV Cache 卸载框架
王斌|NVIDIA 解决方案架构师
介绍 NVIDIA 最新的 KV Cache 卸载方案,梳理 KVCR 整套框架如何协同工作,以支撑更长上下文与更高吞吐的推理服务。
14:05 – 14:40 NIXL 框架及其在推理中的用法
王璟珣|NVIDIA 解决方案架构师
介绍如何用 NIXL 实现接近硬件上限的 KVCache 传输与权重同步,如何灵活搭建多层 KVCache 存储,以及 NIXL 近期新增的能力如何服务推理系统。
14:40 – 15:15 NVIDIA DSX:为下一代 AI 工厂最大化每瓦 Token
彭少丽|NVIDIA 解决方案架构师
从 AI 工厂面临的能效与吞吐挑战出发,介绍 NVIDIA DSX 的架构、蓝图与软件栈,以及它能为客户带来的价值与落地路径,目标是提升下一代 AI 工厂的每瓦 Token。
15:15 – 15:50 智能体基础设施:DOCA Vault 与 DOCA Argus
杨雪|NVIDIA 解决方案架构师
介绍面向智能体的 DOCA 基础设施:Argus 在 BlueField DPU 上做无代理运行时安全与数据路径隔离;Vault 以零信任方式保护智能体文件访问。
15:50 – 16:25 在大语言模型和生成式推荐中使用 FlexKV 缓存和重用 KV Cache
胡琳|NVIDIA 解决方案架构师
介绍 FlexKV 作为一个多层级的分布式 KV Cache 管理框架,如何高效支持 LLM 和生成式推荐的场景中 KV Cache 在不同层级之间的索引和传输的操作,以及在实际业务场景中的性能表现。
16:25 – 17:00 SGLang 中的 KV Cache:缓存复用与分离式推理
杨雨豪|SGLang 社区核心开发者
介绍 SGLang 如何用 RadixAttention 在请求间复用共享前缀的 KV Cache,如何在 PD 分离架构下高效传输 KV Cache 并结合 NVIDIA Dynamo 完成服务编排,以及 HiCache 如何把 KV Cache 从 GPU 显存扩展到主机内存与分布式外部存储。
参会指南
1
点击“阅读原文”或扫描海报二维码,进入页面。
2
点击“立即注册”,输入邮箱注册或登录 NVIDIA 账户,勾选感兴趣的议程和论坛场次,提交参会申请。
3
等待邮件和短信审核确认。请将 nvidia.com 加入邮箱白名单,避免通知被拦截。
4
凭确认通知到场参会。
注:大会名额有限,报名需经审核,以确认邮件和短信为准。
诚邀各位技术同仁齐聚苏州,聚焦 AI 基础设施技术新趋势,共话 AI 产业底层创新与未来机遇!点击“阅读原文”或扫描海报二维码,即刻注册,锁定 NVIDIA 开发者日参会席位!
