全新轻量级开放模型和路由库可更好地在边缘设备、PC、工作站、数据中心和云端对 AI、数据和工作流进行管理。

随着 AI 从聊天机器人向自主智能体演进,开放模型正在满足市场对全面掌控 AI 运行位置、部署方式和演化方式的需求。
NVIDIA 宣布推出 Nemotron 3.5 Lightning,进一步扩展其 Nemotron 3 模型系列,这是同类产品中效率领先的模型,适用于长时间运行的代理式 AI 工作负载。此次发布紧随 Nemotron 3 Nano 之后,体现了 NVIDIA 对持续改进开放模型以提高准确性和速度的承诺。
Nemotron 3.5 Lightning 是一个 300 亿参数的混合专家模型,专为大型多智能体系统中的特定任务而构建,有助于创建更智能、更高效的智能体应用。
此外,NVIDIA 还发布了 NeMo Switchyard,这是一款旨在为热门智能体工具提供智能路由的开源库。企业可以根据自己的特定需求用其来构建路由器。部署后,NeMo Switchyard 能够在开发者自行组合的开放模型、专有模型以及 NVIDIA 模型之间智能地将每个请求定向到强大且高度适合该任务的模型,而无需开发者重写其应用程序。
Nemotron 3.5 Lightning 和 NeMo Switchyard 共同赋予了用户对 AI 部署方式、运行位置以及运行效率的更出色的掌控力 —— 无论是在 PC、工作站、数据中心还是云端。

Nemotron 3.5 Lightning 是一款专为高并发智能体工作流而构建的小型、可定制的开放模型,可提供前沿级智能。
以上为摘要内容,请点击“阅读原文”或扫描下方二维码阅读完整内容:
