随着 AI 从聊天机器人向自主智能体演进,开放模型正在满足市场对全面掌控 AI 运行位置、部署方式和演化方式的需求。
今日,NVIDIA 宣布推出 Nemotron 3.5 Lightning,进一步扩展其 Nemotron 3 模型系列,这是同类产品中效率领先的模型,适用于长时间运行的代理式 AI 工作负载。此次发布紧随 Nemotron 3 Nano 之后,体现了 NVIDIA 对持续改进开放模型以提高准确性和速度的承诺。
Nemotron3.5 Lightning 是一个 300 亿参数的混合专家模型,专为大型多智能体系统中的特定任务而构建,有助于创建更智能、更高效的智能体应用。
此外,NVIDIA 还发布了 NeMo Switchyard,这是一款旨在为热门智能体工具提供智能路由的开源库。企业可以根据自己的特定需求用其来构建路由器。部署后,NeMo Switchyard 能够在开发者自行组合的开放模型、专有模型以及 NVIDIA 模型之间智能地将每个请求定向到强大且高度适合该任务的模型,而无需开发者重写其应用程序。
Nemotron3.5 Lightning 和 NeMo Switchyard 共同赋予了用户对 AI 部署方式、运行位置以及运行效率的更出色的掌控力 —— 无论是在 PC、工作站、数据中心还是云端。
Nemotron 3.5 Lightning是一款专为高并发智能体工作流而构建的小型、可定制的开放模型,可提供前沿级智能。
始终在线的智能体需要由多个模型组成的系统
现代智能体系统 (始终在线的智能体) 正越来越多地作为由多个模型组成的系统或模型集合运行,其中不同的模型专门负责不同的任务。
NVIDIA Nemotron 开放模型专为此架构设计。像 Nemotron 3 Ultra 或 GPT-5.6 这样的前沿推理模型可以规划和协调工作流,而像 Nemotron 3.5
Lightning 这样的小型专用模型可以执行代码审查、工具使用、安全警报监测和回答计费问题等目标任务。
借助 Nemotron 3.5 Lightning 赋能高并发专用任务
NVIDIA Nemotron 3.5 Lightning 是专为高并发任务而构建的完全可定制的开放模型,可为始终在线的智能体提供支持。该模型的开发得益于 Nemotron Coalition 的贡献,其成员提供了评估方法、推理软件和数据集,助力推进模型发展。
与同类模型相比,该模型的输出速度至高可提升至原来的 4 倍,可将智能体任务的完成速度提升 30%。得益于Nemotron 3.5 Lightning 开放且可定制的特点,企业可以轻松地利用 NVIDIA NeMo 结合自身的领域数据、工具和工作流对其进行后训练,以提高专用任务的准确性。
PinchBench 基准测试表明,与同类模型相比,Nemotron 3.5 Lightning 更快地完成智能体任务,同时保持前沿级准确性。
各行各业的 AI 领导者正在为其工作负载定制 Nemotron 3.5 Lightning,帮助提高特定领域智能体任务的准确性。例如,CrowdStrike 将其用于网络安全、Harvey with Trajectory 将其用于法律服务、CodeRabbit 结合 Baseten 将其用于代码审查。此外,Lila Sciences 正在利用它帮助提高物理和生命科学领域智能体任务的推理能力;Fastino Labs 对该模型进行了定制,在软件开发、金融和医疗工作负载方面取得了领先的准确性。


闽公网安备 35020602001684号