返回快讯列表
开源生态

英伟达开源 Nemotron 3.5 Lightning 与路由库 Switchyard

英伟达 8 月 11 日发布 300 亿参数混合专家模型 Nemotron 3.5 Lightning,官方称输出速度最高为同级 4 倍,同时开源模型路由库 NeMo Switchyard。

英伟达 8 月 11 日在官方博客发布 Nemotron 3.5 Lightning,一个 300 亿参数的混合专家模型,权重命名为 30B-A3B,提供 NVFP4 与 BF16 检查点。它的定位不是当主力,而是接手智能体循环里的重复劳动——工具调用、结果校验、子智能体分派这类每一步都用前沿模型就太贵太慢的环节。官方给的数字是输出速度最高为同级模型的 4 倍,智能体任务整体完成时间快 30%。

同天开源的 NeMo Switchyard 是配套的另一半:一个模型路由库,按工作流的每一步把请求分给最合适的模型,覆盖开源模型、第三方闭源模型和英伟达自家模型,不需要重写应用,路由算法可替换。英伟达列出了一批客户实测:LangChain 在 145 个多轮 Deep Agents 任务中只把 7% 的调用交给前沿模型,成本降低 74%,代价是 6% 的准确率;Ramp 在自家 SWE-Bench 上成本降 58%、运行时间降 33%。分发渠道包括 Hugging Face、ModelScope、OpenRouter 和 build.nvidia.com。

这套东西指向的是一个正在成型的做法:不再纠结「选哪个模型」,而是同一条链路里混用几个模型按步分工。如果你的智能体成本主要花在低价值步骤上,路由层可能比换模型更划算。需要留意两点:官方博客通篇只说这是「开放模型」,没点明具体许可证名称,商用前要自己去读权重仓库里的 LICENSE;上面那些降本比例大多来自英伟达内部基准和客户自述,换成你自己的任务分布未必复现。

更多快讯