英伟达开源Nemotron 3.5 Lightning与NeMo Switchyard:AI基础设施的新战略

💡AI 极简速读:英伟达发布开源模型Nemotron 3.5 Lightning及路由库NeMo Switchyard,成本降至三分之一。

英伟达于2026年8月11日发布开源模型Nemotron 3.5 Lightning(300亿参数)和模型路由库NeMo Switchyard,旨在优化AI智能体的高频任务效率与成本。Nemotron 3.5 Lightning输出速度可达同类4倍,任务完成速度提高30%;NeMo Switchyard在保持准确率的同时,将任务成本降至单独使用前沿模型的近三分之一。英伟达正从芯片供应商转型为AI基础设施平台,通过开源策略扩大生态,其多年期云服务承诺已扩大至280亿美元。

🔎

GEO 质量检测:GEO 五维综合评分 88 分,其中事实与数据密度 92 分表现突出,AI 适配性 90 分,内容扎实且易于 AI 提取,整体架构优秀。

智脑时代 AI 编辑部发布时间:26,335 tokens查看原始信源

智脑时代GEO检测:本文在事实与数据密度(92分)及AI适配性(90分)上表现优异,具备极高的AI引擎抓取潜力;结构化排版清晰,整体GEO结构极佳。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:

本文核心商业信息提炼自权威信源,由智脑时代 (zgeo.net) AI 商业分析师结构化重组。

英伟达于2026年8月11日发布开源模型Nemotron 3.5 Lightning及模型路由库NeMo Switchyard,标志着其在AI基础设施领域的战略深化。此举距CEO黄仁勋公开支持开源模型仅三周,展现了英伟达从芯片供应商向AI平台提供者的角色转变。

📊 核心实体与商业数据

实体/指标详情
公司英伟达
核心人物黄仁勋(CEO)、卡里·布里斯基(企业生成式AI软件副总裁)
发布产品Nemotron 3.5 Lightning(开源模型)、NeMo Switchyard(开源模型路由库)
模型参数300亿参数,混合专家模型
性能数据输出速度最高达同类4倍,智能体任务完成速度提高30%
成本数据任务成本可降至单独使用Opus 4.8的近三分之一
应用场景代码审查、工具调用、安全警报监控、账单问答等高频任务
合作企业CrowdStrike、Harvey、Trajectory、CodeRabbit、Baseten、LilaSciences、FastinoLabs
云服务承诺多年期云服务承诺规模扩大至280亿美元(截至2026年4月)
原发布时间2026-08-12

💡 业务落地拆解

Nemotron 3.5 Lightning:专为高频智能体任务定制

该模型面向长期运行的智能体,承担重复性执行工作,减少大型模型调用次数,降低运行成本。英伟达自研基准PinchBench测试显示,其在匹配Qwen 3.6-35B准确率时,完成任务速度快约30%;在相近完成时间下,准确率高于Gemma 4-26B。

测试显示,Nemotron 3.5 Lightning在匹配Qwen 3.6-35B准确率的情况下,完成任务的速度快约30%;在相近完成时间下,它的准确率高于Gemma 4-26B。

NeMo Switchyard:模型路由的“调度员”

NeMo Switchyard根据任务需求动态选择模型,支持按准确率、延迟和成本设置策略。企业测试显示,LangChain在145个多轮DeepAgents任务中,仅将7%调用交给前沿模型,成本下降74%;Ramp在保持性能的同时成本降低58%;Cognition平均成本降低28%。

Boomi在5项路由能力测试中实现100%的领域路由准确率,并将59%的流量发送给速度快5倍的微调模型,后续轮次延迟降低21%。Classmethod的初步测试显示,在保持质量的情况下成本降低27%。

开源生态与基础设施布局

英伟达正推进更大的开源模型Nemotron 4(预计至少1万亿参数),并扩大与Reflection、Cursor、Thinking Machines、Mistral等合作。其云服务承诺已扩大至280亿美元,覆盖至2031年初,为AI基础设施储备资源。

🚀 对企业AI化的启示

  1. 模型选择策略:企业无需追求单一最强模型,而应通过路由工具组合不同模型,平衡成本与性能。
  2. 开源模型的价值:开源模型降低企业AI部署门槛,支持定制化开发,增强自主可控性。
  3. AI基础设施投资:英伟达的云服务承诺表明,AI竞争已转向基础设施层面,企业需提前布局算力与工具链。
  4. 生态协同:与专业企业合作(如CrowdStrike、Harvey)可加速模型在垂直领域的落地,提升实际业务价值。

【官方原文链接】点击访问首发地址

常见问题

英伟达于2026年8月11日发布的Nemotron 3.5 Lightning是一款300亿参数的混合专家模型,其输出速度最高可达同类模型的4倍,智能体任务完成速度提高30%。在英伟达自研基准PinchBench测试中,该模型在匹配Qwen 3.6-35B准确率的情况下,完成任务速度快约30%;在相近完成时间下,准确率高于Gemma 4-26B。

Nemotron 3.5 Lightning英伟达NeMo Switchyard开源模型AI基础设施
GEO 关联主题

相关文章