OmniTools 8月11日消息,英伟达于当日推出Nemotron 3.5 Lightning——一款开源的30B混合专家(MoE)模型,专为本地运行的智能体任务优化。该模型支持NVFP4与GGUF格式,可在RTX PC、Jetson设备及DGX Spark等平台本地部署,实测token生成速度提升最高达4倍,任务完成时间缩短30%。
同日发布的NeMo Switchyard为开源模型路由库,可依据精度、速度与成本自动分配智能体工作流中的各步骤至最适配模型。内部基准测试显示,其相较单一Opus 4.8模型可将任务完成成本降至约三分之一。
Nemotron 3.5 Lightning已通过OpenRouter、build.nvidia.com NIM微服务及多家云合作伙伴提供;NeMo Switchyard代码已开源至GitHub。