Nvidia、AIモデルをタスク中に再編成する「Switchyard」ルーターでタスクコストを3分の1に削減
Nvidia's Switchyard router reshuffles AI models mid-task, cutting task costs to a third in its own tests
Nvidiaは、AIエージェントの運用コスト削減のため、オープンソースライブラリ「NeMo Switchyard」とオープンモデル「Nemotron 3.5 Lightning」を発表した。Switchyardは、AIタスクの各ステップに最適なモデルを動的に割り当てることで、コストを大幅に削減する。Nvidiaのテストによると、Lightningは同クラスのモデルと比較して最大4倍高速な出力を提供し、Qwen3.6-35Bより約30%高速にタスクを完了する。Switchyardと組み合わせることで、Opus 4.8単体で実行する場合と比較して、ベンチマークコストを約3分の1に削減できるという。この技術は、LangChain、Ramp、Cognitionなどの企業でテストされ、LangChainでは74%のコスト削減、Rampではコスト58%、実行時間33%の削減が報告されている。Nemotron 3.5 Lightningは、高ボリュームかつ特化したエージェントタスク向けに設計された300億パラメータのオープンモデルである。
- Nvidiaがオープンソースライブラリ「NeMo Switchyard」とオープンモデル「Nemotron 3.5 Lightning」(300億パラメータ)を発表し、AIタスクの各ステップに最適なモデルを動的に割り当てることでタスクコストを約3分の1に削減すると報告
- SwitchyardとLightningの組み合わせにより、LangChainでは74%のコスト削減、Rampではコスト58%・実行時間33%の削減が報告された
- Lightningは同クラスのモデルと比較して最大4倍高速な出力を提供し、Qwen3.6-35Bより約30%高速にタスクを完了する
AIエージェントの運用コスト削減は企業のAI採用拡大の最大の障壁の一つであり、Nvidiaがモデルルーティング技術とオープンモデルを組み合わせてコストを3分の1に削減できることを示した点は、AIインフラ市場の成長を加速させる可能性がある。特にLangChainでの74%コスト削減やRampでの58%コスト削減という実証データは、エンタープライズAIのROI議論に直接寄与する。Nvidiaがモデル提供のレイヤーでも競争力を強化していることは、AIスタック全体での同社の支配力がさらに強まることを示唆する。