Nvidia、AIモデルをタスク中に再配置するルーター「Switchyard」を発表、コストを3分の1に削減
Nvidia's Switchyard router reshuffles AI models mid-task, cutting task costs to a third in its own tests
記事のポイント
📰ニュース
Nvidiaが、AIエージェントのタスク実行中に最適なモデルに切り替えるオープンソースルーター「NeMo Switchyard」と、専用モデル「Nemotron 3.5 Lightning」を発表しました。
🔍注目ポイント
Switchyardは、タスクの各ステップで最適なモデルを動的に選択・切り替えることで、フロンティアモデルと同等の性能を維持しつつ、コストを最大3分の1に削減できる点が技術的ポイントです。
🔮これからどうなる
企業はAIエージェントの運用コストを大幅に削減でき、より高度で複雑なAIエージェントを経済的に導入・運用できるようになるでしょう。
Nvidiaは、Nemotron 3.5 Lightning(300億パラメータのMixture-of-Expertsモデル)とNeMo Switchyardを組み合わせることで、ベンチマークコストを単一のフロンティアモデルの約3分の1に削減できると主張しています。
この発表は、AlibabaやMetaなど競合他社がオープンモデルを次々とリリースする中で行われ、Nvidiaはモデルとルーティングの両方をオープンソースで提供することで、AIエージェントのコスト削減を推進する狙いです。
この発表は、AlibabaやMetaなど競合他社がオープンモデルを次々とリリースする中で行われ、Nvidiaはモデルとルーティングの両方をオープンソースで提供することで、AIエージェントのコスト削減を推進する狙いです。
AIエージェントの運用コストは大きな課題だったので、Nvidiaがモデルとルーターの両面から解決策を提示したのは画期的ですね。これにより、多くの企業がAIエージェントを導入しやすくなり、私たちの仕事のやり方も大きく変わるかもしれません。