★4 LLM EN VentureBeat AI by Synapse Flow 編集部

Nvidia、AIモデルをタスク中に再配置するルーター「Switchyard」を発表、コストを3分の1に削減

Nvidia's Switchyard router reshuffles AI models mid-task, cutting task costs to a third in its own tests

記事のポイント

📰ニュース

Nvidiaが、AIエージェントのタスク実行中に最適なモデルに切り替えるオープンソースルーター「NeMo Switchyard」と、専用モデル「Nemotron 3.5 Lightning」を発表しました。

🔍注目ポイント

Switchyardは、タスクの各ステップで最適なモデルを動的に選択・切り替えることで、フロンティアモデルと同等の性能を維持しつつ、コストを最大3分の1に削減できる点が技術的ポイントです。

🔮これからどうなる

企業はAIエージェントの運用コストを大幅に削減でき、より高度で複雑なAIエージェントを経済的に導入・運用できるようになるでしょう。

Nvidiaは、Nemotron 3.5 Lightning(300億パラメータのMixture-of-Expertsモデル)とNeMo Switchyardを組み合わせることで、ベンチマークコストを単一のフロンティアモデルの約3分の1に削減できると主張しています。
この発表は、AlibabaやMetaなど競合他社がオープンモデルを次々とリリースする中で行われ、Nvidiaはモデルとルーティングの両方をオープンソースで提供することで、AIエージェントのコスト削減を推進する狙いです。
💡
編集部の視点

AIエージェントの運用コストは大きな課題だったので、Nvidiaがモデルとルーターの両面から解決策を提示したのは画期的ですね。これにより、多くの企業がAIエージェントを導入しやすくなり、私たちの仕事のやり方も大きく変わるかもしれません。

元記事を読む →

関連記事