詳細・ビジネスへの影響
米国NVIDIAは、常時稼働する自律エージェント(Agentic AI)ワークロードに特化して設計された300億(30B)パラメータの最新オープンモデル「Nemotron 3.5 Lightning」を公開しました。
Nemotron 3.5 Lightningは、フォワードパス(推論処理時)に全体のわずか10%に相当する30億パラメータのみを選択的にアクティブ化する「ハイブリッドMixture-of-Experts(MoE)」構造を採用。
これにより、高精度な推論性能を維持したまま、単一GPU上での推論スループットと応答速度を前世代比で数倍以上に向上させています。
さらにNVIDIAは、複雑なマルチエージェントシステム内でタスクを最適なモデルへと自動ルーティングする制御ライブラリ「NeMo Switchyard」も同時にオープンソース提供を開始。
Amazon SageMaker JumpStartやOllamaなどの主要エコシステムで即座に試行可能となっており、企業における自律型AIエージェントの商用導入が一気に加速する見通しです(一次ソース:NVIDIA Developer Blog公式発表)。
