AI News JAPAN

世界のAIニュースを最速で把握できるメディア

Advertisement

NVIDIAがAI工場の電力効率指標を「1メガワット当たりトークン数」に転換、Vera Rubin等の最新成果を公開

30秒サマリー

  • NVIDIAがAI Infra Summitで、AI工場の効率指標を「ピーク性能」から「1MW当たりトークン数」へ転換する方向性と複数の実証成果を発表
  • Lambda社がDSX MaxLPSを用い同一電力予算内でトークンスループット24%増・性能/W比23%改善を確認
  • Vera Rubin NVL72がMLPerf Inference v6.1プレビューでGB300 NVL72比3.7倍のスループットを記録

何が起きたか

NVIDIAは2025年9月15〜16日に米サンタクララで開催されたAI Infra Summit(参加者8,000人超、前年比約2.3倍)において、AIインフラの効率化に関する複数の成果と提携情報を公開した。登壇したIan Buck副社長(ハイパースケール・HPC担当)は、AIインフラの評価指標がピーク性能から「1メガワット当たり検証済みエージェント型トークン数」へ移行しつつあると述べ、AI工場はシリコンから電力グリッドまで一体設計(コデザイン)が必要だと強調した。

電力効率の実証面では、AIクラウドプロバイダーLambdaがDSX MaxLPSをNVIDIA Blackwellサーバー上で検証し、16ノード分の電力予算内で19ノードを稼働させることでクラスター全体のトークンスループットを約400万から500万tokens/秒(24%増)に引き上げ、性能/W比を23%改善したと発表。次世代のVera Rubin NVL72向けでは、適切な環境下においてDSX MaxLPSが同一MW予算内で最大40%のGPU容量増を実現できるとしている。

ベンチマーク面では、MLPerf Inference v6.1のプレビュー提出においてVera Rubin NVL72がGB300 NVL72比で最大3.7倍のスループットを記録。ソフトウェア最適化のみでv6.0比最大1.6倍の性能向上も達成した。エージェント向けベンチマーク「SemiAnalysis AgentX」では、DeepSeek V4 Proモデルを用いたテストでVera Rubin NVL72がGB300 NVL72比で最大30倍/MWのスループットを示し、コスト面では1Mトークン当たり最大45倍のコスト低減が示されたとしている。

パートナーシップでは、Emerald AIがSilicon Valley Powerのフレキシブル負荷接続プログラムを通じDSX Flexを用いてグリッドの需要信号に自動応答する実証を実施。Amazonのグループ会社Annapurna LabsがNVIDIAのNVHBMカスタム高帯域メモリ技術の共同開発を進めていることも明らかにされた。さらにPerplexity、ClickHouse、Redpanda等の複数スタートアップがVera CPUの自社ベンチマーク結果(例:Redpandaは他社CPU比レイテンシ5.5倍低減・スループット73%向上)を公開している。

原典ハイライト

「AIインフラの指標はピーク性能から1MWあたり検証済みエージェント型トークン数へ急速にシフトしている。AI工場はシリコンからグリッドまで一体設計されなければならない」(NVIDIA公式ブログより要約)。DSX MaxLPSは工場全体の電力最適化により1MWあたり最大1.4倍のトークン増を実現できるとしている。

出典: NVIDIA Blog(公式ブログ)

So What?(なぜ重要か)

AIインフラの競争軸が「計算ピーク性能」から「電力単位当たりの経済的生産量(トークン/MW)」へ明確に転換している。これはデータセンターの設計思想そのものを変える動きであり、GPU・ネットワーク・電力管理ソフトウェアを垂直統合で最適化するNVIDIAのフルスタック戦略が有利に働く構造となっている。電力制約が深刻なAI工場運営者にとって、同一インフラ投資から引き出せる収益性が大きく変わる可能性がある。

日本企業への示唆

日本では電力供給の制約とデータセンター立地の問題が顕在化しており、「同一電力枠内でいかに多くのAI処理をこなすか」は国内AI工場・クラウド事業者にとって喫緊の課題となりつつある。今回示されたDSX MaxLPSによる電力予算内での処理能力増(Lambda社実証:同予算で24%スループット増)や、グリッド連動型負荷調整(DSX Flex)は、電力会社や規制当局との折衝も含むインフラ戦略の再設計を促す可能性がある。AI投資を検討する経営層・インフラ担当者は、調達するGPUの世代や数だけでなく、電力管理ソフトウェアと一体化した「トークン/MW」での費用対効果をKPIとして設定することを検討すべき段階に来ている。

背景・経緯

NVIDIAはVera Rubin(第6世代NVLink搭載)、DSX(データセンター管理プラットフォーム)、Dynamoインファレンスソフトウェアなど、AI工場向けのフルスタック製品群を展開している。AI Infra Summitは今年の参加者が昨年の3,500人から8,000人超に急増しており、AIインフラへの業界関心の高まりを反映している。エージェント型AI(Agentic AI)の普及により、単一リクエスト処理とは異なる長文コンテキスト・複数ツール呼び出しを伴うワークロードが増加し、インフラへの要求が変質していることが背景にある。