Technology

ツール利用などを支えるエージェント向けCPU「Vera」の出荷開始

この記事のポイント

  1. 実現したこと

    エージェント向けCPU「Vera」は出荷が始まり、設計公表から製品供給の段階へ進んだ。

  2. 実現の仕組み

    CPU集約型のオーケストレーション、ツール利用、コード実行、データ処理、シミュレーションをVera CPUへ割り当てる構成を採る。

  3. 得られた結果

    ラックスケールシステムの初期測定では、従来機に対して1メガワット当たり最大30倍のスループットを記録したが、この値にVera CPUのツール呼び出し性能は含まれない。

  4. 従来との違い

    GPU中心の推論基盤から、CPU、GPU、推論アクセラレーター、接続・ネットワーク部品を含む7チップ構成へ拡張した。

抽象化したCPUを中心に、異種コンピュート部品とデータ経路が結ばれたエージェント向け計算基盤の編集イラスト
AI生成画像

ツール利用やコード実行などを支えるエージェント型AI向けCPUが出荷段階に入った。NVIDIAのVera CPUは、GPUや推論アクセラレーター、接続・ネットワーク部品と組み合わせる7チップ構成の一部となる。

エージェント向けCPUが製品供給の段階へ

エージェント型AI向けに設計されたNVIDIA初のCPU「NVIDIA Vera CPU」の出荷が始まった。NVIDIAが示した段階は、設計の公表や採用予定にとどまらず、CPUを製品として供給する段階への移行である。

エージェント型AIでは、モデルの推論演算に加え、外部ツールの利用やコード実行を取りまとめるCPU側の処理が生じる。Vera CPUは、この処理経路をエージェント向け基盤へ組み込むプロセッサとして位置付けられている。

ツール利用とコード実行をCPUへ割り当てる

SpaceXAIは、将来のAIアーキテクチャにVera CPUを採用し、オーケストレーション、ツール利用、コード実行、データ処理、シミュレーションを高速化する計画を示した。これは稼働済みの導入事例ではなく、CPU集約処理をVera CPUへ割り当てる採用計画である。

NVIDIAは、Vera CPUが高いコア当たり性能とメモリ帯域を備え、負荷がかかった状態でも予測可能な性能を提供すると説明している。こうした設計によってエージェントの処理時間を短縮し、GPU基盤の稼働率維持を支えるとしている。

CPUを含む7種類のチップで推論基盤を構成

エージェント向けプラットフォームのNVIDIA Vera Rubinは、用途の異なる7種類のチップを組み合わせる。構成要素はVera CPU、Rubin GPU、Groq 3 LPU、NVLink 6 Switch、BlueField-4 DPU、Spectrum-6 SPX、ConnectX-9 SuperNICである。

この構成には、CPUとGPUだけでなく、推論アクセラレーター、チップ間接続、データ処理、ネットワークを担う部品も含まれる。Vera CPUの出荷開始により、エージェント向けCPUは、この異種チップ構成を形作る供給段階の製品となった。

最大30倍の測定値からCPUの寄与を切り分ける

NVIDIAは、ラックスケール推論システム「NVIDIA Vera Rubin NVL72」の評価にSemiAnalysis AgentXワークロードを用いた。このワークロードには、実際のエージェント型コーディングセッションで生じたコンテキストの増加、ツール呼び出し、サブエージェント生成が保存されている。

NVIDIAの初期測定では、DeepSeek V4 Proを動かしたVera Rubin NVL72が、GB300 NVL72に対して1メガワット当たり最大30倍のスループットを示した。ただし、この結果はSemiAnalysisの確認待ちであり、Vera CPUによるツール呼び出しの性能を含まないため、CPU単体の高速化を示す数値ではない。