記事一覧へ戻る
計算資源・チップ

AMDのMI455XとHelios、NVIDIAの牙城に迫るシステム戦略

読了目安 3 分

導入

AMDはAdvancing AI 2026で、Instinct MI455XアクセラレータとHeliosラック級システムを発表した。「世界初の2nm GPU」という見出しは目を引くが、本質はそこだけではない。AMDは単体アクセラレータの販売から、AIデータセンター向けのラック単位インフラ提供へ踏み出そうとしている。

主要ポイント

  • 2nmの意味は正確に見る必要がある。 MI455Xは約3200億トランジスタを持つChiplet製品で、4つのXCD計算チップレットにTSMC N2を使う。一方、FCDやI/O部分はN3Pだ。つまり、パッケージ全体が2nmというより、2nm計算チップレットを採用したデータセンターGPUと見るべきだ。
  • メモリが競争軸になる。 MI455Xは1基あたり432GBのHBM4を搭載し、Heliosラックでは72基のGPUにより合計約31TBのGPUメモリを持つ。長文脈推論、エージェントの同時実行、MoEモデルでは、ピークFLOPS以上にメモリ容量とKV Cacheの余裕が効いてくる。
  • HeliosはGPUカードではなくAI工場だ。 1ラックに72基のMI455X GPUと18基のEPYC Venice CPUを搭載し、FP4で約2.9 ExaFLOPSを提供する。OCP、UALink、UALoE、Ultra Ethernet関連技術、Pensandoネットワークチップを組み合わせた開放型の設計思想も特徴だ。
  • 顧客の顔ぶれは重要だ。 OpenAI、Meta、Microsoft、Oracle、Anthropicの参加は、大手AI企業がNVIDIA一社依存を避けたいと考えていることを示している。

意義と影響

NVIDIAの強さはGPU単体ではない。NVLink、NVSwitch、InfiniBand、Spectrum-X、CUDA、各種ライブラリ、運用ツールまで含む閉じた完成度の高いスタックにある。AMDはこれに対し、よりオープンな標準を使い、クラウド事業者やOEMが自社環境に合わせて設計しやすい道を選んだ。ただし、その分だけ互換性検証やシステム統合の難度は上がる。

ソフトウェアも大きな論点だ。AMDは、大手顧客がPyTorch、vLLM、Tritonなど高い抽象レイヤーで開発しており、CUDAの存在感は薄れていると見る。この見方には一定の妥当性がある。しかしCUDAは単なるAPIではなく、ライブラリ、コンパイラ、ランタイム、デバッグ、性能分析、長年の最適化ノウハウを含むエコシステムだ。

そのため、MI455XとHeliosはAMDにとって入場券であり、勝利宣言ではない。今後は、2nmチップレット、HBM4、先端パッケージを計画通り供給できるか、理論性能を実際のスループットやTokenあたりコストに変換できるか、そしてROCmを特別対応なしで使える基盤にできるかが問われる。これを乗り越えた時、AIチップ市場の力学は大きく変わる可能性がある。

出典:InfoQ 中文

コメント

ログイン状態を確認中…

コメントを読み込み中…

関連記事

CCTest · Blog
倒れた送電線が示した、AIデータセンター時代の電力網リスク
計算資源・チップ
cctest.ai
計算資源・チップ

倒れた送電線が示した、AIデータセンター時代の電力網リスク

ワシントンDC近郊の送電線トラブルは停電には至らなかったが、PJM電力網に大きな電圧変動を起こした。背景には、北バージニアのデータセンター群がほぼ同時にバックアップ電源へ切り替わったことがある。

続きを読む