PRODUCT

AMD Instinct MI350P

BUILT FOR THE INFRASTRUCTURE YOU HAVE.
READY FOR THE AI YOU NEED

  • 144GB HBM3e Memory
  • TBP 600W

AMD Instinct MI350P PCIe カードは、大容量 144GBの HBM3eメモリと 4TB/sのメモリ帯域幅を備え、最新のハイエンド GPUサーバに搭載することができます。複雑なインフラ変更を伴わずに最新の生成 AIやエージェンティック AIのワークロードを大幅に高速化します。
詳しくは担当営業までお問合せください。搭載できるサーバやワークステーションをご提案させていただきます。

AMD Instinct MI350P PCIe カード特徴

  • 最先端 CDNA 4 アーキテクチャ採用
  • 超広帯域メモリ 144GB HBM3eメモリを搭載
    メモリ帯域幅 4TB/s
  • 演算性能は低精度のデータ形式 MXFP4 / MXFP6 にネイティブ対応
    ピーク性能は 4.6 PFLOPS
  • ハードウェアレベルでのパーティショニング(分割)に対応
    最大 4つの独立したインスタンスにセキュア分割
  • AMD ROCm サポート
  • PCIe5.0 サポート
  • 最大消費電力 600W
    (サーバ環境に合わせて450Wに制限・変更することも可能)

AMD Instinct MI350P PCIe カード仕様

GPU 仕様

GPU アーキテクチャ CDNA4
Lithography TSMC 3nm | 6nm
FinFET
ストリーミング プロセッサ 8,192
マトリックス コア 512
演算ユニット 128
ピーク時エンジン クロック 2200 MHz
ピーク Microscaling 4 ビット精度マトリックス (MXFP4) 性能 4.6 PFLOPs
ピーク Microscaling 6 ビット精度マトリックス (MXFP6) 性能 4.6 PFLOPs
ピーク Microscaling 8 ビット精度マトリックス (MXFP8) 性能 4.6 PFLOPs
ピーク Open Compute Project 8 ビット精度マトリックス (OCP FP8) 性能 (構造化スパース性対応) 2.3 PFLOPs
ピーク半精度マトリックス (FP16) 性能 1.15 PFLOPs
ピーク半精度マトリックス (FP16) 性能 (構造化スパース性対応) 2.3 PFLOPs
半精度 (FP16) ピーク性能 72 TFLOPs
単精度マトリックス (FP32) ピーク性能 72 TFLOPs
単精度 (FP32) ピーク性能 72 TFLOPs
倍精度マトリックス (FP64) ピーク性能 36 TFLOPs
倍精度 (FP64) ピーク性能 36 TFLOPs
ピーク INT8 マトリックス性能 2.3 POPs
ピーク INT8 マトリックス性能 (構造化スパース性対応) 4.6 POPs
Peak bfloat16 (BF16) Matrix Performance 1.15 PFLOPs
Peak bfloat16 (BF16) Matrix Performance with Structured Sparsity 2.3 PFLOPs
トランジスタ数 73 Billion
バス タイプ PCIe 5.0 x16
OS サポート Linux x86 64-Bit
標準ボード電力 (TBP) 600W TBP (Max); 450W TBP configurable

GPUメモリ

ラスト レベル キャッシュ (LLC) 128 MB
専用メモリ サイズ 144 GB
専用メモリ タイプ HBM3e
Infinity Cache Yes
メモリ インターフェイス 4096ビット
ピーク メモリ帯域幅 4 TB/s
メモリ ECC サポート 〇 (フルチップ)

AMD CDNA 4 アーキテクチャ

AMD CDNA 4は AMD Instinct MI350 シリーズ GPU の基盤となる専用演算アーキテクチャです。データ移動のオーバーヘッドを削減し、電力効率を高めるように設計されたチップレットテクノロジによる高度なパッケージングを特徴としています。

White Paper

AIスタック開発に AMD Instinct MI350P PCIe カードを選ぶべき5つの理由

  1. 現行インフラで実現する、高次元の AIパフォーマンス。
  2. AIの規模拡大だけで終わらせない。確かな投資対効果(ROI)の確立へ。
  3. オープンで確かな、企業のための AIスタック。
  4. 最小限のコード変更で、スムーズな AI実装を実現。
  5. セキュアな AI実装を、標準機能で実現。

Document

AMD ENTERPRISE AI SOFTWARE

AMD Enterprise AIリファレンススタックと GPU Operatorの連携により、AMDハードウェア上でのAI展開を加速します。これにより、複雑な AIワークフローの統合やパフォーマンスの最適化、スケーラブルな運用をシームレスに実現します。

AMD Enterprise AI Reference Stack

主要なオープンソースAIフレームワークや生成AIモデルを、企業環境に対応したKubernetesプラットフォームと連携させることで、企業はベアメタル(物理)サーバの計算リソースから、わずか数分で本番運用レベルのAI環境を構築できます。これにより、AMDの計算プラットフォームにおいて、AIの実証実験から大規模な本番運用へ移行するまでの時間を最小限に抑えることが可能になります。

https://www.amd.com/en/products/software/enterprise-ai-reference-stack.html

AMD Documentation Hub

AMD プロセッサ、アクセラレータ、グラフィックス、およびその他の製品に関する、ソリューション概要、データシート、チューニング ガイド、プログラマ リファレンスなどの各種資料を検索できます。

https://www.amd.com/ja/search/documentation/hub.html#q=Instinct%20MI350P&sortCriteria=%40amd_release_date%20descending

AMD ROCm Core SDK

AMDハードウェア上でGPUアクセラレーション対応アプリケーションを開発するために必要なすべてが揃っています。ROCm Core SDKには、ROCmソフトウェアスタックの基盤となる必須ライブラリ、ランタイム、コンパイラ、ツールが含まれています。

https://www.amd.com/en/products/software/rocm/sdk.html

AMD Instinct MI350P PCIe Cards – Data Sheet

性能比較

AMD
Instinct MI350P
PCIe Cards
NVIDIA
H200 NVL
NVIDIA
RTX PRO 6000
Blackwell Max-Q
アーキテクチャ CDNA 4 Hopper Blackwell
GPUメモリ 144GB HBM3e 141GB HBM3e 96GB GDDR7
メモリ帯域幅 最大 4.0 TB/s 4.8 TB/s 1,792 GB/s
単精度性能 (FP32) 72 TFLOPS
(ピーク)
67 TFLOPS 110 TFLOPS
倍精度性能 (FP64) 36 TFLOPS
(ピーク)
34 TFLOPS
AI/Tensor性能 4.6 PFLOPS
(MXFP4)
1.98 PFLOPS
(FP8)
3511 AI TOPS
開発環境 ROCm 7.x NVIDIA CUDA NVIDIA CUDA
最大消費電力 600W
(450W設定可)
600W 300W

弊社では、科学技術計算や解析などの各種アプリケーションについて動作検証を行い、
すべてのセットアップをおこなっております。
お客様が必要とされる環境にあわせた最適なシステム構成をご提案いたします。