AMD Instinct MI350P

BUILT FOR THE INFRASTRUCTURE YOU HAVE.
READY FOR THE AI YOU NEED
- 144GB HBM3e Memory
- TBP 600W
AMD Instinct MI350P PCIe カードは、大容量 144GBの HBM3eメモリと 4TB/sのメモリ帯域幅を備え、最新のハイエンド GPUサーバに搭載することができます。複雑なインフラ変更を伴わずに最新の生成 AIやエージェンティック AIのワークロードを大幅に高速化します。
詳しくは担当営業までお問合せください。搭載できるサーバやワークステーションをご提案させていただきます。

AMD Instinct MI350P PCIe カード特徴
- 最先端 CDNA 4 アーキテクチャ採用
- 超広帯域メモリ 144GB HBM3eメモリを搭載
メモリ帯域幅 4TB/s - 演算性能は低精度のデータ形式 MXFP4 / MXFP6 にネイティブ対応
ピーク性能は 4.6 PFLOPS - ハードウェアレベルでのパーティショニング(分割)に対応
最大 4つの独立したインスタンスにセキュア分割 - AMD ROCm サポート
- PCIe5.0 サポート
- 最大消費電力 600W
(サーバ環境に合わせて450Wに制限・変更することも可能)
AMD Instinct MI350P PCIe カード仕様
GPU 仕様
| GPU アーキテクチャ | CDNA4 |
| Lithography | TSMC 3nm | 6nm FinFET |
| ストリーミング プロセッサ | 8,192 |
| マトリックス コア | 512 |
| 演算ユニット | 128 |
| ピーク時エンジン クロック | 2200 MHz |
| ピーク Microscaling 4 ビット精度マトリックス (MXFP4) 性能 | 4.6 PFLOPs |
| ピーク Microscaling 6 ビット精度マトリックス (MXFP6) 性能 | 4.6 PFLOPs |
| ピーク Microscaling 8 ビット精度マトリックス (MXFP8) 性能 | 4.6 PFLOPs |
| ピーク Open Compute Project 8 ビット精度マトリックス (OCP FP8) 性能 (構造化スパース性対応) | 2.3 PFLOPs |
| ピーク半精度マトリックス (FP16) 性能 | 1.15 PFLOPs |
| ピーク半精度マトリックス (FP16) 性能 (構造化スパース性対応) | 2.3 PFLOPs |
| 半精度 (FP16) ピーク性能 | 72 TFLOPs |
| 単精度マトリックス (FP32) ピーク性能 | 72 TFLOPs |
| 単精度 (FP32) ピーク性能 | 72 TFLOPs |
| 倍精度マトリックス (FP64) ピーク性能 | 36 TFLOPs |
| 倍精度 (FP64) ピーク性能 | 36 TFLOPs |
| ピーク INT8 マトリックス性能 | 2.3 POPs |
| ピーク INT8 マトリックス性能 (構造化スパース性対応) | 4.6 POPs |
| Peak bfloat16 (BF16) Matrix Performance | 1.15 PFLOPs |
| Peak bfloat16 (BF16) Matrix Performance with Structured Sparsity | 2.3 PFLOPs |
| トランジスタ数 | 73 Billion |
| バス タイプ | PCIe 5.0 x16 |
| OS サポート | Linux x86 64-Bit |
| 標準ボード電力 (TBP) | 600W TBP (Max); 450W TBP configurable |
GPUメモリ
| ラスト レベル キャッシュ (LLC) | 128 MB |
| 専用メモリ サイズ | 144 GB |
| 専用メモリ タイプ | HBM3e |
| Infinity Cache | Yes |
| メモリ インターフェイス | 4096ビット |
| ピーク メモリ帯域幅 | 4 TB/s |
| メモリ ECC サポート | 〇 (フルチップ) |
AMD CDNA 4 アーキテクチャ
AMD CDNA 4は AMD Instinct MI350 シリーズ GPU の基盤となる専用演算アーキテクチャです。データ移動のオーバーヘッドを削減し、電力効率を高めるように設計されたチップレットテクノロジによる高度なパッケージングを特徴としています。
White Paper
AIスタック開発に AMD Instinct MI350P PCIe カードを選ぶべき5つの理由
- 現行インフラで実現する、高次元の AIパフォーマンス。
- AIの規模拡大だけで終わらせない。確かな投資対効果(ROI)の確立へ。
- オープンで確かな、企業のための AIスタック。
- 最小限のコード変更で、スムーズな AI実装を実現。
- セキュアな AI実装を、標準機能で実現。
Document
AMD ENTERPRISE AI SOFTWARE
AMD Enterprise AIリファレンススタックと GPU Operatorの連携により、AMDハードウェア上でのAI展開を加速します。これにより、複雑な AIワークフローの統合やパフォーマンスの最適化、スケーラブルな運用をシームレスに実現します。

AMD Enterprise AI Reference Stack

主要なオープンソースAIフレームワークや生成AIモデルを、企業環境に対応したKubernetesプラットフォームと連携させることで、企業はベアメタル(物理)サーバの計算リソースから、わずか数分で本番運用レベルのAI環境を構築できます。これにより、AMDの計算プラットフォームにおいて、AIの実証実験から大規模な本番運用へ移行するまでの時間を最小限に抑えることが可能になります。
https://www.amd.com/en/products/software/enterprise-ai-reference-stack.html
AMD Documentation Hub

AMD プロセッサ、アクセラレータ、グラフィックス、およびその他の製品に関する、ソリューション概要、データシート、チューニング ガイド、プログラマ リファレンスなどの各種資料を検索できます。
AMD ROCm Core SDK

AMDハードウェア上でGPUアクセラレーション対応アプリケーションを開発するために必要なすべてが揃っています。ROCm Core SDKには、ROCmソフトウェアスタックの基盤となる必須ライブラリ、ランタイム、コンパイラ、ツールが含まれています。
https://www.amd.com/en/products/software/rocm/sdk.html
AMD Instinct MI350P PCIe Cards – Data Sheet
性能比較
| AMD Instinct MI350P PCIe Cards |
NVIDIA H200 NVL |
NVIDIA RTX PRO 6000 Blackwell Max-Q |
|
| アーキテクチャ | CDNA 4 | Hopper | Blackwell |
| GPUメモリ | 144GB HBM3e | 141GB HBM3e | 96GB GDDR7 |
| メモリ帯域幅 | 最大 4.0 TB/s | 4.8 TB/s | 1,792 GB/s |
| 単精度性能 (FP32) | 72 TFLOPS (ピーク) |
67 TFLOPS | 110 TFLOPS |
| 倍精度性能 (FP64) | 36 TFLOPS (ピーク) |
34 TFLOPS | – |
| AI/Tensor性能 | 4.6 PFLOPS (MXFP4) |
1.98 PFLOPS (FP8) |
3511 AI TOPS |
| 開発環境 | ROCm 7.x | NVIDIA CUDA | NVIDIA CUDA |
| 最大消費電力 | 600W (450W設定可) |
600W | 300W |
弊社では、科学技術計算や解析などの各種アプリケーションについて動作検証を行い、
すべてのセットアップをおこなっております。
お客様が必要とされる環境にあわせた最適なシステム構成をご提案いたします。




