AMD Instinct MI300X در برابر NVIDIA H100 SXM
AMD · CDNA 3
AMD Instinct MI300X
در انتظار بازبینی
NVIDIA · Hopper
NVIDIA H100 SXM
در انتظار بازبینی
تفاوتهای اصلی
- ظرفیت حافظه: AMD Instinct MI300X ۱۴۰٪ بیشتر (192 GB در برابر 80 GB)
- پهنای باند حافظه: AMD Instinct MI300X ۵۸٪ بیشتر (5,300 GB/s در برابر 3,350 GB/s)
- FP16/BF16 Tensor/Matrix: AMD Instinct MI300X ۳۲٪ بیشتر (1,307.4 TFLOPS در برابر 989.5 TFLOPS)
- حداکثر توان (TDP/TBP): NVIDIA H100 SXM ۷٪ کمتر (700 W در برابر 750 W)
اعداد توان پردازشی Tensor/Matrix بدون sparsity (dense) درج شدهاند. وندورها معمولاً عدد با sparsity را که دو برابر است تبلیغ میکنند.
| مشخصه | AMD Instinct MI300X | NVIDIA H100 SXM |
|---|---|---|
| کلیات | ||
| معماری | CDNA 3 | Hopper |
| فرایند ساخت | TSMC 5nm / 6nm (chiplet) | TSMC 4N |
| فرمفکتور | OAM | SXM |
| حافظه | ||
| ظرفیت حافظه | 192 GB | 80 GB |
| نوع حافظه | HBM3 | HBM3 |
| پهنای باند حافظه | 5,300 GB/s | 3,350 GB/s |
| ECC | دارد | دارد |
| توان پردازشی (dense) | ||
| FP64 | 81.7 TFLOPS | 34 TFLOPS |
| FP64 Tensor/Matrix | 163.4 TFLOPS | 67 TFLOPS |
| FP32 | 163.4 TFLOPS | 67 TFLOPS |
| TF32 Tensor/Matrix | 653.7 TFLOPS | 494.5 TFLOPS |
| FP16/BF16 Tensor/Matrix | 1,307.4 TFLOPS | 989.5 TFLOPS |
| FP8 Tensor/Matrix | 2,614.9 TFLOPS | 1,979 TFLOPS |
| INT8 Tensor/Matrix | 2,614.9 TOPS | 1,979 TOPS |
| توان مصرفی | ||
| حداکثر توان (TDP/TBP) | 750 W | 700 W |
| ارتباطات | ||
| اتصال GPU به GPU | Infinity Fabric | NVLink 4 |
| پهنای باند اتصال GPU به GPU | 896 GB/s | 900 GB/s |
| نسل PCIe | 5 | 5 |
| تعداد لین PCIe | 16 | 16 |
| تقسیمبندی سختافزاری | — | MIG، تا ۷ نمونه |
مقدار بهتر