AMD Instinct MI325X در برابر NVIDIA A100 SXM 80GB
AMD · CDNA 3
AMD Instinct MI325X
در انتظار بازبینی
NVIDIA · Ampere
NVIDIA A100 SXM 80GB
در انتظار بازبینی
تفاوتهای اصلی
- ظرفیت حافظه: AMD Instinct MI325X ۲۲۰٪ بیشتر (256 GB در برابر 80 GB)
- پهنای باند حافظه: AMD Instinct MI325X ۱۹۴٪ بیشتر (6,000 GB/s در برابر 2,039 GB/s)
- FP16/BF16 Tensor/Matrix: AMD Instinct MI325X ۳۱۹٪ بیشتر (1,307.4 TFLOPS در برابر 312 TFLOPS)
- حداکثر توان (TDP/TBP): NVIDIA A100 SXM 80GB ۶۰٪ کمتر (400 W در برابر 1,000 W)
اعداد توان پردازشی Tensor/Matrix بدون sparsity (dense) درج شدهاند. وندورها معمولاً عدد با sparsity را که دو برابر است تبلیغ میکنند.
| مشخصه | AMD Instinct MI325X | NVIDIA A100 SXM 80GB |
|---|---|---|
| کلیات | ||
| معماری | CDNA 3 | Ampere |
| فرایند ساخت | TSMC 5nm / 6nm (chiplet) | TSMC 7N |
| فرمفکتور | OAM | SXM |
| حافظه | ||
| ظرفیت حافظه | 256 GB | 80 GB |
| نوع حافظه | HBM3e | HBM2e |
| پهنای باند حافظه | 6,000 GB/s | 2,039 GB/s |
| ECC | دارد | دارد |
| توان پردازشی (dense) | ||
| FP64 | 81.7 TFLOPS | 9.7 TFLOPS |
| FP64 Tensor/Matrix | 163.4 TFLOPS | 19.5 TFLOPS |
| FP32 | 163.4 TFLOPS | 19.5 TFLOPS |
| TF32 Tensor/Matrix | 653.7 TFLOPS | 156 TFLOPS |
| FP16/BF16 Tensor/Matrix | 1,307.4 TFLOPS | 312 TFLOPS |
| FP8 Tensor/Matrix | 2,614.9 TFLOPS | — |
| INT8 Tensor/Matrix | 2,614.9 TOPS | 624 TOPS |
| توان مصرفی | ||
| حداکثر توان (TDP/TBP) | 1,000 W | 400 W |
| ارتباطات | ||
| اتصال GPU به GPU | Infinity Fabric | NVLink 3 |
| پهنای باند اتصال GPU به GPU | 896 GB/s | 600 GB/s |
| نسل PCIe | 5 | 4 |
| تعداد لین PCIe | 16 | 16 |
| تقسیمبندی سختافزاری | — | MIG، تا ۷ نمونه |
مقدار بهتر