NVIDIA A100 SXM 80GB در برابر NVIDIA H100 SXM
NVIDIA · Ampere
NVIDIA A100 SXM 80GB
در انتظار بازبینی
NVIDIA · Hopper
NVIDIA H100 SXM
در انتظار بازبینی
تفاوتهای اصلی
- پهنای باند حافظه: NVIDIA H100 SXM ۶۴٪ بیشتر (3,350 GB/s در برابر 2,039 GB/s)
- FP16/BF16 Tensor/Matrix: NVIDIA H100 SXM ۲۱۷٪ بیشتر (989.5 TFLOPS در برابر 312 TFLOPS)
- حداکثر توان (TDP/TBP): NVIDIA A100 SXM 80GB ۴۳٪ کمتر (400 W در برابر 700 W)
اعداد توان پردازشی Tensor/Matrix بدون sparsity (dense) درج شدهاند. وندورها معمولاً عدد با sparsity را که دو برابر است تبلیغ میکنند.
| مشخصه | NVIDIA A100 SXM 80GB | NVIDIA H100 SXM |
|---|---|---|
| کلیات | ||
| معماری | Ampere | Hopper |
| فرایند ساخت | TSMC 7N | TSMC 4N |
| فرمفکتور | SXM | SXM |
| حافظه | ||
| ظرفیت حافظه | 80 GB | 80 GB |
| نوع حافظه | HBM2e | HBM3 |
| پهنای باند حافظه | 2,039 GB/s | 3,350 GB/s |
| ECC | دارد | دارد |
| توان پردازشی (dense) | ||
| FP64 | 9.7 TFLOPS | 34 TFLOPS |
| FP64 Tensor/Matrix | 19.5 TFLOPS | 67 TFLOPS |
| FP32 | 19.5 TFLOPS | 67 TFLOPS |
| TF32 Tensor/Matrix | 156 TFLOPS | 494.5 TFLOPS |
| FP16/BF16 Tensor/Matrix | 312 TFLOPS | 989.5 TFLOPS |
| FP8 Tensor/Matrix | — | 1,979 TFLOPS |
| INT8 Tensor/Matrix | 624 TOPS | 1,979 TOPS |
| توان مصرفی | ||
| حداکثر توان (TDP/TBP) | 400 W | 700 W |
| ارتباطات | ||
| اتصال GPU به GPU | NVLink 3 | NVLink 4 |
| پهنای باند اتصال GPU به GPU | 600 GB/s | 900 GB/s |
| نسل PCIe | 4 | 5 |
| تعداد لین PCIe | 16 | 16 |
| تقسیمبندی سختافزاری | MIG، تا ۷ نمونه | MIG، تا ۷ نمونه |
مقدار بهتر