NVIDIA H200 SXM در برابر NVIDIA L40S
NVIDIA · Hopper
NVIDIA H200 SXM
در انتظار بازبینی
NVIDIA · Ada Lovelace
NVIDIA L40S
در انتظار بازبینی
تفاوتهای اصلی
- ظرفیت حافظه: NVIDIA H200 SXM ۱۹۴٪ بیشتر (141 GB در برابر 48 GB)
- پهنای باند حافظه: NVIDIA H200 SXM ۴۵۶٪ بیشتر (4,800 GB/s در برابر 864 GB/s)
- FP16/BF16 Tensor/Matrix: NVIDIA H200 SXM ۱۷۳٪ بیشتر (989.5 TFLOPS در برابر 362 TFLOPS)
- حداکثر توان (TDP/TBP): NVIDIA L40S ۵۰٪ کمتر (350 W در برابر 700 W)
اعداد توان پردازشی Tensor/Matrix بدون sparsity (dense) درج شدهاند. وندورها معمولاً عدد با sparsity را که دو برابر است تبلیغ میکنند.
| مشخصه | NVIDIA H200 SXM | NVIDIA L40S |
|---|---|---|
| کلیات | ||
| معماری | Hopper | Ada Lovelace |
| فرایند ساخت | TSMC 4N | TSMC 4N |
| فرمفکتور | SXM | PCIe |
| حافظه | ||
| ظرفیت حافظه | 141 GB | 48 GB |
| نوع حافظه | HBM3e | GDDR6 |
| پهنای باند حافظه | 4,800 GB/s | 864 GB/s |
| ECC | دارد | دارد |
| توان پردازشی (dense) | ||
| FP64 | 34 TFLOPS | — |
| FP64 Tensor/Matrix | 67 TFLOPS | — |
| FP32 | 67 TFLOPS | 91.6 TFLOPS |
| TF32 Tensor/Matrix | 494.5 TFLOPS | 183 TFLOPS |
| FP16/BF16 Tensor/Matrix | 989.5 TFLOPS | 362 TFLOPS |
| FP8 Tensor/Matrix | 1,979 TFLOPS | 733 TFLOPS |
| INT8 Tensor/Matrix | 1,979 TOPS | 733 TOPS |
| توان مصرفی | ||
| حداکثر توان (TDP/TBP) | 700 W | 350 W |
| ارتباطات | ||
| اتصال GPU به GPU | NVLink 4 | — |
| پهنای باند اتصال GPU به GPU | 900 GB/s | — |
| نسل PCIe | 5 | 4 |
| تعداد لین PCIe | 16 | 16 |
| تقسیمبندی سختافزاری | MIG، تا ۷ نمونه | — |
مقدار بهتر