Dispose de cœurs Tensor de quatrième génération et d'un moteur de transformation avec une précision FP8 qui fournit une formation jusqu'à 4X plus rapide que la génération précédente pour les modèles GPT-3 (175B), accélérant considérablement le développement de grands modèles de langage et les flux de travail d'apprentissage profond.
Le H100 dispose d'un nombre impressionnant de 640 cœurs Tensor et de 128 cœurs de traçage de rayon, ce qui facilite le traitement des données à grande vitesse, complété par 14 592 cœurs CUDA pour atteindre un incroyable 26 teraFLOPS sur des procédures de précision complète, ce qui le rend idéal pour les tâches de calcul les plus exigeantes.
NVLink de quatrième génération offre 900 gigaoctets par seconde (Go/s) d'interconnexion GPU à GPU, permettant une mise à l'échelle multi-GPU transparente et un calcul distribué pour les charges de travail d'IA au niveau de l'entreprise et les applications de calcul haute performance.