Cuenta con núcleos Tensor de cuarta generación y un motor Transformer con precisión FP8 que proporciona un entrenamiento hasta 4 veces más rápido que la generación anterior para los modelos GPT-3 (175B), lo que acelera drásticamente el desarrollo de grandes modelos de lenguaje y los flujos de trabajo de aprendizaje profundo.
La H100 cuenta con la impresionante cantidad de 640 núcleos Tensor y 128 núcleos de trazado de rayos, lo que facilita el procesamiento de datos a alta velocidad, complementado con 14 592 núcleos CUDA para lograr la increíble cantidad de 26 teraFLOPS en procedimientos de precisión total, lo que la hace ideal para las tareas computacionales más exigentes.
NVLink de cuarta generación ofrece 900 gigabytes por segundo (GB/s) de interconexión GPU a GPU, lo que permite un escalado multi-GPU sin fisuras y una computación distribuida para cargas de trabajo de IA de nivel empresarial y aplicaciones de computación de alto rendimiento.