Har fjärde generationens Tensorkärnor och en transformatormotor med FP8-precision som ger upp till 4X snabbare träning jämfört med föregående generation för GPT-3 (175B) -modeller, vilket dramatiskt påskyndar utvecklingen av stora språkmodeller och djupinlärningsarbetsflöden.
H100 har imponerande 640 Tensor Cores och 128 Ray Tracing Cores, vilket underlättar höghastighetsdatabehandling, kompletterat med 14 592 CUDA-kärnor för att uppnå otroliga 26 TeraFLOPS på fullständiga precisionsprocedurer, vilket gör den idealisk för de mest krävande beräkningsuppgifterna.
Fjärde generationens NVLink erbjuder 900 gigabyte per sekund (Gb/s) av GPU-till-GPU-sammankoppling, vilket möjliggör sömlös multi-GPU-skalning och distribuerad databehandling för AI-arbetsbelastningar på företagsnivå och högpresterande datorapplikationer.