Behåll dina sbatch-skript. Släpp klusterunderhållet. BUZZ HPC är värd för en minimal men ändå gedigen SLURM-miljö på förstklassiga grafikprocessorer, så forskare och ingenjörer kan köra jobb istället för att fixa noder.
Controller + inloggningsnod förkonfigurerad; GPU-beräkningsnoder registrerade via Ansible. Standard SLURM 23.x CLI ur lådan.
Köer för noder H100, B200 och A6000; schemaläggning med rättvis delning aktiverad. Ingen återfyllning eller preemption hos MVP.
Skicka in en förfrågan, och vi lägger till eller tar bort noder. Timmar, inte veckor. Betala endast för reserverade GPU:er.
NFS-hem/projektutrymme plus lokal NVMe-skrapa. Parallellt filsystem och objektlagring är färdplansobjekt.
Prometheus + Grafana instrumentpaneler; BUZZ-ops tar emot hårdvaruvarningar och byter misslyckade noder automatiskt.
VPN-isolerat kluster; Unix-användar/gruppseparation. Valfri identitetsintegration kommer snart.
HPC-veteraner på samtal (9 × 5) med 24 × 7 hårdvarueskalering.
GPU-hästkrafter i bare metal, noll schemaläggningsunderhåll och människor som talar SLURM flytande. Det är den kortaste vägen från forskningsidé till resultat - ingen datacenteruppbyggnad krävs.

Portera befintliga SLURM-arbetsbelastningar till snabbare grafikprocessorer utan att skriva om jobbskript.
Schemalägg PyTorch-jobb med flera noder under ett välkänt batchsystem.
Håll lokala kluster små; flöda över till BUZZ när efterfrågan ökar.
Förbered en tillfällig GPU-superdator för en kurs eller hackathon och minska den sedan.
Få ditt SLURM-kluster att köra på grafikprocessorer i världsklass på några dagar.