Program: Luni - Vineri 09:30-18:00 PM

Nu ai niciun produs în coș.

Supermicro, arhitectul celui mai mare cluster AI răcit cu lichid din lume

iulie 14, 2025

Clusterul AI răcit cu lichid Supermicro este coloana vertebrală a Colossus, cel mai mare sistem AI din lume, construit pentru xAI, compania fondată de Elon Musk. Cu peste 4.000 de noduri GPU, livrate și integrate într-un timp record, Supermicro oferă o soluție completă pentru nevoile celor mai complexe modele AI, precum cele folosite pentru antrenarea LLM-urilor. Sistemul integrează toate componentele esențiale – servere GPU, soluții de rețea de mare viteză, tehnologie de răcire avansată și instrumente de management – într-o arhitectură unitară, validată și sustenabilă.

Performanță de vârf cu clusterul AI răcit cu lichid Supermicro

Soluția Supermicro este optimizată pentru aplicații AI și HPC, oferind o combinație de răcire directă cu lichid (direct-to-chip) și imersiune. Aceste tehnologii permit o densitate mare de procesoare GPU într-un spațiu redus, reduc semnificativ consumul de energie destinat climatizării și mențin performanțele stabile în regim continuu. Clusterul Colossus reprezintă un exemplu clar de integrare eficientă la scară largă, fiind în același timp sustenabil și scalabil.

Clusterul AI răcit cu lichid Supermicro este construit pe o arhitectură de înaltă densitate ce integrează 32 de sisteme Supermicro 4U HGX cu opt GPU-uri NVIDIA H100 sau H200 fiecare, răcite cu lichid și distribuite în doar cinci rackuri. Acest design permite instalarea a 256 de GPU-uri într-o unitate scalabilă, cu un total de 20 TB de memorie HBM3 pentru H100 sau 36 TB de HBM3e în cazul versiunii H200. Soluția oferă un raport de rețea 1:1 pentru fiecare GPU, activând tehnologii precum NVIDIA GPUDirect RDMA și GPUDirect Storage – esențiale pentru antrenarea modelelor LLM de ordinul trilioanelor de parametri.

Cluster AI de top, răcit cu lichid

Soluția personalizată de răcire cu lichid dezvoltată de Supermicro nu doar dublează densitatea de calcul în raport cu sistemele tradiționale, ci reduce și consumul de energie electrică al centrului de date cu până la 40%. De asemenea, infrastructura este compatibilă cu platformele de rețea NVIDIA Quantum-2 InfiniBand și Spectrum-X Ethernet, oferind o lățime de bandă optimă pentru sarcinile de antrenare AI.

Supermicro integrează și un pipeline personalizat de stocare pentru datele AI, compatibil cu cele mai avansate sisteme de fișiere paralele din industrie, optimizate pentru viteză și scalabilitate. În plus, soluția este certificată pentru platforma NVIDIA AI Enterprise, inclusiv suport pentru microserviciile NVIDIA NIM – facilitând implementarea rapidă și sigură a aplicațiilor AI la scară enterprise.

Tehnologie sustenabilă și livrare rapidă

Unul dintre avantajele strategice oferite de Supermicro este capacitatea de a livra sisteme rack-scale complete într-un timp extrem de scurt. Compania a demonstrat că poate construi, testa și integra infrastructuri complexe de centre de date AI în doar câteva săptămâni, datorită unei abordări de tip building-block, bazate pe module validate. În același timp, utilizarea tehnologiei de răcire cu lichid reduce costurile operaționale și impactul asupra mediului, permițând companiilor să îndeplinească cerințele ESG tot mai stricte.

Interiorul clusterului xAI Colossus de 100K GPU

Clusterul AI răcit cu lichid Supermicro reprezintă un nou punct de referință pentru proiectele AI la scară largă. Prin integrarea hardware-ului de ultimă generație, a soluțiilor avansate de răcire și a unei livrări rapide, Supermicro transformă modul în care organizațiile pot construi și opera infrastructuri AI de top. Cu proiecte precum Colossus, compania se poziționează în prima linie a revoluției AI globale.