Data centerul devine o fabrică de token-uri, iar succesul se măsoară în cât de repede iese primul token după punerea în funcțiune. Acesta a fost mesajul lui Rod Evans, VP Supercomputing și AI Cloud Infrastructure la NVIDIA, în keynote-ul susținut pe 23 septembrie 2026 la Vertiv Week, la Zagreb. Evans a anunțat rack-uri de aproape 1 MW în 2028, trecerea la distribuție de 800 V DC și răcire 100% lichidă la 45°C, cu Vertiv printre partenerii-cheie.
Evenimentul: infrastructură convergentă pentru era AI
Vertiv Week 2026, cu tema „Vertiv Driving Innovation: Converged Infrastructure for the AI Era”, a avut loc între 22 și 24 septembrie 2026 la Mozaik Event Center din Zagreb, Croația. La eveniment au participat jurnaliști, analiști, operatori de data center și parteneri, printre care NVIDIA și asociații din industrie.
Explozia token-urilor: agenții AI multiplică cererea de 24 de ori
Consumul de token-uri generat de agenții AI va crește de circa 24 de ori până în 2030, la aproximativ 118 cvadrilioane de token-uri, potrivit prognozei prezentate de Evans. Ca exemplu, el a dat volumul lunar de token-uri procesat de Google: 9,7 trilioane în mai 2024, ajuns la ordinul cvadrilioanelor în 2026. Modelele de raționament și cele agentice consumă deja cea mai mare parte a acestor token-uri.
Cererea de inferență se va muta aproape de utilizator. Motivul este latența: un răspuns procesat într-un data center din California ajunge prea greu în Europa.
Evans a povestit cum folosește agenți AI pentru cele circa 400 de e-mailuri pe care le primește zilnic. Agenții le sortează, extrag ce e important și propun răspunsuri. Chiar la NVIDIA, a spus el, inginerii primesc pe lângă salariu, acțiuni și token-uri nelimitate:
„Ești dezvoltator AI. Ce-ți poți dori mai mult decât token-uri nelimitate? Te inspiră să visezi și să explorezi lucruri noi.”
Fabrica AI: energie la intrare, token-uri la ieșire
Evans a descris evoluția în trei etape. Prima a fost serverul DGX cu opt GPU-uri, acum câțiva ani vârful tehnologiei. A urmat rack-ul cu 72 de GPU-uri strâns interconectate. Ultima etapă este fabrica AI, construită modular și containerizată, așa cum am putut să o vedem în fabrica Vertiv din Rugvica.
„Intră energie pe o parte și ies token-uri pe cealaltă. Primul lucru pe care vor să îl afle partenerii noștri de cloud este care e timpul până la primul token. Token-urile sunt cele care aduc banii.”
Preluată de la Jensen Huang, imaginea AI-ului ca „tort cu cinci straturi” pune pe primul nivel energia. Urmează cipurile, infrastructura (fabrica AI), modelele și, în vârf, aplicațiile. Stratul aplicațiilor este cel mai mare, dar niciunul nu poate fi ignorat.
Complexitatea crește odată cu scara. Evans a reluat formula Sun Microsystems, „The network is the computer” (n.r. Rețeaua este calculatorul), care spune el că e și mai adevărată în 2026. Mizele financiare sunt pe măsură: 10.000 de GPU-uri din generația Vera Rubin costă puțin sub 2 miliarde de dolari. De aceea implementarea trebuie făcută corect din prima.
Rolul lui Evans s-a schimbat și el. Hardware-ul „se vinde singur”, a spus el, așa că își petrece timpul ajutând partenerii NVIDIA Cloud să își construiască un model de business sustenabil.
„AI maker sau AI taker?”: autonomie regională prin modele open
Evans a menționat clar că nu îi place termenul „Sovereign AI” și preferă să vorbească despre autonomie regională.
NVIDIA publică mai multe modele open source decât oricine altcineva, a spus Evans. El vede modelele deschise ca pe o amenințare reală pentru modelele proprietare. Ele democratizează accesul și îți permit să îți ții datele critice acolo unde decizi.
„Vă dăm toate modelele noastre open source. Luați-le, sunt open source, faceți ce vreți cu ele. Asta vă permite să vă construiți propria direcție, propriile reguli, propria jurisdicție. E lucrul corect pentru Europa.”
Evans nu crede însă în protecționismul tehnologic. Ca exemplu a dat BMW, care produce în China, Africa de Sud, America și Europa și nu poate lucra doar cu furnizori europeni. Concluzia lui: gândești la scară globală, dar decizi conștient unde îți stau datele.
NVIDIA nu impune o arhitectură, ci oferă arhitecturi de referință și sisteme certificate prin parteneri OEM. Soluțiile trec printr-un Design Review Board intern. Clientul poate alege un partener cloud sau o implementare on-premise. „Nu ne interesează unde o faceți, important e să meargă din prima”, a spus Evans.
Physical AI: „următorul mare val de creștere”
După AI-ul agentic, următorul motor de creștere va fi physical AI, crede Evans. Primul exemplu dat a fost Olimpiada roboților desfășurată recent în China. Al doilea, un articol din The Daily Telegraph cu titlul „Directorii occidentali se întorc din China îngroziți de ce au văzut”. Articolul descria fabrici fără oameni, doar cu roboți, construite în parte din cauza lipsei de forță de muncă.
Din același articol, Evans l-a citat pe CEO-ul Ford:
„Noi am inventat producția de masă. Dacă nu ne schimbăm și nu devenim ca ei, nu vom mai exista. Ei construiesc un produs mai bun, mai ieftin, mai repede și de calitate mai bună.”
Evans a legat de același fenomen restructurările din industria auto europeană, inclusiv de la Jaguar Land Rover și Volkswagen. Al doilea exemplu au fost taxiurile autonome Waymo din Phoenix și California. El se așteaptă ca acestea să ajungă în marile orașe în următoarele 12–18 luni, la Londra probabil la începutul anului viitor.
„Physical AI a sosit în sfârșit și va genera mult mai multe date.”
Blueprint-ul DSX: data centerul standardizat, ca rack-ul
La GTC (n.r. GPU Technology Conference), în martie, Jensen Huang (CEO și co-fondator Nvidia) i-a adunat pe șefii celor mai mari 20 de parteneri de infrastructură data center. Primul argument a fost finanțarea:
„Când construiesc un bloc de apartamente în Manhattan, Paris, Zagreb sau Londra, nimeni nu mă întreabă câte apartamente am vândut înainte să-mi dea banii. De ce, când vreau să construiesc un data center, nimeni nu-mi împrumută bani până nu dovedesc că l-am vândut 70%? Nu există data centere goale.”
Al doilea argument: cei 20 de constructori construiesc fiecare altfel. Răspunsul NVIDIA este blueprint-ul DSX, oferit industriei în același mod ca arhitectura rack-based. Rack-ul a fost publicat open source, iar Apple și-a construit noua gamă de servere pe baza acestor designuri, a spus Evans.
Cadrul DSX acoperă optimizarea energiei, software-ul de infrastructură și platformă, simularea (DSX Sim, Omniverse, digital twins), Max-Q și DSX Flex. Peste 250 de parteneri din industrie construiesc deja conform DSX. „Dacă construiesc ceva, nu va deveni depașit”, a spus Evans.
El recomandă și construcția modulară. Un site de un gigawatt ridicat ca o singură clădire înseamnă „zece ani până la primul token”. Modulele livrabile, fiecare cu propria răcire, putere și spațiu, sunt mult mai rapide. Un clip Omniverse prezentat în timpul keynote-ului a arătat planificarea unei fabrici AI de 1 GW, cu sisteme de răcire și alimentare de la Vertiv și Schneider Electric. O asemenea fabrică are aproape 5 miliarde de componente și peste 200.000 de mile (n.r. circa 320.000 km) de fibră optică.
Energia: fiecare watt contează, iar rack-ul se apropie de 1 MW
Un data center are patru resurse finite: putere, răcire, spațiu și conectivitate. Dintr-un site de 1 GW alimentat din rețea, după pierderile din facilitate, răcire și rack rămân utile doar 60–70%. Nici rețeaua nu livrează tot ce ai contractat. Dintr-un contract de 100 MW primești, „dacă ai noroc”, 93 MW. De aceea NVIDIA recomandă energia generată on-site, behind-the-meter: gaz în SUA, hidro, solar sau eolian în Europa.
Pentru a evita puterea „blocată”, NVIDIA propune conceptul Max-Q, adică performanța maximă pe watt. Un rack din generația actuală consumă maximum 224 kW. În modul Max-Q coboară la 164 kW, așa că în același buget de putere încap mai multe rack-uri. Operațional, antrenarea poate rula la putere maximă, iar inferența poate trece pe Max-Q.
Următoarea generație de rack, din 2028, se va apropia de 1 MW.
„Cu distribuția tradițională, pentru un rack de un megawatt ai avea nevoie de 32 de cabluri de alimentare. Mult noroc! N-o să meargă niciodată.”
Soluția este distribuția de 800 V DC. Curentul alternativ intră în data center și este convertit la 800 V DC. În rack, tensiunea este coborâtă la 54 V DC, standardul din telecom. Evans estimează că astfel, dintr-un gigawatt, randamentul util poate urca de la 60% la 80–85%. El a anunțat că Vertiv este unul dintre partenerii care lucrează cu NVIDIA pentru ca 800 V DC să devină realitate.
Răcire 100% lichidă la 45°C și căldură pentru orașe, somoni și lemn
Grace Blackwell folosește deja răcire lichidă direct pe cip. Vera Rubin extinde răcirea lichidă la switch-uri și surse de alimentare, pentru un rack răcit 100% cu lichid. Apa intră la 45°C, iar asta contează, a explicat Evans:
„Aproape oriunde pe planetă pot obține apă la 45 de grade. Dacă intră la 45, iese la 65 și pot folosi apa aceea pentru altceva.”
Evans a dat trei exemple de reutilizare a căldurii din țările nordice:
- Termoficare urbană: căldura prin schimbător alimentează un sat sau un oraș.
- Piscicultură: puietul de somon are nevoie de apă caldă în primele faze de creștere.
- Industria lemnului: un copac tăiat conține circa 50% apă. Lemnul poate fi uscat pe loc cu căldura reziduală, în loc să fie transportat 200 km până la fabrică.
Răcirea lichidă la temperaturi înalte înseamnă și mai puține chillere și răcitoare evaporative. Consumul de apă scade cu până la 95%, potrivit prezentării.
Parteneriatul cu Vertiv. Evans a spus că Vertiv a fost printre primele companii care au venit cu un design de data center adaptat răcirii lichide pentru platformele NVIDIA. Pentru arhitectura de răcire lichidă bazată pe pod-urile Vertiv, el a prezentat următoarele câștiguri:
| Indicator | Rezultat |
| Consum anual de energie pentru răcire | −20% |
| Spațiu ocupat de rack-uri | −40% |
| Timp de implementare | 50% mai rapid |
| Amprentă totală | −40% |
Încheiere: „AI-ul a trecut pragul”
Evans a încheiat cu un citat din Jensen Huang, de la Davos 2026:
„Acum 20 de ani, toate acestea erau science fiction. Acum 10 ani erau un vis. Astăzi le trăim. AI-ul a trecut pragul de la a genera răspunsuri la a face muncă efectivă.”
Mesajul pentru industria de data center a fost clar: fabricile AI se construiesc acum, iar infrastructura decide cât de repede ajung la primul token.