NVIDIA wypuszcza na rynek platformę Vera Rubin NVL72, która zmienia ekonomikę fabryk AI poprzez nieporownaną wydajność na wat. Produkcja już rusza u głównych dostawców chmury - CoreWeave, Google Cloud, Microsoft Azure i Oracle Cloud Infrastructure - z łańcuchem dostaw obejmującym ponad 350 fabryk w 30 krajach. Benchmark CoreWeave na modelu DeepSeek-R1 mówi sam za siebie: platforma dostarcza 10 razy więcej przepustowości na megawat niż poprzednia generacja Grace Blackwell NVL72.

Siłą Vera Rubin jest skrajna koprojekcja siedmiu chipów i pięciu szyn rackowych pracujących jako jeden zintegrowany system, a nie zbiór komponentów kupowanych osobno. W centrum tego ekosystemu stoi procesor Vera CPU z custom'owym rdzeniem Olympus, który redefinuje możliwości CPU dla era agentów AI. Oferuje on dwukrotnie wyższą wydajność jednowątkową, trzykrotnie większą przepustowość między rdzeniami i 40 procent mniejsze opóźnienia pamięci w stosunku do konkurencyjnych projektów chipletowych, co robi go najefektywniejszym Single-threaded CPU dla obciążeń agentowych, które naprawdę się liczą.

Platforma integruje także szóstą generację technologii NVLink do skalowania, networking Spectrum-6 SPX oraz BlueField-4 STX. Ta holistyczna architektura, zoptymalizowana od chipów aż do infrastruktury sieciowej, bezpośrednio trafia w punkt bólu fabryk AI - zużycie energii i koszt tokenów. W erze, gdy duże modele językowe pochłaniają ogromne ilości prądu, architektura Vera Rubin pokazuje, że dalszy postęp w wydajności AI musi przychodzić ręka w rękę z efektywnością energetyczną.