Fabryki AI zbudowane na skalę megawatów czy gigawatów stanowią ogromne inwestycje kapitałowe - każdy megawat kosztuje około 60 milionów dolarów, dlatego operatorzy muszą mieć jasny obraz potencjalnego zwrotu z kapitału. NVIDIA identyfikuje trzy kluczowe elementy, które determinują rentowność takich instalacji.
Pierwszym czynnikiem jest zdolność zarobkowa - ile tokenów fabryka może teoretycznie sprzedać w ciągu roku. Drugi to trwałość sprzętu - jak długo procesory GPU i systemy NVIDIA mogą generować przychody po ich dostarczeniu. Trzecim jest popyt - czy na rynku istnieje rzeczywiste zapotrzebowanie na tę przepustowość tokenów. Kluczowe spostrzeżenie: żaden z tych elementów nie może w pełni kompensować słabości w innym. Wysokie możliwości produkcyjne nic nie dają, jeśli fabryka sprzedaje tylko część tego, co może wytworzyć. Duży popyt nie ma znaczenia, jeśli sprzęt traci zdolność produkcyjną po zaledwie roku pracy.
Platforma NVIDIA została zaprojektowana z myślą o maksymalizacji wszystkich trzech czynników jednocześnie. Systemy NVIDIA są produktywne - dostarczają najwyższą przepustowość na megawat i najniższy koszt per token. Są trwałe - GPU NVIDIA i całe systemy zachowują zdolność zarobkową przez lata. Są też uniwersalne - potrafią uruchamiać każdy typ AI niezależnie od fazy wdrażania i geograficznej lokalizacji, a także wiele obciążeń nie związanych z AI. Takie podejście do inżynierii całego stosu oprogramowania i sprzętu pozwala fabrykom AI generować maksymalny zwrot z inwestycji.