NVIDIA zaproponowała strategię połączenia niestandardowych XPU z jej światowej klasy infrastrukturą AI, aby ułatwić budowę fabryk sztucznej inteligencji. Problem polega na tym, że tworzenie w pełni niestandardowego rozwiązania - od projektowania samych akceleratorów XPU po całą architekturę sieciową, software fabryk i ekosystem dostawców - jest procesem złożonym, kosztownym i czasochłonnym. Rozwiązanie NVLink Fusion stanowi mostek między custom designem XPU a sprawdzonym stackiem infrastrukturalnym NVIDIA.

Fabryki AI działają w ciągłym cyklu produkcyjnym, gdzie gospodarka opiera się na metrykach takich jak liczba tokenów na sekundę, wydajność energetyczna, koszt na token oraz stopień wykorzystania systemów. Aby osiągnąć skalę hyperscalerów, infrastruktura musi się składać nie tylko z samych akceleratorów, ale również z zaawansowanej sieciowania scale-up i scale-out, architektury rack-level, oprogramowania fabryk produkcyjnych i solidnego ekosystemu partnerów. To wyjaśnia, dlaczego XPU Fusion łączy niestandardowe XPU z dojrzałą technologią NVIDIA - pozwala to firmom skupić się na innowacji tam, gdzie ma to największy wpływ, a jednocześnie zmniejsza złożoność, przyspieszając time-to-market i zmniejszając ryzyko biznesowe.

Podejście ma szczególne znaczenie dla współczesnych obciążeń, takich jak uruchamianie modeli z trylionami parametrów, architektury mixture-of-experts czy agentyczne AI. Jeśli fabric scale-up nie może dotrzymać tempa przepustowości wymagająnej przez te systemy, to spadnie wykorzystanie sprzętu i wzrosną koszty operacyjne. NVIDIA stawia na sieć o wysokiej wydajności, wbudowanej mocy obliczeniowej i szybkim scalingu, aby rozwiązać ten krytyczny wąski gardło.