OpenAI oficjalnie ujawniła szczegóły swojego custom chipa inferencyjnego Jalapeño, który stanowi największą niespodziankę 37. konferencji Hot Chips. Chip nie jest prostym ASIC-iem, ale pełnoprawną alternatywą dla architektur Blackwell, pokazując, że OpenAI potrafiła zbudować konkurencyjne rozwiązanie zaledwie przed rokiem po ogłoszeniu współpracy z Broadcomem.
Metryka wydajności przesunęła się teraz w kierunku performance per watt - czyli rzeczy, którą Jalapeño obsługuje imponująco. W testach OpenAI chip dostarczył 1,5-1,9x więcej pracy na wat przy maksymalnej przepustowości i 1,7-3,6x niższe opóźnienia end-to-end w porównaniu z systemami GB200/GB300. Dla wysoce interaktywnych obciążeń wydajność była 2,1-4,1x wyższa. Szczególnie godne uwagi jest to, że mimo nominalnej mocy 700W chip w rzeczywistych testach pracował na lub poniżej 550W.
Wdrażanie Jalapeño do własnej infrastruktury OpenAI ma się rozpocząć do końca 2026 roku, a OpenAI już ma drugą generację w zaawansowanym stadium rozwoju i trzecią w przygotowaniu. To zmienia krajobraz konkurencji chipów AI - zamiast bezpośredniego wyścigu w czystej wydajności, fokus przesunął się na efektywność energetyczną i całkowity koszt posiadania. Jeśli obietnice OpenAI sprawdzą się w praktyce, może to zagrozić dominacji NVIDIA na rynku chipów inferencyjnych.