OpenAI zapowiadał nową usługę Ultrafast, która pozwala uruchamiać GPT-5.6 Sol z prędkością do 14 razy wyższą niż obecnie. Nowa warstwa API wykorzystuje technologię Cerebras i osiąga wydajność do 750 tokenów wyjściowych na sekundę, co jest gwałtownym przyspieszeniem w stosunku do dotychczasowych możliwości.
Ultrafast to nowa kategoria usług OpenAI dedykowana aplikacjom, gdzie szybkość jest kluczowa. Współpraca z Cerebras - specjalistą w dziedzinie sprzętu do trenowania i obsługi dużych modeli - pozwoliła na osiągnięcie takiego skoku w wydajności. To otwarcie nowych możliwości dla usług real-time wymagających natychmiastowych odpowiedzi, od chatbotów aż po systemy autonomiczne.
Wprowadzenie Ultrafast odzwierciedla rosnącą konkurencję na rynku LLM, gdzie szybkość i opóźnienie stają się decydującymi czynnikami. Dla developerów to oznacza dostęp do szybszych modeli bez utraty jakości, choć oficjalne ceny i dostępność tej usługi nie zostały jeszcze w pełni ujawnione.