StepFun uruchomił Step 5 Preview, nowy model flagship bazujący na architekturze sparse Mixture-of-Experts z 600 miliardami całkowitych parametrów, z czego aktywnych jest około 27 miliardów na token - co stanowi zaledwie 4,5 procent wag na token. Model cechuje się 1-milionowym oknem kontekstu i wspiera wejścia tekstowe, obrazy oraz wideo. Głównym argumentem sprzedażowym jest koszt - zespół StepFun twierdzi, że oferuje porównywalną inteligencję przy znacznie niższych kosztach operacyjnych dla konkretnych zadań.

Model wykorzystuje niezwykłą architekturę - zamiast rozszerzać sieć, zespół zdecydował się na design narrow-deep z 92 warstwami Transformera. Takie podejście ma zapewniać dłuższe ścieżki dla niejawnego rozumowania i pracy agentycznej. Step 5 Preview wspiera również zaawansowane funkcje: multiple reasoning levels (low, medium, high), przesyłanie strumieniowe, tool calling, JSON Mode oraz integrację z Claude Code przez Step Plan. W testach zespół dokumentuje zdolność modelu do koordynowania 950 zapytań web w jednym akcji agenta.

Na razie model dostępny jest jako hosted API i na platformie StepFun, ale bez możliwości self-hostingu. Zespół zapowiedział, że otwarte wagi - które zajęłyby około 1,2 TB w formacie BF16 - staną się dostępne 15 października 2026 roku. Po ich publikacji self-hosting będzie wymagać wielogpuowego serwera. To pozycjonuje Step 5 Preview jako konkurencyjne rozwiązanie dla małych i średnich zespołów szukających efektywności kosztowej w pracach wymagających głębokich zdolności agentu AI.