DeepSeek zaprezentował DeepSeek-V4-Flash-0731, najnowszy model z rodziny V4, który wyróżnia się znacznie ulepszonymi możliwościami agentowymi. Model zawiera 304 miliardy parametrów i waży 167 GB na platformie Hugging Face, a jego architektura okazuje się niezwykle efektywna - model punch well above its weight w porównaniu do większych konkurentów.
Cena jest oszałamiająca: zaledwie 0,14 USD za milion tokenów wejściowych i 0,27 USD za milion wyjściowych. To cena zbliżona do najtańszych modeli na rynku, mimo że V4-Flash oferuje znacznie wyższą wydajność. Według rankingu Artificial Analysis model wyprzedza nawet MiniMax M3, który dysponuje 428 miliardami parametrów - prawie 40 procent większą liczbą parametrów. Na wykresie Intelligence Index vs. Cost per Intelligence Index Task V4-Flash plasuje się w naprawdę dobrej pozycji.
Warte uwagi jest również to, że jakość odpowiedzi znacznie poprawia się po zwiększeniu poziomu reasoning effort na wysoką wartość. Nowy model DeepSeek kolejny raz potwierdza strategię chińskiego producenta - dostarczać wysokiej klasy inteligencję AI przy ułamkowym koszcie w porównaniu do konkurentów z Zachodu. V4-Flash jest dostępny między innymi przez OpenRouter i stanowi obecnie jeden z najlepszych wyborów dla użytkowników szukających optymalnego bilansu wydajności i budżetu.