Mistral AI udostępnił publiczny preview Mistral Large 4, wewnętrznie nazwanego Le Chonk, to granularny model Mixture of Experts z 1,05 biliona całkowitych parametrów. Model ma 49 miliardów aktywnych parametrów na token, wbudowany 1,6 miliardowy koder wizji i może obsługiwać okno kontekstu aż 1 miliona tokenów - to zdecydowanie ambitna specyfikacja pchająca granice tego, co możliwe w open-weight modelach.
Model wytrenowano od zera na 3800 GPU NVIDIA Grace Blackwell umieszczonych w europejskich datacenterach Mistrala, co stanowi znaczący wysiłek inwestycyjny. Architektura hybrydowa łączy możliwości instrukcji i rozumowania z natywnym wsparciem dla obrazów. Kluczowa innowacja to fakt, że zaledwie 4,7 procenta wszystkich wag aktywuje się na token - dlatego model o rozmiarze trilikowy może być oferowany w cenach poziomu mid-tier: 1,36 dolara za milion tokenów wejściowych i 4,18 dolara za milion wyjściowych. Pełne 1,05 biliona parametrów musi oczywiście zapamiętywać GPU, ale liczba aktywowanych parametrów określa rzeczywistych koszt obliczeniowy.
Szczególnie godne uwagi są wyniki w bezpieczeństwie cybernetycznym - Mistral raportuje 93 procent dokładności na benchmarku Cybench i 82 procent na CyberGym-E2E. Konkurencyjne modele zamknięte otrzymują bliskie zera wyniki, ponieważ odmówią wykonania takich zadań. API już działa, ale wagi otwartego modelu będą dostępne dopiero pod koniec października 2026, co oznacza że samodzielne wdrożenie musi jeszcze poczekać.