Alibaba's Qwen research lab wydała w piątek nowy model Qwen 3.8 27B - 27-miliardowy język-wizyjny LLM z licencją Apache 2. To rozsądny rozmiar do uruchamiania na dobrze wyposażonym laptopie, a poprzednia generacja Qwen 3.6 27B zrobiła już duże wrażenie. Samoraportowane benchmarki tej wersji pokazują znaczny skok wydajności w stosunku do Qwen 3.6 27B i zamkniętego Qwen 3.7-Plus, który jeszcze w maju tego roku należał do najsilniejszych modeli Qwena niezależnie od wielkości.
Tester Simon Willison uruchamiał model zarówno na MacBooku Pro M5 Max z 128GB RAM, jak i na serwerze NVIDIA DGX Spark, używając kwantyzowanej wersji Q4_K_M o rozmiarze 17GB w LM Studio. Odkrył jednak znaczący problem: model domyślnie używa xhigh dla parametru reasoning_effort, co ma powodować spektakularne przeżuwanie zadań zamiast ich szybkiego rozwiązania. Qwen oferuje trzy opcje - xhigh dla złożonych zadań wymagających głęboką analizę, medium do balansowania dokładności i szybkości, oraz low dla efektywnych odpowiedzi. Jednak ustawienie xhigh jako domyślne to żaden pomysł, szczególnie jeśli chodzi o sprzęt konsumencki.
To stanowi praktyczny problem dla użytkowników bez potrzeby takiej głębokie analizy. Zmiana reasoning_effort na medium lub low może znacznie poprawić responsywność modelu, ale wymaga od użytkownika świadomości problemu i wiedzy jak go naprawić. Domyślna konfiguracja, która sprawuje się źle na rzeczywistym sprzęcie, jest osobliwym wyborem inżynierów produktu dla modelu promowanego właśnie dla zastosowań na laptopach.