Nowa wersja 0.34 llm-gemini wprowadza obsługę modelu gemini-3.8-flash z trzema poziomami thinking - low, medium i high - umożliwiającymi elastyczne sterowanie głębią rozumowania AI. Gemini 3.8 Flash to najnowsza iteracja lekkiego modelu Google'a, dostępna teraz wśród narzędzi wiersza poleceń llm, które ułatwiają pracę z modelami przez terminal.
Wydanie naprawia również istotny problem dotyczący odpowiedzi asynchronicznych. Uprzednio systemy takie mogły nie zapisywać prawidłowo informacji o wersji rozwiązywanego modelu, co utrudniało śledzenie, którą dokładnie wersję modelu wykorzystano do przetworzenia żądania. Ta poprawka (issue #137) poprawia niezawodność logowania i debugowania.
Aktualizacja jest częścią ekosystemu llm, open-sourcowego narzędzia utrzymywanego przez Simona Willisona, które upraszcza integrację z modelami takimi jak Claude i OpenAI GPT. Dostęp do trzech poziomów thinking w gemini-3.8-flash pozwala użytkownikom escolić między szybszymi odpowiedziami a bardziej zaawansowaną analizą, zależnie od złożoności zadania.