Narzędzie LLM wydało wersję 0.32rc2, która zmienia domyślny model z GPT-4o mini na GPT-5.6 Luna. Nowy model oferuje znacznie lepszą wydajność, ale jest droższy - kosztuje 0,20 dolara za milion tokenów na wejściu i 1,20 za wyjściu, wobec 0,15 i 0,60 dla GPT-4o mini. Alternatywnie użytkownicy mogą wybrać GPT-5 nano, najtańszą opcję (0,05 i 0,40), lub powrócić do wcześniejszego modelu za pomocą prostej komendy.
Główną nowością jest nowa komenda llm openai endpoint, która pozwala uruchamiać prompty i czaty bezpośrednio przeciwko dowolnym endpointom kompatybilnym z OpenAI Chat Completions API bez konieczności wstępnej konfiguracji modelu. Te wywołania nie są logowane w historii. Funkcja rozwiązuje problem braku prostego narzędzia CLI do testowania promptów na arbitralnych endpointach, a Simon Willison postanowił ją wbudować bezpośrednio w LLM.
Użytkownicy mogą używać tej komendy nawet bez instalacji LLM, korzystając z uvx - na przykład do uruchomienia promptu z narzędziami przeciwko lokalnemu modelowi w LM Studio wystarczy jednolinijkowa komenda. To szczególnie przydatne dla developer-ów testujących lokalne modele lub niestandardowe implementacje API.