Liquid AI wydała dwa otwarte modele decyzyjne - d1-3B obsługujący tekst i obrazy oraz d1-omni-600M łączący tekst z obrazami lub audio - które działają zupełnie inaczej niż tradycyjne generatywne LLM-y. Zamiast pisać odpowiedzi token po tokenie, modele d1 czytają stan i zestaw pytań raz, a następnie zwracają rozkład prawdopodobieństwa dla każdej dozwolonej odpowiedzi. Oba modele działają w jednym forward passie i zwracają output_tokens: 0, co oznacza zero dodatkowych obliczeń po początkowym przetwarzaniu.
Modele obsługują trzy rodzaje pytań: noul (pytania tak-nie zwracające P(tak)), choice (wybór z options zwracający pełny rozkład) oraz score (probabilistyczną pozycję na skali od 2 do 10 poziomów). Checkpointy znajdują się na Hugging Face, ładują się przez bibliotekę Transformers i mają wsparcie llama.cpp od pierwszego dnia. Licencja LFM Open License v1.0 pozwala na bezpłatne użytkownie komercyjne dla firm z przychodami poniżej 10 milionów dolarów rocznie. Docelowymi platformami są serwery NVIDIA DGX, stacje robocze RTX i urządzenia brzegowe Jetson.
Liquid AI rekomenduje modele d1 do routowania żądań, moderacji treści, klasyfikacji intencji, reranking-u wyników, oceniania przez LLM-y, guardrails dla agentów i inspekcji wizualnej. To przełom dla systemów wymagających decyzji w czasie rzeczywistym - eliminacja tokengeneratora oznacza drastyczne zmniejszenie opóźnień i zużycia obliczeniowego. d1-omni-600M to wczesne wydanie badawcze bez opublikowanych pomiarów opóźnień, ale już teraz stanowi konkurencję dla tradycyjnych pipeline'ów decyzyjnych bazujących na parserowaniu tekstu z LLM-ów.