Liquid AI zapowiedział LFM2.5-VL-3B, kompaktowy model wizyjno-językowy z 3,1 miliarda parametrów przeznaczony do działania bezpośrednio na urządzeniach użytkownika. Model potrafi odczytywać zawartość ekranów na mobilnych, webowych i desktopowych platformach, określać współrzędne obiektów, parsować dokumenty i wykresy oraz wywoływać narzędzia na podstawie wejściowych tekstów lub obrazów.

Wydajność LFM2.5-VL-3B jest imponująca w stosunku do jego rozmiarów. Osiąga średnio 69,4 punktu na 28 benchmarkach wizyjnych, co dorównuje modelowi InternVL-3.5-4B i zaledwie 0,7 punktu za Qwen3.5-4B - oba te konkurenci mają cztery razy więcej parametrów (4,7 miliarda). Model działa bez rozumowania, co oznacza szybkie odpowiedzi i niskie opóźnienia. Zmieści się w około 3 GB pamięci i na Apple M5 Max osiąga szybkość dekodowania 228 tokenów na sekundę.

Model został opublikowany w czterech formatach - native, GGUF, ONNX i MLX - z natychmiastową obsługą w llama.cpp, MLX, vLLM, SGLang i ONNX Runtime. Licencja LFM Open License v1.0 bazuje na Apache-2.0 z jednym zastrzeżeniem: bezpłatne użytkownie komercyjne dostępne jest dla firm z przychodami poniżej 10 milionów USD rocznie, co umożliwia niezależnym deweloperom, startupom i małym firmom darmowe wdrażanie. Przedsiębiorstwa powyżej tej granicy muszą negocjować licencję handlową. Badania, edukacja i organizacje non-profit nie mają ograniczeń dochodowych.