IBM udostępnił właśnie nowy model do generowania embeddings - Granite Embedding Multilingual R2, który jest dostępny całkowicie za darmo na licencji Apache 2.0 i obsługuje ponad 30 języków. To znaczący ruch w kierunku demokratyzacji sztucznej inteligencji, bo dotychczas tego typu narzędzia były albo dostępne tylko za opłatą, albo miały poważne ograniczenia licencyjne. Model waży mniej niż 100 milionów parametrów, co oznacza, że bez problemu można go uruchomić nawet na słabszym sprzęcie, a mimo kompaktowych rozmiarów osiąga najlepsze wyniki w swojej kategorii wagi.
Granite R2 potrafi pracować z kontekstem do 32 tysięcy tokenów jednocześnie, co w praktyce oznacza możliwość analizy równocześnie kilkunastu stron tekstu. Dla porównania - starsze modele embeddingów radzą sobie zwykle z kontekstem rzędu 512 czy maksymalnie 8 tysięcy tokenów. Ta zdolność jest kluczowa dla systemów wyszukiwania (retrieval-augmented generation), które napędzają nowoczesne chatboty i asystentów AI - mogą one teraz szukać informacji w zdecydowanie większych zbiorach danych bez tracenia istotnych szczegółów.
Ważne jest, że model od razu działa dobrze w wielu językach - to rozwiązanie dla globalnych projektów, a nie tylko anglojęzycznych. Praktycznie oznacza to, że polskie, francuskie, niemieckie czy chińskie dokumenty mogą być indeksowane i przeszukiwane z jednakową wydajnością. Dla firm i deweloperów to zmienia grę - mogą teraz wdrażać zaawansowane systemy wyszukiwania bez tych nieprzyjemnych niespodzianek związanych z licencjami komercyjnymi czy brakiem wsparcia dla ich języka.