Pokee AI wydało Pokee-Isaac 28B - model języka o 28 miliardach parametrów z oknem kontekstu 10 milionów tokenów, specjalnie zaprojektowany do pracy wewnątrz granicy bezpieczeństwa klienta bez wysyłania danych do chmury. Problem, który rozwiązuje Isaac, to fakt, że długoterminowi agenci akumulują kontekst szybciej niż rozwiązują zadania - każde wyjście narzędzia, obserwacja i krok rozumowania pośredniego pozostaje w oknie, a zdolność przechowywania takiego kontekstu przy jednoczesnym zachowaniu spójności była dotąd dostępna niemal wyłącznie z chmurowych punktów końcowych.

Model Pokee-Isaac spełnia szczególnie potrzeby branż regulowanych, instytucji sektora publicznego i aplikacji na urządzeniach, gdzie dane w ogóle nie mogą opuszczać granic organizacji. Zespół badawczy Pokee twierdzi, że model uzyskuje wynik 93,3 procent w benchmarku RULER przy 10 milionach tokenów oraz osiąga parytet z najsilniejszymi bazami cloud'owymi zoptymalizowanymi pod względem kosztów na benchmarkach agentic. Model jest serwowany za pośrednictwem API kompatybilnego z OpenAI i dostępny na licencji do wdrażania wewnątrz VPC, on-premises lub na urządzeniu. Pokee zapewnia wsparcie zerowego dnia dla vLLM i SGLang, a uruchomienie na pojedynczym GPU jest możliwe od RTX 4090 lub równoważnika.

Model nie jest otwartym wagonem, lecz licencjonowanym rozwiązaniem, co czyni go odpowiednim dla organizacji średnich i dużych firm posiadających własny stos inferencji, a także dla producentów urządzeń. Pomiar wydajności przeprowadził Pokee tylko na GPU klasy B200, dlatego roszczenie dotyczące obsługi konsumenckich GPU powinno być traktowane raczej jako wskazówka producenta niż zgłoszony wynik.