Agenci oparci na modelach językowych lepiej wykonują długoterminowe zadania, gdy umiejętności wywoływane są jako podagenci ze świeżymi oknami kontekstowymi, zamiast załadowywania instrukcji do głównego kontekstu agenta. Zespół badaczy z arXiv porównał te dwa podejścia i pokazał, że spawnianie dedykowanych podagentów dla poszczególnych podzadań prowadzi do lepszych wyników rozumowania.

Problem rośnie wraz z długością zadania. W tradycyjnym podejściu, im więcej informacji o umiejętnościach trafia do okna kontekstowego, tym bardziej pogarsza się jakość rozumowania agenta - to klasyczny problem gdzie kontekst staje się zbyt obciążony. Podejście ze świeżymi oknami kontekstowymi dla każdego podagenta unika tego zjawiska, pozwalając każdemu podagentowi skupić się na konkretnym subtask'u z czystą, skoncentrowaną wiedzą.

Trade-off jest jednak czytelny: podagenci wymagają dodatkowych tokenów do koordynacji między agentami, co zwiększa koszty komunikacyjne. Naukowcy stwierdzili, że ta dodatkowa cena jest warta zapłacenia, ale tylko gdy pakiety umiejętności mają jasno zdefiniowane interfejsy wejścia-wyjścia i zawierają proceduralne znania potrzebne do ich realizacji. Wynik badań sugeruje, że organizacja i struktura wiedzy mogą być równie ważne co jej zawartość dla efektywności agentów wykonujących skomplikowane zadania.