Agentao to nowa platforma wykonawcza stworzona do bezpiecznego uruchamiania agentów AI, którzy mogą wywoływać różne narzędzia, modyfikować lokalny stan systemu i interakcję z zewnętrznymi protokołami. Naukowcy zaproponowali architekturę warstwową, która oddziela propozycje działań generowane przez model języka od faktycznego wykonania autoryzowanego przez system gospodarz.
Głównym problemem, który rozwiązuje Agentao, jest zmniejszenie ryzyka związanego z nadmiernie uprzywilejowanymi działaniami agentów, słabą możliwością audytu, zastrzykiwaniem promptów, zatruciem narzędzi i niekontrolowanymi efektami ubocznymi. System wprowadza mechanizmy uprawnień, które kontrolują, jakie działania może wykonać agent, oraz tworzy jawne abstrakcje czasu wykonania dla uprawnień, stanu systemu, granic protokołu i śladów wykonania.
Chociaż Agentao nie zapewnia formalnych gwarancji bezpieczeństwa, jego architektura sprawia, że agenty stają się bardziej podlegające kontroli i inspekcji. System jest szczególnie przydatny dla środowisk lokalnych, gdzie organizacja ma pełną kontrolę nad infrastrukturą. Kod projektu został udostępniony publicznie na GitHubie, co umożliwia społeczności dalsze badania i rozwój bardziej bezpiecznych systemów agentów AI.