Naukowcy stworzyli nowatorską technikę uczenia wzmacniającego, która zmniejsza komunikację między agentem sztucznej inteligencji a systemem monitorującym poprzez inteligentne decydowanie, kiedy faktycznie prosić o weryfikację bezpieczeństwa. Zamiast sprawdzać każdą akcję - co pochłania zasoby i przepustowość - agent uczy się przewidywać, które działania mogą być potencjalnie ryzykowne i naprawdę wymagają ingerencji zewnętrznego systemu asurance. To podejście ma szczególne znaczenie dla systemów rozproszonych i embedded AI, gdzie przesyłanie danych stanowi znaczący koszt, a bezpieczeństwo operacyjne jest absolutnie krytyczne.
Tradycyjne podejścia do runtime assurance polegały na ciągłym monitorowaniu każdego kroku agenta - system kontrolujący weryfikował bezpieczeństwo każdej decyzji przed jej wykonaniem. To podejście jest bezpieczne, ale nieefektywne, szczególnie w środowiskach z ograniczoną przepustowością lub gdy agent operuje w terenie z opóźnieniami transmisji. Nowa metoda zmienia tę paradygmatę: agent najpierw uczy się modelować własne ryzyka, a następnie samodzielnie decyduje, czy jego planowana akcja wymaga zewnętrznej aprobaty. To znacznie zmniejsza ilość komunikacji między systemami, a jednocześnie utrzymuje wysoką gwarancję bezpieczeństwa.
Praktyczne konsekwencje tego podejścia są znaczące dla branży. Roboty operujące w terenie, drony autonomiczne czy systemy medyczne mogą działać szybciej i bardziej niezależnie, gdy nie czekają na potwierdzenie każdej mikroskopijnej decyzji. Metoda potencjalnie przyspiesza działanie systemów, zmniejsza zużycie energii związane z transmisją danych i obniża wymagania infrastrukturalne, zachowując jednocześnie rygor bezpieczeństwa, który jest niezbędny w zastosowaniach krytycznych.