Agenty LLM pracujące z narzędziami spędzają cenny czas nie tylko na obliczeniach modelu, ale przede wszystkim na czekaniu - każde wywołanie narzędzia, zmiana stanu środowiska i obserwacja zmieniają się sekwencyjnie, jeden za drugim. Speculative Macro Commit rozwiązuje ten problem, wprowadzając dwupoziomowy system: autorytarny model główny generuje ostateczną trajektorię, zaś szybszy model spekulacyjny jednocześnie przewiduje i wykonuje łańcuchy akcji na oddzielnym snapshot środowiska.
Mechanizm SMC wydobywa powtarzające się wieloakcyjne schematy z danych treningowych i przechowuje je w bibliotece makr. Gdy rzeczywista akcja agenta pasuje do pierwszej przewidzianej akcji z biblioteki, system zatwierdza cały pozostały łańcuch wraz z jego obserwacjami od razu, zamiast czekać na każdy krok. Badacze testowali to na praktycznych scenariuszach, używając Qwen3.5-27B INT4 jako modelu głównego i Qwen3.5-4B jako draftera spekulacyjnego.
Wyniki pokazują znaczne przyspieszenie: na benchmarku tau-squared-Bench uzyskano 10,23 procent redukcji latencji wobec poprzedniej metody Speculative Actions i 18,59 procent wobec wykonania sekwencyjnego. Na AppWorld redukcja sięgnęła 7,7 procent w stosunku do SA oraz aż 44,9 procent wobec sekwencyjnego podejścia, choć z niewielkim spadkiem ukończenia zadań. To praktyczne rozwiązanie pokazuje, że wieloetapowa spekulacja może znacznie zmniejszyć czas oczekiwania agentów bez utraty dokładności.