Microsoft udostępnił code-testing-generator, agenta AI specjalizujący się w generowaniu testów jednostkowych, który znacznie przewyższa wydajnością standardowy GitHub Copilot. Na wewnętrznym benchmarku 152 zadań agent ukończył 140 zadań z powodzeniem, podczas gdy stock Copilot osiągnął zaledwie 120 zadań przy użyciu tego samego modelu bazowego i promptów.
Kluczową innowacją agenta jest jego zdolność do analizy repozytorium przed rozpoczęciem pracy. Tradycyjne asystenty kodowania pozostawiają wiele decyzji na użytkownikach - jaki framework testowy wybrać, gdzie umieścić plik, jakie asercje zastosować. Code-testing-generator rozwiązuje ten problem poprzez najpierw zbadanie struktury projektu, a następnie zaplanowanie, napisanie, uruchomienie i weryfikację testów. Agent działa jako definicja wraz z umiejętnościami, nie jako usługa hostowana, co oznacza że uruchamia się wewnątrz istniejących systemów kodowania i kod pozostaje lokalny.
Rozwiązanie trafia przede wszystkim do startupów i zespołów mid-market, które nie mają zasobów do ręcznego kodowania testów dla każdego modułu. Szczególnie wartościowe będzie dla branż regulowanych jak usługi finansowe, opieka zdrowotna i sektor publiczny, gdzie audyty wymagają dokładnej pokrywy testami. Agent pomoże w wypełnianiu testów dla niezatestowanych modułów, generowaniu testów dla pull-requestów, podnoszeniu pokrycia przed release'ami i standaryzacji konwencji w polyglotowych monorepo.