Naukowcy zbadali skalę penetracji tekstu generowanego przez sztuczną inteligencję w publikacjach naukowych dostępnych na arXiv, opracowując metodologię do pomiaru tego zjawiska. Jednak ich badanie ujawnia fundamentalne ograniczenia - detektory AI mają tendencję do fałszywych alarmów i coraz gorzej radzą sobie w identyfikowaniu wygenerowanej treści wraz ze wzrostem jej użycia.

Problem tkwi w tym, że gdy AI staje się coraz bardziej zaawansowane, a jego tekst coraz trudniej odróżnić od pisma ludzkiego, tradycyjne metody detekcji tracą na skuteczności. Publikacje naukowe mają szczególne znaczenie dla całej ekosystemu badawczego - złe wykrywanie AI tekstu może prowadzić do rozpowszechniania się błędów i pozornie potwierdzonych wniosków opartych na zawartości generowanej maszynowo.

To odkrycie naświetla szerszą wyzwanie stojące przed akademią - brak standaryzowanych, wiarygodnych narzędzi do sprawdzania autentyczności tekstów w erze zaawansowanego generowania AI. Bez lepszych rozwiązań mogą pojawić się poważne konsekwencje dla jakości i wiarygodności publikacji naukowych, szczególnie gdy instytucje badawcze będą intensywniej wdrażać narzędzia AI w procesy pisania.