Naukowcy z arXiv argumentują, że systemy AI rozwijane dla interakcji z ludźmi powinny modelować całą przestrzeń możliwych interpretacji zamiast zmuszać się do wyboru jednej definitywnej odpowiedzi. Tradycyjne podejście w uczeniu maszynowym zakłada, że istnieje jedna absolutna prawda - różne oceny człowieka się uśrednia lub odrzuca jako błąd adnotacji. Dla wielu zadań zorientowanych na człowieka to założenie jest problematyczne, bo ludzkie sądy są inherentnie wieloznaczne i kilka interpretacji tego samego wejścia może być jednocześnie rozsądnych i wartościowych.
Artykulacja tego problemu ma głębokie implikacje dla architektury AI. Redukowanie wieloznaczności do pojedynczego celu ryzykuje pominięcie istotnych informacji o różnorodności ludzkiego postrzegania, osądu i doświadczenia. Autorzy postulują shift w myśleniu - zamiast walczyć z wariancją w ocenach, należy ją modelować jako integralną część danych treningowych i walidacyjnych. To oznacza zmianę w reprezentacji systemów AI, podejściu do testowania ich wydajności i ostatecznym deploymentu.
Jeśli AI miałby faktycznie wspierać człowieka, a nie go zastępować, musi uwzględniać tę naturalną wieloznaczność. Perspektywa ta powinna wpłynąć na to, jak oceniamy poprawność systemów AI, jak je trenujemy i jak je wdrażamy w świecie. Pozwoli to na stworzenie bardziej human-centered AI, który nie narzuca jedną wizję rzeczywistości, ale respektuje różnorodność ludzkiej interpretacji i sądów.