Artykuł opublikowany na Annas Archive zwraca uwagę na alarmujący trend - firmy rozwijające modele AI mogą przyspieszać niszczenie fizycznych książek w wyniku masowego pozyskiwania danych treningowych. Choć mechanizm tego procesu nie jest w pełni wyjaśniony w dostępnym fragmencie, problem kładzie się cieniem na praktyki pozyskiwania danych przez branżę.

Rzadkie i historycznie wartościowe wydania są szczególnie zagrożone, ponieważ mogą być wykorzystywane do trenowania dużych modeli językowych bez odpowiedniego zabezpieczenia czy ewentualnego zwrotu materiału. Autorzy артикула wzywają społeczność cyfryzacyjną do przyspieszenia skanowania rzadkich kolekcji, zanim pozostaną już tylko w postaci cyfrowej na serwerach firm AI, a oryginały znikną z obiegu.

Wykrycie tego problemu przez użytkowników Hacker News - artykuł zebrał 110 punktów i 56 komentarzy - sugeruje rosnącą świadomość dotyczącą konsekwencji wyścigu technologicznego dla dziedzictwa kulturalnego. Dyskusja podkreśla konieczność znalezienia równowagi między rozwojem AI a ochroną unikatowych materiałów bibliotecznych i archiwalnych.