Naukowcy stworzyli pierwszy w swojej skali publiczny korpus transkrypcji religijnych audycji radiowych w Stanach Zjednoczonych, zawierający ponad 700 tysięcy nagrań i 60 milionów linii tekstu mowy. Dane pochodzą z miesięcznego okresu w lipcu 2025 roku, kiedy automatycznie nagrywano 15-minutowe segmenty z 785 różnych webstreamów retransmitujących sygnały ponad dwóch tysięcy stacji AM i FM na całym kraju.
Projekt stanowi znaczący krok w badaniach medialnych, ponieważ media religijne to powszechny, ale niedostatecznie badany kanał komunikacji masowej w USA. Do tej pory brak był dużych zbiorów transkryptów uniemożliwiał naukowcom pogłębioną analizę zawartości. Zespół badawczy opracował potok przetwarzania oparty na automatycznym rozpoznawaniu mowy i modelach językowych, które transkrybowały nagrania, identyfikowały poszczególnych mówców i kategoryzowały treść według formatu programu i tematyki. Wszystkie dane zostały zorganizowane w powiązane tabele zawierające metadane strumieni, metadane nagrań i linie transkryptu.
Korpus otwiera możliwości dla badaczy zajmujących się analizą dyskursu publicznego, studiami nad medią religijną w różnych regionach i tradycjach, a także prac nad przetwarzaniem mowy w dziedzinach słabo reprezentowanych w dotychczasowych zbiorach treningowych. Taki zasób pozwoli na naukowe zgłębianie, jak tematy społeczne i polityczne są omawiane w mediach religijnych i jaką rolę odgrywają one w formowaniu opinii publicznej.