Zespół badawczy przedstawił MudawanSn - nowy publiczny korpus zawierający 1271 równolegle wyrównanych zdań tłumaczonych ręcznie z wołof do nowoczesnego arabskiego. To pierwszy zasób specjalnie zaprojektowany dla tej pary języcznej, choć istniejące zbiory wielojęzykowe takie jak FLORES-200 czy NTREX zawierają oba języki, nie były wyspecjalizowane na tę konkretną kombinację.
Teksty źródłowe pochodzą z korpusu MasakhaNER i obejmują senegalski dyskurs medialny dotyczący polityki, spraw społecznych, religii i sportu. Proces konstruowania zasobu obejmował szczegółowy protokół tłumaczenia, wyrównanie zdań oraz wieloetapową kontrolę jakości. Zespół przetestował cztery systemy tłumaczenia obejmujące różne architektury - NLLB-200 z 600 milionami parametrów, mT5-base oraz dwa warianty AfriNLLB.
Wyniki pokazały znaczące ulepszenia przy fine-tuningu na MudawanSn. Najlepszy model, AfriNLLB-12, osiągnął 7.76 BLEU i 30.72 chrF++ dla kierunku wołof-arabski, a 8.75 BLEU i 33.08 chrF++ dla arabskiego-wołof. Korpus został opublikowany na licencji CC BY-NC i jest dostępny na platformach Hugging Face i GitHub, co otwiera nowe możliwości dla badań nad tłumaczeniem między mniej reprezentowanymi językami.