AIsurface
Strona główna Archiwum
Strona główna › Archiwum › Badania
Badania arXiv CS.AI

What Do We Expect from LLMs? Mapping the Design of LLM Benchmarks

18 wrz 2026
Hype:
5/10
Czytaj oryginał →
Podobne artykuły
Transformer do rozpoznawania sprzeczności i wahania w wielu modalności
arXiv CS.CL · 18 wrz 2026
Subliminal prompting: co naprawdę steruje ukrytymi cechami w modelach języka
arXiv CS.CL · 18 wrz 2026
Odkrywanie stylów w modelach językowych bez uczenia się
arXiv CS.CL · 18 wrz 2026
Co myślą użytkownicy o AI: analiza opinii z App Store
arXiv CS.CL · 18 wrz 2026
FakeSpotter: narzędzie do wykrywania wirusowego fałszu niezależne od treści
arXiv CS.CL · 18 wrz 2026
Usuwanie słów stopu zniekształca analizę tekstu prawniczego
arXiv CS.CL · 18 wrz 2026
AI Surface · Agregator newsów o AI po polsku · Prośby o usunięcie treści: [email protected]