De preprint-database arXiv kampt met een enorme toename van door kunstmatige intelligentie gegenereerde artikelen van lage kwaliteit. Om de bruikbaarheid van het platform te redden, voert de dienst strikte limieten en verboden in voor onderzoekers die onbehandelde AI-inhoud indienen.
De wetenschappelijke gemeenschap waarschuwt dat arXiv, een essentieel platform voor het delen van onderzoek voordat het peer-review ondergaat, dreigt onbruikbaar te worden. Volgens berichtgeving van newscientist.com is er sprake van een "onslaught" van zogenaamde 'AI-slop': teksten die met minimale menselijke inspanning door AI zijn gegenereerd en vaak feitelijke onjuistheden bevatten.
Explosieve groei in volume
De cijfers illustreren de schaal van het probleem. In september 2024 werden er nog 20.569 artikelen ingediend bij arXiv. Een jaar later, in september 2025, was dit gestegen naar 26.646. In september 2026 bereikte dit aantal een piek van 40.363 indieningen.
Deze enorme toename zet de moderatie van het platform onder zware druk. Kevin Buzzard van het Imperial College London stelt dat het voor legitieme onderzoekers moeilijker is geworden om hun werk te publiceren, omdat artikelen nu wekenlang in de wachtrij kunnen blijven staan. De hoeveelheid content is zo groot geworden dat Buzzard zelf AI-tools moet gebruiken om te filteren welke papers hij daadwerkelijk moet lezen.
Harde maatregelen tegen 'AI-slop'
Om de kwaliteit te bewaken, heeft arXiv drastische maatregelen genomen. Onderzoekers die artikelen indienen met onbetwistbaar bewijs van onbehandelde AI-generatie riskeren nu een tijdelijk of zelfs permanent verbod. Zoals beschreven door arstechnica.com, kan het indienen van ongepaste AI-content leiden tot een verbod van één jaar. Bovendien kunnen toekomstige publicaties van deze auteurs verplicht worden onderworpen aan een peer-review voordat ze op het platform worden geplaatst.
De focus van deze maatregelen ligt niet op het verbieden van AI-ondersteuning, maar op het gebrek aan menselijk toezicht. Volgens theaicronicle.com richt de policy zich specifiek op 'AI-slop' en gehallucineerde referenties. Elke auteur op een paper wordt volledig verantwoordelijk gehouden voor de inhoud, ongeacht de gebruikte tools.
Systemische druk en kwaliteitsverlies
De problematiek beperkt zich niet enkel tot arXiv. De bredere wetenschappelijke wereld worstelt met de combinatie van krachtige AI-tools en de heersende "publish-or-perish"-cultuur. In een analyse van het tijdschrift Organization Science werd een sterke stijging in het volume van indieningen vastgesteld, gepaard gaand met een daling in de wetenschappelijke strengheid. theconversation.com meldt dat dit systeem mogelijk verschuift naar een evenwicht van "meer in plaats van beter onderzoek".
Bovendien is de impact van AI-fouten merkbaar in specifieke vakgebieden. In de biomedische sector bevat naar schatting één op de acht papers inmiddels AI-gegenereerde tekst, wat volgens Substack kan leiden tot het eroderen van het vertrouwen in het wetenschappelijke archief door foutieve citaties.
Specifieke beperkingen per categorie
Om de stroom aan laagwaardige content verder in te dammen, zijn er ook categorie-specifieke regels ingevoerd. Zo meldt datasociety.net dat de moderatie in de categorie 'computer science' is aangescherpt. Review-artikelen, survey-papers en position papers worden in deze categorie nu vaker geweigerd als er geen bewijs is van eerdere acceptatie door een peer-reviewed tijdschrift of conferentie.