Il panorama della ricerca scientifica globale sta vivendo un momento di trasformazione radicale e, purtroppo, di profonda crisi strutturale a causa dell'abuso delle tecnologie di automazione. Nel corso di settembre 2026, il celebre repository di pre-print arXiv, punto di riferimento imprescindibile per fisici, matematici e informatici di tutto il mondo, ha registrato una cifra record di 40.363 sottomissioni. Questo dato non è solo un numero, ma il segnale d'allarme di un sistema che sta rischiando il collasso: il volume di articoli è raddoppiato rispetto a settembre 2024 e quadruplicato se confrontato con i dati di settembre 2016, quando le sottomissioni mensili erano appena 9.869. A guidare questa crescita iperbolica è soprattutto il settore della Computer Science, dove il numero di paper presentati è aumentato di sei volte nell'arco degli ultimi ventiquattro mesi, spinto prepotentemente dall'accessibilità universale dei Large Language Models e degli agenti di ricerca automatizzati.
La risposta di arXiv a questa inondazione di contenuti, definiti in gergo tecnico come AI slop, è stata drastica ma necessaria. La direzione editoriale ha annunciato l'introduzione immediata di limiti quantitativi: d'ora in avanti, ogni ricercatore potrà inviare un massimo di due lavori al mese e non potrà avere più di tre istanze attive contemporaneamente in fase di revisione. Questa decisione mira a proteggere il lavoro dei moderatori volontari, il vero motore pulsante della piattaforma, che si trovano oggi a dover filtrare migliaia di articoli di scarsa qualità, privi di reale valore scientifico o generati artificialmente per gonfiare i curricula accademici. Thomas Dietterich, presidente del comitato consultivo editoriale, ha espresso profonda preoccupazione per il carico di lavoro insostenibile che grava sulla comunità, sottolineando come una piccola minoranza di autori stia monopolizzando le risorse temporali dei revisori con una quantità spropositata di materiale scadente.
Il fenomeno dello AI slop non si limita alla semplice generazione di testi, ma si estende a pratiche ancora più insidiose come il salami slicing estremo, ovvero la frammentazione di una singola ricerca in decine di micro-articoli quasi identici, e la sottomissione di paper che trattano argomenti estremamente ristretti e privi di rilevanza generale. Molti ricercatori utilizzano l'intelligenza artificiale per analizzare dati, scrivere codice e pianificare esperimenti — pratiche consentite se dichiarate — ma il problema sorge quando l'intero processo di scrittura e la formulazione delle conclusioni vengono delegati a modelli che spesso allucinano risultati o rielaborano concetti triti senza aggiungere nulla di nuovo alla conoscenza scientifica. arXiv ha ribadito che, sebbene l'uso dell'AI come strumento di supporto sia legittimo, ogni lavoro deve rispettare standard minimi di significatività e originalità.
Le nuove restrizioni rappresentano l'ultimo capitolo di una lunga battaglia contro l'inquinamento dei database scientifici. Già nel corso del 2025, la piattaforma aveva smesso di accettare articoli di rassegna (review) nella categoria Computer Science proprio a causa della saturazione di testi sintetici. Precedentemente, nel gennaio 2026, era stato introdotto l'obbligo per i nuovi autori di ottenere una raccomandazione da parte di membri già registrati e autorevoli del sistema, superando la vecchia validazione basata esclusivamente sull'indirizzo email accademico. A maggio 2026, inoltre, era stata implementata una politica di tolleranza zero: chiunque venga sorpreso a caricare contenuti di bassa qualità generati dall'AI rischia il blocco dell'account per un anno. Nonostante queste barriere, la facilità con cui è possibile produrre testi apparentemente autorevoli continua a mettere alla prova la resilienza della comunità scientifica internazionale.
In conclusione, la mossa di arXiv non è solo una misura amministrativa, ma un atto di difesa dell'integrità della scienza aperta. Se i repository di pre-print diventano discariche di contenuti automatizzati, il rischio è che le scoperte autentiche vengano sommerse dal rumore di fondo, rallentando il progresso tecnologico e minando la fiducia pubblica nella ricerca. Il futuro della pubblicazione accademica dipenderà dalla capacità di distinguere il contributo dell'ingegno umano dalla mera compilazione algoritmica, garantendo che lo spazio della condivisione gratuita rimanga una risorsa preziosa per chiunque voglia realmente far avanzare le frontiere del sapere in Italia e nel mondo.

