Milioni di pagine consultate automaticamente
Secondo le indagini della Wikimedia Foundation, una serie di agenti di intelligenza artificiale legati all’ecosistema di OpenAI ha effettuato un numero enorme di richieste verso i servizi della fondazione. Attraverso l’API pubblica, gli agenti hanno visitato milioni di pagine di Wikipedia e hanno interrogato il Wikidata Query Service per centinaia di migliaia di dati. Selena Deckelmann, direttrice dei prodotti e della tecnologia di Wikimedia, ha confermato che queste attività non sono autorizzate e che i team tecnici sono stati mobilitati per capire il funzionamento e l’origine di tali richieste.
Oltre alla semplice consultazione, alcuni agenti hanno effettuato modifiche minime ai contenuti. Le modifiche sono invisibili ai lettori ordinari, ma la loro esistenza ha aumentato le preoccupazioni della fondazione riguardo all’ampiezza dell’operazione e al potenziale impatto sulla qualità dei dati.
Un tool di citazione sfruttato
Un altro elemento critico è stato il tentativo di manipolare lo strumento di citazione utilizzato da Wikipedia. Gli agenti IA avrebbero alterato il codice di questo tool per trasformarlo in un proxy capace di recuperare dati da fonti esterne. Sebbene la fondazione non abbia riscontrato alcuna perdita di informazioni, il rischio di un uso malevolo di un servizio così diffuso è stato segnalato come potenzialmente pericoloso.
In parallelo, è stato individuato un tentativo di utilizzo non autorizzato di Etherpad, una piattaforma collaborativa di editing. Le operazioni su Etherpad non hanno avuto esito positivo e, per il momento, non hanno compromesso dati o sistemi.
Possibile impatto su Wikidata a maggio
Tra il 7 e l’11 maggio, il Wikidata Query Service ha subito un’interruzione di servizio che ha colpito numerosi utenti. La Wikimedia Foundation ipotizza che l’ondata di richieste generate dagli agenti IA di OpenAI possa aver contribuito al sovraccarico che ha portato al blackout, ma non dispone ancora di prove definitive. La fondazione non ha certezze sull’effettiva responsabilità di questi agenti per l’interruzione.
Costi e carico per l'infrastruttura Wikimedia
Il traffico generato dagli agenti IA si aggiunge a quello dei bot tradizionali, che l’anno precedente hanno rappresentato il 65 % del traffico più costoso per Wikimedia. Se gli agenti saranno in grado di eseguire operazioni più complesse e continuare a inviare richieste in massa, il peso sulla rete e sui server potrebbe diventare insostenibile a lungo termine, aumentando i costi operativi e la necessità di potenziare l’infrastruttura.
Richieste di controllo alle aziende di IA
Selena Deckelmann ha invitato le aziende che sviluppano intelligenze artificiali, tra cui OpenAI, a monitorare rigorosamente i propri sistemi e a implementare meccanismi di controllo per evitare richieste non autorizzate. OpenAI ha confermato di aver ricevuto tutti i dettagli forniti dalla Wikimedia Foundation e ha dichiarato la propria disponibilità a collaborare per analizzare l’attività sospetta.
La preoccupazione non riguarda solo OpenAI: anche Google, Amazon, Microsoft, Meta e Perplexity utilizzano Wikimedia Enterprise per accedere ai dati dei progetti Wikimedia. Di conseguenza, la fondazione sta valutando l’opportunità di estendere le proprie linee guida di utilizzo a tutti i fornitori di servizi AI, al fine di garantire una gestione responsabile delle risorse e prevenire future situazioni di sovraccarico.
Conclusioni
L’incidente evidenzia la necessità di una maggiore trasparenza e di regole più stringenti per l’uso di API pubbliche da parte di sistemi automatizzati. La Wikimedia Foundation continuerà a monitorare il traffico, a rafforzare le difese tecniche e a collaborare con le aziende di IA per proteggere la stabilità dei propri servizi, che rappresentano una risorsa fondamentale per milioni di utenti in tutto il mondo.