Reddit sta affrontando uno dei problemi più urgenti del cyberspazio: il crescente problema di spammatori automatizzati e contenuti generati artificialmente attraverso gli stessi modelli linguistici su cui sta costruendo le sue soluzioni. Gli stessi modelli avanzati di intelligenza artificiale, che permettono a chiunque di produrre testi coerenti in modo veloce, sono in prima linea nel contrastare l'abuso di questi strumenti.
Una lotta al fuoco con il fuoco
Reddit, una piattaforma con centinaia di milioni di utenti attivi, riconosce che i cosiddetti grandi modelli linguistici (LLM, acronimo inglese) hanno portato con sé nuove complessità. Prima che esistessero i LLM, gli spam avevano limitazioni; oggi, invece, chiunque può generare messaggi convincenti o commenti mirati in massa.
Per questo motivo, Reddit sta adottando tecniche avanzate, tra cui l'applicazione di nuovi LLM, per riconoscere e bloccare automaticamente il 90% dei contenuti dannosi prima che gli utenti li vedano. Secondo uno studio interno, questi nuovi strumenti tecnologici hanno aumentato del 30% l'efficienza rispetto all’approccio tradizionale, permettendo di individuare pattern sottili di comportamento fittizio che gli algoritmi precedenti non erano pronti a riconoscere.
I numeri del combattimento quotidiano
I dati parlano chiaro: Reddit afferma di bloccare circa 23 milioni di visualizzazioni di spam al giorno e di individuare circa 25.000 nuovi post o commenti inappropriati quotidianamente. Questo significativo volume è il risultato di una lotta continua contro bot e creatori di contenuti malevoli che usano strumenti simili per attaccare la piattaforma, generando contenuti artificiali ad alto volume.
In questo contesto, l’implementazione di strumenti basati su LLM rappresenta una svolta cruciale. Reddit spiega, in una dichiarazione ufficiale, di utilizzare modelli linguistici per identificare “comportamenti falsi coordinati e hype artificiale”, andando ben oltre ciò che i sistemi tradizionali erano riusciti a rilevare. Questo si traduce in misure più sensibili e precise.
Risultati concreti
Fin dal primo trimestre del 2024, Reddit ha registrato una riduzione del 20% nelle visualizzazioni di spam rispetto ai tre mesi precedenti, confermando l'effetto positivo dell’implementazione dei nuovi modelli. Questi risultati, tuttavia, non si limitano alla rimozione di contenuti inopportuni, ma si estendono anche al riconoscimento di materiali potenzialmente offensivi o che violano le norme della comunità.
Un equilibrio tra tecnologia e moderazione umana
Sebbene il progresso tecnologico sia evidente, gli esperti del settore ricordano che l’uso di algoritmi avanzati non può sostituire completamente la moderazione da parte di esseri umani. Sottolineano sempre che l’efficacia maggiore si ottiene quando si uniscono la forza del monitoraggio automatizzato ai processi di verifica e moderazione fatti da moderatori umani, in particolare in casi complessi.
L’approccio dei concorrenti
Altri giganti dei social, come YouTube, Facebook e Instagram, stanno anche implementando criteri diversi per quanto riguarda i contenuti generati da AI. Alcune piattaforme permettono la pubblicazione di questi materiali, a patto che si dichiari esplicitamente di trattarsi di contenti generati artificialmente. Tuttavia, TikTok ha deciso di andare oltre: ha introdotto un sistema che permette agli utenti di regolare, tramite un toggle, la quantità di contenuti AI che vogliono vedere.
- YouTube: richiede un avviso per i contenuti generati da AI;
- Facebook, Instagram, Meta: seguono linee guida simili a quelle di YouTube;
- TikTok: offre un toggle personalizzato per la quantità di contenuti AI.
Il futuro della moderazione in tempo reale?
Se i LLM riescono a rilevare con rapidità elevata contenuti prodotti artificialmente, è inevitabile che queste capacità si estendano a casi di contenuti che violano le linee guida, come i discorsi di odio o materiali che promuovono la violenza. Tuttavia, il dibattito si incentra su quanto questa svolta tecnologica possa realmente migliorare, in maniera equilibrata, l’esperienza dell’utente e la moderazione della comunità.
Tuttavia, l’applicazione di tali strumenti richiede attenzione. Si corre il rischio di censure esagerate o di omissioni di contenuti legittimi se non si affina correttamente la capacità dei modelli di distinguere il bene dal male. Reddit si colloca in un contesto delicato dove la tecnologia evolve più velocemente di quanto i criteri etici siano in grado di seguirne il passo. Per questo motivo, ogni intervento deve essere accompagnato da un dibattito aperto e da un coinvolgimento attivo delle istituzioni.