Uno studio condotto in Cina centrale ha identificato un impatto negativo sull’apprendimento da parte degli studenti che utilizzano l'intelligenza artificiale (IA) per completare i compiti scolastici, effetti che emergono soltanto dopo circa due anni di utilizzo costante. I dati sono stati raccolti su un campione di 26.000 studenti delle scuole medie inferiori, superiori e ad accedere universitario in un distretto abitato da oltre un milione di residenti.

I principali utilizzatori di AI

Il monitoraggio si è incentrato sull’aumento esponenziale dell’uso dell'AI. Molti studenti che inizialmente non utilizzavano strumenti di IA ne hanno iniziato ad usare tra il settembre 2024 e il gennaio 2025, coincidendo con il lancio di DeepSeek V2.5 e V3 R1.

Le piattaforme più utilizzate sono risultate: Doubao, DeepSeek, ChatGLM, Ernie Bot e Qwen. I dati mostrano che entro sei mesi dall'introduzione dell’AI, i voti medio-buoni nei compiti scolastici sono aumentati del 18%, mentre il tempo medio necessario per completare ogni assegnazione è sceso da 64 a soli 45 minuti.

I risultati degli esami chiusi invece hanno evidenziato un calo consistente, fino al 20%. Questi dati sono in contrasto marcato con le prime performance positivizzanti. I ricercatori spiegano che gli effetti negativi sugli esami principali, come Zhongkao e Gaokao, diventano evidenti solo dopo circa due anni.

Sono quattro su cinque i lunghi utilizzatori di AI ad evidenziare segni evidenti di delega nel lavoro ai sistemi di intelligenza artificiale. I partecipanti che completavano le assegnazioni in meno di 50 minuti e ottenevano buoni voti nei compiti ma ottenendo risultati scadenti negli esami ufficiali erano probabilmente coloro che delegavano i compiti all’AI.

Le materie più colpite

Il calo di apprendimento si è mostrato più accentuato in materie come politica e geografia (27%), seguite da scienze STEM (22%), inglese (17%) e cinese (9%). Sebbene in precedenza gli esperimenti avessero focalizzato l’attenzione su matematica e programmazione, si è evidenziato che le materie umanistiche subiscono il colpo più forte.

Il calo varia a seconda degli studenti. Quegli studenti più giovani delle scuole secondarie inferiori e i ragazzi hanno registrato maggiori perdite rispetto a quelli più maturi o alle ragazze. Nei dati specifici si vede che i ragazzi hanno perso fino al 21,6% rispetto alle ragazze (18,4%), e i giovani di secondaria inferiore hanno perso il 24%, rispetto al 17% dei superiori.

Altrettanto importante è stato il rapporto tra frequenza d’uso e i danni cognitivi, con una escalation chiara: coloro che utilizzavano AI fino ad un’ora la settimana avevano un calo del 5%, coloro che facevano cinque ore o più avevano un calo del 30%.

Le possibili soluzioni

I ricercatori suggeriscono di intervenire in diversi modi per mitigare queste perdite. Tra le soluzioni proposte c’è l’uso di informazioni certificate sui costi a lungo termine dell'applicazione AI, l’importanza maggiore alle prove in classe e l’analisi temporale delle assegnazioni invece che soltanto la valutazione in base ai punteggi. Questi interventi sono motivati dal fatto che i voti alti in compiti autonomi non necessariamente preannunciano successo negli esami strutturati.

Una dichiarazione rilevante è stata presentata da Andrej Karpathy, ricercatore di Anthropic, che ha proposto che le scuole smettano di cercare di monitorare l’uso dell'AI per compiti domestici, e concentrino la valutazione su lavoro in classe supervisionato. Secondo lui, quando gli studenti sanno che saranno valutati senza supporto esterno, rimangono motivati a imparare veramente.

Conferme da studi paralleli

I risultati di questo studio si sovrappongono con quelle di altri settori e contesti. Un recente studio di Anthropic ha mostrato che i partecipanti che hanno utilizzato l’AI per imparare nuove competenze di programmazione hanno ottenuto una valutazione peggiore del 17% rispetto a un gruppo di controllo, senza guadagni di tempo reale.

I dati mostrano inoltre che coloro che copiavano direttamente le risposte dell’AI hanno ottenuto risultati peggiori rispetto a quelli che utilizzavano l’AI per capire meglio gli assegnamenti.

Perdite di pensiero critico

Lo studio della Swiss Business School, ha mostrato una forte correlazione negativa tra il grado di utilizzo di AI e lo sviluppo del pensiero critico. Altri esperti di università statunitensi e britanniche hanno rilevato che le persone che trattano l’AI principalmente come una macchina per trovare risposte, perdono rapidità nella capacità cognitiva.

Il problema dei risultati accademici

Un’altra conferma arriva da una ricerca condotta da Berkeley, che ha analizzato circa mezzo milione di voti scolastici. I corsi legati al programma e alla redazione hanno visto un aumento di circa 13 punti percentuali negli A rispetto al periodo precedente al lancio di ChatGPT. Tali effetti si sono concentrati su lavori non supervisionati, non emergendo invece in prove controllate.

In tutte le situazioni, lo studio evidenzia che la delega dell’apprendimento all’AI produce miglioramenti apparenziali a breve termine, ma danni strutturati nel lungo periodo, che emergono soltanto con il tempo. Questi risultati richiamano a un maggiore controllo delle metodologiche didattiche e un’attenta supervisione sull’uso dell’AI tra gli studenti.