OpenAI ha svelato le capacità autonome di GPT-5.6 Sol, il modello che non solo è in grado di ottimizzare il proprio sviluppo ma può anche autonomamente addestrare modelli più piccoli, come il modello Luna. Secondo la descrizione della società, questo processo è stato avviato tramite un prompt estremamente semplice, fornendo a Sol solo poche istruzioni, il che ha permesso al modello di gestire gran parte del lavoro autonomamente.
Una promessa di evoluzione autonoma
Uno dei maggiori tratti distintivi di GPT-5.6 Sol è la sua capacità di ottimizzare il modello Luna dopo la sua preallena. Un ricercatore ha dato a Sol un prompt abbastanza sotto specificato, chiedendogli di identificare le giuste configurazioni di allenamento, selezionare le GPU appropriate, avviare lo script di addestramento e verificare che tutto funzionasse correttamente. Sol ha completato con successo questa serie di compiti, dimostrando un alto livello di autonomia.
Una rappresentazione parzialmente oscurata delle istruzioni del ricercatore a Sol mostra che le direttive coprivano configurazioni di allenamento, selezione delle GPU, lancio degli script e verifica dei risultati. Il modello Sol ha mostrato una capacità eccezionale di eseguire una serie complessa di attività tecnico-computazionali con un minimo intervento esterno.
Confronto con il predecessore
Per misurare le capacità di adattabilità e miglioramento autonomo, OpenAI ha introdotto un benchmark interno basato su compiti reali di ricerca sull’IA. Questi includono il debug di sistemi di ricerca, l'ottimizzazione di nuclei e ricette di allenamento, l'esecuzione di esperimenti di apprendimento automatico e il miglioramento di altri modelli.
Rispetto al predecessore, GPT-5.5, GPT-5.6 Sol ha guadagnato 16.2 punti sull’indice aggregato RSI (Recursive Self-Improvement). Il modello Sol si trova in cima alla gerarchia del benchmark, seguito da varianti come Terra e Luna, epoi dal resto della serie GPT. Questo avanzamento rappresenta un progresso significativo, poiché l'abilità di un sistema di migliorare autonomamente se stesso, formando un ciclo di retroazione, è alla base della ricerca sull'intelligenza artificiale e la sua sicurezza.
Rischi e prospettive
Nonostante i progressi, aziende come Anthropic lo scorso Giugno hanno sottolineato che il miglioramento totale ricorsivo non è ancora stato raggiunto. Tuttavia, secondo Anthropic, il modello Claude gestisce ora compiti incrementali tra i grandi cambiamenti di paradigma, lasciando agli umani solo una percentuale insignificante delle decisioni strategiche.
Nuovi standard di produttività interna
Gli esperti di OpenAI utilizzano GPT-5.6 Sol in tutta la fase di sviluppo, che va dal debug dei sistemi di addestramento all’ottimizzazione e alla lettura dei risultati sperimentali. Secondo i dati forniti, durante i test interni, l’output giornaliero medio di token per ricercatore ha superato per più di due volte il massimo precedente registrato da GPT-5.5. Inoltre, il numero medio di pull request per ricercatore e sperimentazioni condotte è aumentato significativamente, permettendo agli team di trasformare idee in risultati in modo più rapido.
I dati di adozione interna raccolti negli ultimi sei mesi rivelano un aumento impressionante dell’uso dell’AI in OpenAI. La quantità di calcolo dedicato all’inferenza interna di codice è aumentata di 100 volte, mentre l'uso dei token basati sugli agenti è balzato di circa 22 volte. Anche se OpenAI ammette che questi dati non misurano direttamente i progressi della ricerca, evidenziano chiaramente la crescita esponenziale degli strumenti ausiliari alimentati dall’IA.
Conclusione
La capacità dimostrata da GPT-5.6 Sol di ottimizzare autonomamente il modello Luna e di migliorare la produttività interna segna un momento cruciale. L’azienda auspica che il ricercatore automatizzato si avvicini sempre di più alla realtà. Mentre il ricorsivo miglioramento completo continua a essere una sfida complessa, il traguardo di progresso raggiunto finora apre la strada a un'era di sviluppo dell’intelligenza artificiale più dinamica e autonomamente guidata.