Richard Sutton, noto ricercatore e vincitore del Premio Turing nel 2024, ha fondato Oak Lab unendo le forze con Khurram Javed. Questa startup basata a Toronto mira a costruire agenti di intelligenza artificiale in grado di apprendere veramente in maniera autonoma, in modo simile agli esseri umani.
Un'alternativa al deep learning
Sutton, definito spesso come uno dei padri dell’apprendimento di rinforzo (reinforcement learning), non è soddisfatto degli sviluppi attuali del deep learning. Definisce i metodi attuali di deep learning "debozzi e inefficienti". A differenza di molti ricercatori del settore, Sutton sottolinea l’importanza di adottare approcci radicalmente diversi per spingere l’IA al suo massimo potenziale.
Criticità verso la generative AI
Nel mese di giugno, Sutton ha espresso preoccupazioni significative riguardo alla generative AI. Secondo lui, gli agenti di IA generativi sono buoni nell’imitare, ma non sono in grado di valutare autonomamente i risultati ottenuti. Questa mancanza impedisce alla IA di compiere scoperte reali che richiedono un tipo di autorealizzazione e complessità avanzata.
Un piano ambizioso
Sutton ha condiviso ieri i suoi obiettivi per un sistema autonomo di IA. Il suo ideale è un agente che sia capace di "costruire modelli interni del mondo", che possa organizzare in modo autonomo le fasi di sperimentazione, valutazione e selezione, senza dipendere esclusivamente da dati statici. Questo è esattamente l'approccio che Oak Lab cerca di implementare, sfruttando l'apprendimento di rinforzo.
Il modello ideale, ha spiegato Sutton, è un agente in grado di apprendere durante l’operatività stessa, senza bisogno di enormi set di dati pre-elaborati e supervisionati. L’apprendimento dovrebbe avvenire in un ciclo continuo, come accade nel mondo umano: attraverso l’esperienza e con l’apprendimento dal contesto circostante.
Obiettivi tecnologici
Oak Lab ha un obiettivo ambizioso: sviluppare agenti con un miliardo di miliardi (una trilione) di parametri, capaci di apprendere e pianificare in tempo reale e con un consumo energetico estremamente contenuto — circa 20 watt — il che è estremamente efficiente in termini energetici rispetto alle strutture esistenti.
Rivoluzione dell’approccio
- Apprendimento continuo durante l’operatività
- Costruzione interna di modelli del mondo
- Autovalutazione e sperimentazione autonomi
- Efficienza energetica estrema
La svolta tecnologica che Sutton vuole portare con Oak Lab si basa sulla convinzione che l’apprendimento debba emergere naturalmente dal comportamento e dall’esperienza, e non essere semplicemente il risultato di supervisione esterna.
Il ruolo di Keen Technologies
Sutton e Khurram Javed hanno lavorato precedentemente insieme presso Keen Technologies, una società di IA fondata da John Carmack (il celebre creatore di DOOM e co-innovatore del visore Oculus VR). La collaborazione di precedenti esperienze conduce ora ad un progetto che cerca di rompere in modo radicale con le strutture esistenti.
Persone come motore del cambiamento
Sutton, uno dei pionieri del reinforcement learning, ha da sempre sostenuto che l’apprendimento deve procedere come un’attività in cui il sistema "agisce, riceve feedback e adatta la sua strategia". Oak Lab rappresenta un laboratorio ideale per sperimentare questa visione all'interno di una cornice startup, che consente agilità e velocità di sperimentazione.
Una scommessa sul futuro
Non tutti condividono questa visione radicalmente diversa del futuro dell'intelligenza artificiale. Tuttavia, Sutton non sembra smarrirsi nelle critiche: il suo obiettivo è offrire un'alternativa concreta, un modello che abbandoni la logica "dati in su input e risultati in output".
Se avrai modo di seguire lo sviluppo di Oak Lab, potrai osservare con attenzione come un team di pensatori visionari cerca di ridefinire il paradigma dominante dell’IA, con un chiaro obiettivo: costruire agenti capaci di imparare veramente, non solo di imitare.