Un momento critico per la governance dell'intelligenza artificiale

Siamo entrati in un nuovo capitolo delle capacità dell'intelligenza artificiale, e questo richiede un nuovo capitolo per la politica sull'IA. Nessuna azienda, industria o governo può affrontare questa sfida da solo. Dobbiamo rispondere a questo momento con una predisposizione verso azioni significative piuttosto che verso la perfezione politica. Le puntate in gioco sono enormi: l'IA avanzata potrebbe accelerare lo sviluppo di nuovi medicinali, rafforzare le infrastrutture critiche, ampliare le opportunità economiche e aiutare a risolvere problemi scientifici che hanno resistito a generazioni di sforzi umani. Tuttavia, le capacità che rendono i modelli più utili comportano anche rischi, e non rimarranno confinate a pochi laboratori di frontiera.

Il recente articolo del Chief Scientist di OpenAI, Jakub Pachocki, ha sottolineato che il rapido aumento dell'intelligenza artificiale, incluso il potenziale dell'auto-miglioramento ricorsivo, richiede "estrema cautela". Le capacità di Astra, le prime prove dell'accelerazione della ricerca guidata dall'IA, e l'articolo di Jakub indicano tutti la stessa direzione: l'IA sta avanzando rapidamente e la politica deve procedere al suo passo. Siamo di fronte a una finestra che si sta chiudendo per stabilire salvaguardie durature prima che le capacità dell'IA superino le istituzioni responsabili della loro governance. È il momento per i policymaker di agire.

Un'agenda d'azione in quattro pilastri

OpenAI ha delineato una strategia articolata per affrontare la necessità urgente di una governance robusta dell'IA. Questa agenda comprende quattro pilastri distinti, ognuno dei quali affronta aspetti critici della regolamentazione e della sicurezza dell'intelligenza artificiale. La strategia riconosce che nessun singolo approccio - né esclusivamente federale, né esclusivamente volontario, né puramente nazionale - sarà sufficiente. Invece, è necessario un approccio coordinato su più livelli che coinvolga il governo federale, gli stati, l'industria e la comunità internazionale.

Il primo pilastro: requisiti federali obbligatori sulla sicurezza dell'IA

OpenAI sta spingendo attivamente per requisiti nazionali obbligatori sulla sicurezza dell'IA, in grado di evolversi insieme alla tecnologia. L'azienda intende collaborare con il Congresso su una regolamentazione nazionale obbligatoria e basata sulla capacità. Questo non è semplicemente un appello, ma un impegno concreto di OpenAI a lavorare costruttivamente con i responsabili politici federali.

La visione di OpenAI per un quadro federale è descritta nel dettaglio nel suo "Blueprint for Democratic Governance of Frontier AI" (Piano per la governance democratica dell'IA di frontiera). Questo documento traccia un percorso verso un quadro federale duraturo che dovrebbe includere: requisiti comuni di test e valutazione indipendente, protezioni più forti della sicurezza informatica, regole chiare per la segnalazione di incidenti, una maggiore preparazione nazionale e misure condivise per tracciare i progressi verso l'auto-miglioramento ricorsivo.

Diversi seri propositi sulla sicurezza di frontiera stanno prendendo forma nel Congresso. OpenAI ha affermato che continuerà a impegnarsi costruttivamente e si aspetta di supportare legislazione che materialmente aumenti il livello di sicurezza. Con puntate così elevate, non si può permettere che il perfetto diventi il nemico del bene. Il Congresso dovrebbe agire prima di concludere la sessione.

Un quadro nazionale dovrebbe essere forte ma attentamente mirato. I requisiti di sicurezza di frontiera dovrebbero applicarsi solo alla manciata di laboratori ben finanziati che sviluppano i sistemi più capaci - non a startup, piccoli sviluppatori o ricercatori che operano molto lontano dalla frontiera. Gli obblighi dovrebbero essere proporzionati alle capacità e ai rischi. Inoltre, la politica sulla sicurezza di frontiera non dovrebbe diventare politica sui modelli aperti con un altro nome.

Il secondo pilastro: mantenere lo slancio negli stati

Fino a quando il Congresso non agisce, OpenAI continuerà a sostenere la legislazione statale che rafforza l'ecosistema più ampio della sicurezza dell'IA. Oggi l'azienda ha annunciato il suo supporto per quattro progetti di legge della California che affrontano aspetti complementari dell'ecosistema della sicurezza dell'IA:

  • SB 813 - Stabilisce un processo per designare organizzazioni indipendenti e qualificate capaci di valutare i rischi dell'IA. Questo progetto di legge crea l'infrastruttura per valutazioni di sicurezza indipendenti e rigorose.
  • AB 1405 - Stabilisce standard per gli auditor dell'IA. Questo garantisce che coloro che valutano i sistemi di IA abbiano le qualifiche e le competenze necessarie per condurre valutazioni significative.
  • SB 1119 - Fornisce protezioni specifiche per i giovani dalle tecnologie dell'IA. Riconosce le vulnerabilità particolari dei minori e stabilisce salvaguardie specifiche per loro.
  • AB 1864 - Stabilisce salvaguardie contro le minacce biologiche abilitate dall'IA. Questo affronta uno dei rischi più significativi e potenzialmente catastrofici associati all'IA avanzata.

OpenAI ha inoltre supportato in precedenza la legislazione della California SB 53, il RAISE Act di New York, l'SB 315 dell'Illinois e gli audit indipendenti nella legislazione sulla sicurezza di frontiera in corso di considerazione nel Massachusetts. L'azienda incoraggia gli stati a convergere intorno a queste salvaguardie comuni. Mentre lo fanno, possono creare una linea di base nazionale de facto che il Congresso potrebbe infine codificare - un approccio che OpenAI definisce "federalismo inverso".

Però l'armonizzazione non significa congelare i requisiti sul posto. Gli stati dovrebbero continuare a muoversi per riempire il vuoto e alzare l'asticella fino a quando il governo federale non agisce. Questo approccio a livello statale crea anche una opportunità per sperimentare diversi modelli di governance e imparare cosa funziona meglio prima di codificarlo a livello federale.

Il terzo pilastro: standard guidati dall'industria

OpenAI lavorerà con altri laboratori di frontiera per far avanzare gli standard dell'IA di frontiera, costruendo uno sforzo volontario ora, con o senza il supporto del governo. Questa collaborazione tra aziende rivali riconosce che la sicurezza dell'IA è un interesse comune che trascende la competizione commerciale.

Gli standard guidati dall'industria sono importanti per diversi motivi. In primo luogo, gli esperti tecnici all'interno dei laboratori di frontiera comprendono meglio le sfide di sicurezza specifiche e il ritmo del progresso tecnologico. In secondo luogo, gli standard volontari possono evolvere più rapidamente rispetto alla legislazione governativa. In terzo luogo, gli standard dell'industria possono essere più sofisticati e tecnicamente accurati di quanto potrebbero essere i requisiti legislativi.

OpenAI ha sottolineato che ha rafforzato il monitoraggio, l'allineamento e le salvaguardie della sicurezza in tutto il ciclo di vita dello sviluppo dei modelli. Questo include un isolamento più forte per i carichi di lavoro di ricerca di frontiera, un monitoraggio ampliato del comportamento del modello durante l'addestramento abilitato da strumenti e le valutazioni, e regole più chiare per quando escalare i problemi. Per Astra, l'azienda ha anche introdotto un monitoraggio universale delle traiettorie complete, incluse le catene di pensiero, e una porta di valutazione dell'allineamento obbligatoria prima di una distribuzione interna più ampia.

Il quarto pilastro: costruire standard globali

OpenAI sosterrà approcci internazionali compatibili per misurare le capacità, gestire i rischi, preservare il controllo umano e determinare quando e come lo sviluppo dovrebbe rallentare o fermarsi, anche se ciò significa rallentare l'avanzamento delle capacità del modello. Questo è un impegno significativo che mostra la priorità che OpenAI attribuisce alla sicurezza globale dell'IA rispetto alla mera competizione tecnologica.

Gli standard globali sono essenziali perché l'IA è una tecnologia globale. I modelli sviluppati in tutto il mondo, inclusi i modelli aperti, si avvicineranno sempre più alla frontiera odierna e diventeranno ampiamente disponibili. Senza standard e governance internazionali coordinati, esiste il rischio che diversi paesi adottino approcci frammentari e incoerenti che potrebbero indebolire la sicurezza complessiva.

La finestra dei difensori e la finestra della politica

Greg Brockman ha descritto una "finestra dei difensori" - un periodo limitato durante il quale l'IA di frontiera può aiutare i difensori a rafforzare i sistemi critici prima che le potenti capacità offensive diventino diffuse. I policymaker affrontano un momento analogo: una finestra che si sta chiudendo per stabilire salvaguardie durevoli prima che le capacità dell'IA superino le istituzioni responsabili della loro governance.

Questa metafora della finestra è potente perché cattura l'idea che c'è un periodo ottimale per agire. Se aspettiamo troppo a lungo, sarà più difficile - forse impossibile - implementare salvaguardie efficaci. Se agiamo troppo presto, potremmo perdere informazioni che ci aiuterebbero a progettare migliori regolamenti. Ma il momento migliore per agire sembra essere adesso, mentre la tecnologia è ancora relativamente concentrata nelle mani di pochi laboratori di frontiera che hanno gli incentivi e la capacità di conformarsi a standard rigorosi.

Man mano che le capacità crescono, la fiducia nella sicurezza deve sempre più determinare il ritmo del progresso dell'IA. La sicurezza non ostacola il progresso; è ciò che consente al progresso di procedere ulteriormente e di beneficiare più persone. Questo è un punto cruciale che OpenAI ha voluto enfatizzare: la sicurezza e l'innovazione non sono nemiche, ma alleate. Una tecnologia in cui le persone non si fidano non sarà adottata ampiamente, indipendentemente da quanto sia capace.

L'auto-miglioramento ricorsivo: preparazione per il futuro

L'auto-miglioramento ricorsivo completamente autonomo - in cui i sistemi di IA guidano indipendentemente generazioni successive di IA sempre più capace - non sta accadendo oggi. Non dovremmo perseguirlo se non quando può essere fatto in modo sicuro. Tuttavia, l'IA sta già accelerando parti della ricerca utilizzata per sviluppare e allineare la prossima generazione di modelli.

La ricerca più recente di OpenAI mostra che gli agenti di IA possono eseguire alcuni compiti che richiederebbero a ricercatori esperti diversi giorni. Questo non è auto-miglioramento ricorsivo, ma è un'evidenza della direzione del viaggio. Questo sviluppo è profondamente significativo perché mostra che siamo già su un percorso verso sistemi di IA che possono aiutare a sviluppare generazioni successive di IA più capaci.

OpenAI sottolinea che questa accelerazione può e deve essere diretta verso la sicurezza. L'obiettivo è costruire in modo sicuro ricercatori di IA automatizzati che lavorino sotto la supervisione umana per far avanzare sia l'apprendimento profondo che l'allineamento - utilizzando ogni generazione di IA per aiutare a rendere la prossima ancora più sicura, più allineata e più facile da controllare, non semplicemente più capace.

I governi dovrebbero sviluppare modi comuni per misurare questo progresso, preservare il controllo umano significativo e stabilire barre di sicurezza condivise per quando e come lo sviluppo dovrebbe rallentare o fermarsi. Se non riusciamo a soddisfare certe barre di sicurezza senza rallentare la crescita della capacità, dovremmo dare priorità alle prime. Più potente diventa la tecnologia, più forti devono diventare le salvaguardie circostanti.

OpenAI ha affermato chiaramente che quando procedere rappresenterebbe un rischio inaccettabile per la sicurezza, rallenterà o fermerà lo sviluppo o la distribuzione di sistemi che non può sufficientemente salvaguardare. L'azienda ha dimostrato questo impegno in passato e continuerà a farlo come richiesto dal suo quadro di preparazione.

Modelli aperti e modelli chiusi: non è un compromesso zero

È importante sottolineare che la politica sulla sicurezza di frontiera non dovrebbe diventare politica sui modelli aperti con un altro nome. I modelli aperti possono essere parte della soluzione, in particolare nella sicurezza informatica e dove le esigenze di sovranità, sicurezza o residenza dei dati favoriscono la distribuzione locale. La maggior parte compete non sulla frontiera, ma su costo, controllo e latenza.

OpenAI, insieme ad altre aziende, ha affermato nel firmare la lettera "Open Weights and American AI Leadership" che l'America ha bisogno sia di modelli aperti che di modelli chiusi. Un quadro federale dovrebbe affrontare le capacità e i