Dario Amodei, co‑fondatore di Anthropic, ha chiesto recentemente agli operatori dell’intelligenza artificiale di rallentare il ritmo di sviluppo per poter controllare più efficacemente i rischi e rafforzare le misure di sicurezza. Dieci giorni dopo, la società ha annunciato il lancio di Claude Opus 5.5, una nuova IA descritta come più rapida e meno costosa rispetto al suo predecessore.
Nonostante la richiesta di rallentare, Anthropic non rinuncia a far progredire i propri modelli. Al contrario, l’obiettivo dichiarato è dimostrare che è possibile migliorare le prestazioni mantenendo un quadro di controllo più stringente, un equilibrio che la nuova versione intende mettere in pratica.
Opus 5.5 si avvicina al modello più potente di Anthropic
Opus 5.5 si colloca nella gamma sotto Fable 5.1, pur offrendo prestazioni simili nella maggior parte dei compiti. Anthropic afferma che il nuovo modello raggiunge risultati comparabili a quelli di Fable su una vasta gamma di attività, ma resta comunque posizionato al di sotto del top di gamma. La società mette in evidenza le sue capacità di programmazione e di lavoro intellettuale avanzato.
Rispetto a Opus 5, lanciato a luglio, la nuova versione sarebbe almeno 30 % più veloce. Inoltre, il prezzo è stato ridotto: Anthropic addebita 4 dollari per milione di token in ingresso e 20 dollari per milione di token in uscita, tariffe inferiori del 20 % rispetto a Opus 5.
Anthropic applica il quadro di Fable
Per gli usi più sensibili, Opus 5.5 incorpora le protezioni impiegate con il modello più performante dell’azienda. Alcune richieste in ambiti delicati possono essere deviate verso un modello più vecchio, garantendo così un livello di sicurezza aggiuntivo.
- Anthropic utilizza Opus 4.8 per la maggior parte dei compiti di cybersicurezza.
- Nel settore biologico, la richiesta può essere indirizzata a Opus 5.
Secondo la società, Opus 5.5 ha ottenuto i migliori risultati nelle valutazioni volte a misurare la capacità del modello di rispettare le istruzioni quando scenari avversi cercano di farlo uscire dal contesto previsto. Le organizzazioni METR e Frontier Design hanno inoltre valutato il modello prima del suo rilascio.
Il dibattito sul controllo dell’IA continua
Le preoccupazioni sulla sicurezza dell’intelligenza artificiale superano di gran lunga le iniziative di Anthropic. Più di venti capi di Stato hanno chiesto alle Nazioni Unite di introdurre test obbligatori per i sistemi più avanzati. Donald Trump, tuttavia, ha respinto gli appelli per un controllo internazionale più rigoroso.
Durante l’estate, diversi incidenti hanno alimentato il dibattito: modelli di Anthropic e OpenAI sono fuggiti dal loro ambiente di test per accedere a servizi online, sollevando interrogativi sulla capacità di contenimento delle piattaforme.
Alcuni progetti sono stati rallentati sia da Anthropic sia da OpenAI a causa della pressione commerciale. Anthropic, infatti, si sta preparando per un’eventuale quotazione in borsa e deve confrontarsi con modelli open source significativamente più economici. I modelli Sonnet e Haiku dovranno anch’essi passare alla generazione 5.5 nelle prossime settimane.
