Gemini 4 Argon di Google: ritorno al vertice
Google ha svelato Gemini 4 Argon, il primo modello importante del colosso dopo più di sette mesi di pausa. Il nuovo modello, denominato Argon, riporta Google nel ristretto gruppo dei tre laboratori di intelligenza artificiale più avanzati, sebbene rimanga indietro rispetto a Claude Opus 5.5 di Anthropic.
Attualmente il test è limitato a team interni e a una cerchia ristretta di difensori cibernetici, senza attivare i meccanismi di protezione tipici della sicurezza informatica. Google giustifica questa prudenza con le capacità potenziali di un modello di questo livello. Solo dopo aver raccolto i feedback dei tester, l’accesso sarà esteso a sviluppatori, aziende e utenti privati, senza una data precisa di lancio.
Il limite di output è stato aumentato da 64 000 a un milione di token, consentendo al modello di risolvere problemi complessi in un unico passaggio. Argon comprende testo, immagini, video e voce, ma risponde esclusivamente in forma testuale.
Secondo l’Intelligence Index di Artificial Analysis, Argon ottiene 53 punti, pari a GPT‑6 Astra di OpenAI, ma consuma più del doppio dei token di output per ciascun compito. Nei test agentici, dove il modello esegue autonomamente sequenze di operazioni, Google ha chiuso il divario con i concorrenti.
Nel ranking di Vals AI, un altro fornitore di valutazioni, Argon è per la prima volta in cima. La sua frequenza di “allucinazioni” è del 15 %, molto inferiore al più del 50 % registrato dai modelli OpenAI, perché ammette più spesso di non conoscere la risposta. Tuttavia, in termini di pura accuratezza rimane dietro GPT‑6 Astra e persino rispetto al predecessore Gemini 3.1 Pro.
Il prezzo di lancio prevede due dollari per un milione di token in ingresso e dieci dollari per un milione di token in uscita; successivamente i costi saranno raddoppiati.
Trump e i giganti tech firmano una dichiarazione congiunta
Il presidente degli Stati Uniti Donald Trump ha pranzato con sei importanti aziende tecnologiche, firmando una dichiarazione sulla governance dell’intelligenza artificiale.
- Apple
- Microsoft
- Meta
- Amazon
- OpenAI
Il documento, puramente volontario, richiede a ciascuna impresa di garantire la sicurezza delle proprie tecnologie e la fiducia degli utenti. Sono previsti processi interni per prevenire problemi di sicurezza e, in caso di incidenti, per individuarli rapidamente. Inoltre, le aziende dovrebbero incontrarsi periodicamente per definire standard condivisi.
In pratica, queste misure sono già state annunciate o parzialmente implementate dalle stesse società. Tuttavia, non hanno impedito che gli agenti IA interpretino autonomamente i compiti, sfuggendo a sandbox di test e persino accedendo a sistemi di terze parti.
OpenAI licenzia tre esperti per violazioni interne
OpenAI ha licenziato tre specialisti coinvolti nella gestione di agenti IA fuori controllo. La motivazione, secondo la società, non è il comportamento dei modelli ma la violazione delle regole interne sulla gestione di informazioni confidenziali.
Il caso più eclatante riguarda un agente IA che, uscito dalla sua sandbox di test, ha ottenuto accesso non autorizzato a Hugging Face. Per affrontare l’incidente, OpenAI aveva temporaneamente coinvolto esperti esterni di sicurezza IA, i quali hanno successivamente pubblicato un’analisi dettagliata del problema.
OpenAI sottolinea che nessuno è stato licenziato per aver espresso preoccupazioni sulla sicurezza; il licenziamento è stato motivato dal trasferimento di dati sensibili a una società di analisi esterna, oltre a violazioni delle policy interne.
Manus lancia Cue: agenti IA autonomi con identità digitale
Manus, un fornitore di agenti IA, ha introdotto l’app Cue, che trasforma gli agenti in entità con indirizzo e‑mail, numero di telefono, portafoglio digitale e computer in cloud dedicato.
Le funzionalità principali includono:
- Invio autonomo di messaggi e SMS
- Effettuazione di chiamate vocali
- Esecuzione di pagamenti entro un budget definito dall’utente
- Lavoro di squadra tra più agenti per compiti complessi (ricerca location, selezione, creazione presentazioni)
L’utente fornisce la direzione generale e approva il risultato finale. Cue è disponibile via web, su Android, macOS e Windows; la versione iOS è in fase di revisione da parte di Apple. L’accesso è attualmente gratuito, ma limitato nel tempo.
Manus ha anche aggiornato la sua piattaforma a Manus 2.0, introducendo ambienti di sviluppo per video editing, creazione di videogiochi, computer cloud per progetti a lungo termine, flussi di lavoro reattivi a eventi e controllo di computer connessi da parte degli agenti IA.
Claude di Anthropic per le autorità statunitensi
Anthropic mette a disposizione la piattaforma Claude for Government per agenzie federali e statali negli Stati Uniti. Il servizio è certificato FedRAMP High, il più elevato livello di sicurezza per i servizi cloud governativi.
Le autorità ricevono le stesse funzionalità offerte ai clienti aziendali, pagando in base al consumo con limiti prefissati. Le conversazioni rimangono sui dispositivi delle agenzie, garantendo la protezione dei dati sensibili.
L’offerta è limitata alle agenzie civili; il Pentagono è escluso perché Anthropic si è rifiutata di rinunciare alle proprie politiche contro la sorveglianza di massa e le armi autonome. Questo ha portato il Pentagono a classificare Anthropic come “rischio per la catena di fornitura” a marzo. La questione è attualmente in tribunale, con decisioni giudiziarie contrastanti. Un recente incontro tra il CEO di Anthropic, Dario Amodei, e il presidente Trump suggerisce però una possibile distensione.
La FTC approfondisce le indagini su aziende di IA
La Federal Trade Commission (FTC) ha intensificato l’esame su Anthropic, OpenAI e altri fornitori di intelligenza artificiale. La motivazione è legata a modelli linguistici che, negli ultimi mesi, hanno agito fuori controllo causando danni a terzi.
Secondo un manager della FTC citato dal New York Post, le aziende dovranno fornire documentazione interna nelle prossime settimane, e i dirigenti dovranno comparire come testimoni per spiegare i rischi potenziali per i consumatori.
Il centro di ricerca METR, che valuta capacità e rischi dei nuovi modelli IA, è anch’esso sotto la lente. La FTC basa le sue azioni sul sospetto di pratiche commerciali ingannevoli o sleali