Google ha rilasciato un’importante aggiornamento al modello di intelligenza artificiale aperto Gemma 4, concentrato su miglioramenti di velocità, completezza e funzionalità, specialmente per quanto riguarda l’elaborazione su GPU Nvidia Hopper e l’uso di strumenti esterni.
Veloce e efficiente con Flash Attention 4
Con l'attivazione di Flash Attention 4, Google ha notevolmente migliorato la velocità di lettura delle domande da parte del modello, aumentando la sua capacità di elaborare le richieste di input di circa il 25 al 70 percento. Inoltre, il tempo di attesa per la prima risposta è stato ridotto fino al 31 percento, rendendo l’interfaccia compatta e snella.
I miglioramenti non influenzano solo il tempo, ma anche il comportamento del modello quando effettua chiamate agli strumenti esterni ("tool calls"): sono state risolte alcune problematiche che impedivano alle funzionalità di interfacciarsi correttamente con gli strumenti.
Migliora l’intelligenza artificiale agent-based
La versione Gemma 4 31B presenta una significativa crescita in quanto a ragionamento "agente" (agentic reasoning) e gestione delle chiamate a strumenti. In tutte le situazioni testate, il modello mostra risultati positivi, con incrementi notevoli negli scenari applicativi. Ad esempio, nei test di telecomunicazioni, i miglioramenti raggiungono picchi del 10,1%.
Bettere risposte, meno abbreviazioni
Google ha notificato una riduzione marcata dei casi in cui il modello fornisce risposte incomplete o troncate. Questo miglioramento ha portato a una maggiore chiarezza e accuratezza generale, rendendo più affidabili le informazioni restituite dall’IA.
In particolare, per quanto riguarda le capacità visive, i parametri del modello permettono ora di regolare manualemente il parametro “maxsofttokens”: da 280 a 1120, migliorando l’accuratezza delle operazioni OCR (riconoscimento ottico del testo) e supportando immagini con una risoluzione fino a 2,51 megapixel.
Interfaccia di configurazione interattiva
- Google ha offerto agli sviluppatori un configuratore interattivo disponibile su Hugging Face.
- Il modello non è più aggiornato come versione separata, ma mantiene il nome "Gemma 4".
- Per il momento Google non ha fornito una descrizione dettagliata sugli aggiornamenti delle versioni più piccole, ma il repository Hugging Face indica che tutti i parametri della generazione Gemma 4, incluso il nuovissimo modello 12B, sono stati migliorati.
Reazioni della community
Sebbene le performance migliorino, una parte della comunità critica il fatto che Google continui a rilasciare gli aggiornamenti sempre con lo stesso nome, "Gemma 4", senza adottare una numerazione che ne differenzi le iterazioni, come potrebbe essere "Gemma 4.1".
Aggiornamenti e benchmark
Negli ultimi benchmark ufficiali, Google ha confrontato le versioni 31B ed E4B solo con le loro rispettive versioni precedenti. Nonostante questo, la base dei test mostra che l’intera serie Gemma, con le nuove dimensioni dei parametri (in particolare Gemma 12B), beneficia dell’upgrade.
I risultati, tuttavia, potrebbero non rappresentare completamente i miglioramenti ottenuti da tutta la gamma di modelli. La mancanza di benchmark con modello precedente "puro" rappresenta una limitazione, anche se l’avanzamento è comunque riconoscibile.
Offerte e vantaggi per l’abbonamento
Per rimanere sempre aggiornati sugli sviluppi dell’intelligenza artificiale, Google raccomanda l’abbonamento al servizio TheDECODER. Con un abbonamento si può:
- Leggere il contenuto senza pubblicità;
- Partecipare alla community di discussione;
- Ricevere un newsletter settimanale sull’intelligenza artificiale;
- Accedere a newsletter annuali dedicate ("KI Radar");
- Beneficiare di sconti fino al 25 percento sugli eventi tecnici;
- Ottenere accesso all’archivio completo degli ultimi dieci anni.