Kimi ha annunciato il lanzio di Kimi K3, un modello multimodale open-source con 2,8 trilioni di parametri, che supporta l'elaborazione nativa delle immagini e dei video e presenta un window context di un milione di token. Il modello, basato su una architettura di tipo Mixture-of-Experts con 896 esperti e una tecnica di attenzione chiamata "Kimi Delta Attention", è rivolto a compiti avanzati come la programmazione su larga scala, il lavoro intellettuale e le conclusioni complesse. Gli sviluppatori hanno anticipato la pubblicazione completa delle pesi del modello entro il 27 luglio 2026.

Preferenze e Prestazioni di Kimi K3

In una serie di benchmark interni, Kimi K3 si colloca immediatamente dopo i modelli chiusi di alto livello Fable 5 e GPT-5.6 Sol, ma supera in modo significativo tutti i modelli testati. Il modello è in grado di completare 3 test su 6 nella categoria della programmazione e si piazza sul podio in tutti i restanti. Per i test relativi agli agenti, Kimi K3 vince 3 su 6 prove e mostra prestazioni competitive nei test visivi con Fable 5 che mantiene la leadership in 2 casi.

Kimi K3 in un Benchmark Indipendente

Laboratori indipendenti come "Artificial Analysis" hanno confermato che Kimi K3 raggiunge punteggi paragonabili a modelli di frontiera come Fable 5 e GPT-5.6 Sol. Nell'Intelligence Index di Artificial Analysis, Kimi K3 ottiene 57 punti, un punteggio simile a Opus 4.8 (56) e GPT 5.5 (56) ma ancora inferiore a Fable 5 (60) e GPT-5.6 Sol (59). Nell'area degli agenti, Kimi K3 raggiunge una valutazione Elo di 1668 su GDPval v2, un miglioramento notevole rispetto all'1190 del predecessore K2.6.

Analisi delle Capacità Visive

Uno dei punti di forza di Kimi K3 è il sistema "Vision in the Loop", una combinazione di visione artificiale e programmazione in grado di generare output visivi e gestire compiti complessi su lunghe sequenze. Kimi ha dato in vista esempi come la creazione di un gioco open-world generato proceduralmente nel browser con Three.js WebGPU e GPU-Compute e una visualizzazione interattiva di un buco nero. Il modello ha anche dimostrato di poter creare simulazioni della capsula spaziale "Lungo Marsiglio 10", emulando il Game Boy Advance.

Implementazioni Tecnologiche di Kimi K3

Kimi K3 si basa su una modernissima tecnologia di attenzione chiamata "Kimi Delta Attention", che permette una decoding velocità fino a 6,3 volte maggiore in contesti con grandi finestre di input. Le "Attention Residuals" di Kimi aumentano l'efficienza di addestramento del modello del 25% con un impatto minimo sul costo del calcolo.

Costi di Utilizzo di Kimi K3

Per quanto riguarda i costi, una milione di token di input costa tra 0,30$ (con cache) e 3,00$ senza cache, mentre una milione di token di output costa 15,00$. Il costo di Kimi K3 supera di gran lunga le tariffe del predecessore K2.6, che era rispettivamente a 0,16$, 0,95$ e 4,00$. Nonostante il prezzo aumenti anche per i fornitori cinesi di modelli di frontiera, il costo di Kimi K3 si colloca esattamente al livello di Anthropic's Sonnet 5, anche se questo modello sembra offrire prestazioni inferiori.

Il modello, infatti, costa 0,94$ per test in media sull'indice di intelligenza, vicino al costo del GPT-5.6 Sol e a metà rispetto al più costoso Opus 4.8. Tra i modelli a peso aperto, DeepSeek V4 Pro rimane decisamente più economico a 0,04$.

Economie di Scala e Token Utilizzo

Kimi K3 ha dimostrato di utilizzare meno token rispetto ai modelli precedenti: per un insieme di valutazioni, ne ha eseguito circa 132 milioni, evidenziando una maggiore efficienza. Questo è rilevante nel contesto di applicazioni complesse dove l'economia di token può avere un impatto significativo sui costi totali e sull'efficienza operativa.

Un Paradigma Cambiato

I dati sottolineano che i tempi in cui i modelli cinesi di Intelligenza Artificiale erano venduti a basso costo sono ormai finiti. Kimi K3 si adatta alla nicchia premium, posizionandosi vicino ai modelli di punta occidentali. Mentre le prestazioni sono ottime, i costi di utilizzo sono riallineati a standard simili a quelli dei competitor occidentali, con prezzi di input simili ai modelli medie performance come Anthropic's Sonnet 5.

Riduzione del Costo della Halluzinazione

In una valutazione di Artificial Analysis, Kimi K3 ha registrato una percentuale di errori inferiore rispetto al predecessore, passando da una percentuale del 51% rispetto agli errori da un'accuratezza maggiore. Questo rappresenta un passo in avanti rilevante per il livello di attendibilità del modello.

Applicazioni Pratiche e Ambizioni Tecniche

Uno dei principali ambiti di applicazione di Kimi K3 è la programmazione su larga scala con supervisione ridotta. Le capacità del modello vanno ben oltre la generazione di codice isolato, con il modello in grado di coordinare strumenti terminali e mantenere il focus su compiti complessi. La combinazione di elaborazioni di immagini e output visivi permette di applicare Kimi in aree diverse, comprese la gestione grafica, la progettazione CAD e l'implementazione di software interattivo in tempo reale.

Innovazioni Future e Impatto del Mercato

Con Kimi K3, Kimi continua a spingere il confine tecnologico, fornendo un modello che offre prestazioni vicine ai modelli chiusi di frontiera a costi competitivi. Questo potrebbe impattare non solo il mercato cinese, ma anche la competizione globale tra fornitori di IA, con particolare riferimento a quelli che mirano ai segmenti premium.