Kimi K3: il modello di frontiera da 2,8T di Moonshot
Il modello Mixture-of-Experts da 2.800 miliardi di parametri di Moonshot, con finestra di contesto da 1M di token, input nativo di immagini e video e pesi aperti.
1M tokens · Text / Vision / Video / Code · Prompt cache
Okou non esegue Kimi K3. Questa pagina è un riferimento su specifiche, prezzi e benchmark. Per lo stesso tipo di lavoro su Okou, oggi usa Claude Fable 5.
Vedi Claude Fable 5Kimi K3 è il modello di frontiera di Moonshot AI, presentato il 16 luglio 2026: una rete Mixture-of-Experts sparsa con 2.800 miliardi di parametri totali, 16 esperti attivi su 896 per token, finestra di contesto da 1.048.576 token e input nativo di immagini e video. Artificial Analysis gli assegna 57,1 sull'Intelligence Index v4.1: quarto tra le configurazioni testate, dietro Claude Fable 5 (59,9) e GPT 5.6 Sol (58,9), davanti a Claude Opus 4.8.
Il prezzo di listino è $3.00 per milione di token in input, $0.30 in caso di cache hit e $15.00 per milione di token in output, uniforme su tutta la finestra e senza sovrapprezzo per contesti lunghi. I pesi aperti sono usciti su Hugging Face il 27 luglio 2026 con la Kimi K3 License di Moonshot. Okou non esegue Kimi K3. Il modello più vicino nella gamma Okou è Claude Fable 5, che ha la stessa finestra da 1M di token ed è in testa allo stesso Intelligence Index.
Cos'è Kimi K3?
16 luglio 2026 · La linea di frontiera di Moonshot. Successore della serie Kimi K2, incluso K2.7 Code.
Kimi K3 è il modello di frontiera di Moonshot AI, presentato il 16 luglio 2026 e servito tramite l'app Kimi e l'API Kimi con l'id kimi-k3. È un modello Mixture-of-Experts sparso: 2.800 miliardi di parametri totali con 16 esperti attivi su 896 per token, ed è questo che tiene il costo di inferenza vicino a quello di un modello denso di fascia media nonostante la dimensione.
Il salto rispetto alla linea K2 è più evidente nel lavoro di agente a lungo orizzonte. Nella suite di lancio di Moonshot, K3 supera tutti i modelli testati su Program Bench, SWE Marathon, BrowseComp, SpreadsheetBench 2 e Automation Bench, restando dietro a Claude Fable 5 su FrontierSWE e a GPT 5.6 Sol su DeepSWE. Sull'Elo GDPval-AA v2 di Artificial Analysis, che misura il lavoro intellettuale a valore economico, arriva a 1668, contro i 1190 di Kimi K2.6 e sopra i 1600 di Claude Opus 4.8.
Cosa rende notevole Kimi K3
Caratteristiche principali di architettura e capacità.
K3 unisce lo stack MoE a due meccanismi di efficienza che Moonshot chiama Kimi Delta Attention e Attention Residuals, ai quali attribuisce una decodifica fino a 6,3 volte più rapida, e serve la finestra da 1.048.576 token a un prezzo unico, senza fasce di contesto. L'output arriva a 131.072 token per impostazione predefinita e può essere configurato più alto all'interno della stessa finestra. In input testo, immagini e video; in output testo. L'API su platform.kimi.ai è compatibile con OpenAI e i pesi — circa 594 GB in MXFP4 — sono pubblicati per il self-hosting.
Specifiche in breve
Benchmark di Kimi K3
I punteggi su coding, agenti e visione sono i numeri di lancio di Moonshot, con tutti i modelli al massimo sforzo di ragionamento; l'Intelligence Index e l'Elo GDPval sono misurazioni indipendenti di Artificial Analysis. Una tabella del fornitore è un tetto, non una garanzia, e tester indipendenti hanno riportato un tasso di allucinazione ben superiore a quello dichiarato da Moonshot.
Prezzi di Kimi K3
Prezzo di listino del provider, per 1M di token.
Come si comporta Kimi K3 nella pratica
Comportamento riportato dal materiale di lancio del fornitore e da valutazioni indipendenti.
Esecuzioni di agente lunghe
I benchmark in cui K3 è primo — SWE Marathon, Automation Bench, BrowseComp — misurano la capacità di restare sull'obiettivo per centinaia di passi, non la correttezza di una singola risposta. Coincide con il posizionamento di Moonshot: prima di tutto un motore per agenti.
Prezzo uniforme su 1M di token
L'intera finestra da 1.048.576 token viene fatturata a una sola tariffa, senza sovrapprezzo oltre una soglia. La finestra da 1M di GPT-5.5, invece, applica un prezzo diverso all'input oltre i 272K token, ed è ciò che rende costose altrove le esecuzioni molto lunghe in un unico contesto.
Costo per attività
Artificial Analysis ha misurato $0.94 per attività sull'intero indice: circa la metà degli $1.80 di Claude Opus 4.8 e in linea con gli $1.04 di GPT 5.6 Sol. Moonshot dichiara tassi di cache hit oltre il 90% sui carichi di coding, il che avvicina il costo effettivo dell'input alla tariffa da $0.30.
I migliori task per agenti con Kimi K3
Leggere un intero repository in un solo contesto
Una finestra da 1M di token a prezzo uniforme contiene un'intera codebase, un trimestre di ticket di supporto o un lungo insieme documentale in una sola richiesta, senza spezzettare e senza un sovrapprezzo in agguato a fine finestra.
Agenti di navigazione e ricerca
BrowseComp 91,2 è il punteggio più alto della tabella di lancio di Moonshot, davanti a GPT 5.6 Sol e Claude Fable 5. La ricerca web a più salti — trovare la fonte, seguire la citazione, far quadrare i numeri — è dove l'addestramento agentico di K3 si vede di più.
Input di screenshot e video
K3 accetta immagini e video in modo nativo: gli agenti di QA che leggono screenshot e le pipeline che elaborano clip registrate non hanno bisogno di un modello di visione separato davanti al modello di ragionamento.
Quando evitare Kimi K3
Lascia perdere K3 quando serve un profilo di sicurezza verificato dal fornitore o un supporto enterprise contrattuale in USA o UE; quando i prompt sono così brevi che la tariffa cache da $0.30 non entra mai in gioco e basta un modello economico; e quando l'obiettivo è il self-hosting: 594 GB di pesi MXFP4 richiedono 64 o più acceleratori in produzione. Test indipendenti hanno inoltre misurato tassi di allucinazione ben oltre la cifra pubblicata da Moonshot, quindi gli output ricchi di fatti vanno comunque verificati. E su Okou, K3 non è proprio un'opzione.
Kimi K3 vs altri modelli
Kimi K3 vs Claude Fable 5
Fable 5 è avanti sull'Intelligence Index (59,9 contro 57,1) e su FrontierSWE (86,6 contro 81,2); K3 si prende Terminal-Bench 2.1, BrowseComp e SWE Marathon. Entrambi hanno una finestra da 1M di token. A decidere sono di solito prezzo e disponibilità: Fable 5 costa $10/$50 per milione di token e gira su Okou, K3 costa $3/$15 e non ci gira.
Kimi K3 vs GPT 5.6 Sol
Sol segna 58,9 sull'Intelligence Index contro i 57,1 di K3 e vince DeepSWE (73,0 contro 67,5) e Terminal-Bench per mezzo punto. K3 risponde con 1M di finestra contro i 400K di Sol e un terzo del prezzo in input. Il costo misurato per attività è vicino: $0.94 per K3, $1.04 per Sol.
Kimi K3 vs Claude Opus 4.8
K3 è avanti a Opus 4.8 sulla maggior parte delle suite agentiche e sull'Elo GDPval-AA (1668 contro 1600), a $3/$15 contro $5/$25. Opus 4.8 mantiene il vantaggio sull'affidabilità del routing degli strumenti in produzione ed è disponibile su Okou, dove K3 non lo è.
Kimi K3 vs Kimi K2.7 Code
K3 è il successore: 1M di token di contesto contro 256K, input video nativo e un tetto molto più alto sui benchmark agentici, a circa il triplo del prezzo ($3/$15 contro $1.14/$4.80). Oggi nessuno dei due gira su Okou: K2.7 Code è stato ritirato e K3 non è mai stato aggiunto.
In sintesi: dovresti usare Kimi K3?
Il modello a pesi aperti più forte pubblicato finora e il primo davvero competitivo con la frontiera chiusa sul lavoro di agente, a un terzo del prezzo di Fable 5. Okou non lo esegue, quindi leggi questa pagina come riferimento: per gli stessi carichi agentici da 1M di token su Okou, Claude Fable 5 è la scelta più simile.
Domande frequenti
Posso usare Kimi K3 su Okou?
Oggi no. Kimi K3 non fa parte della gamma di modelli Okou: non può essere selezionato in chat né in un workflow, e non può essere aggiunto con la tua chiave API. Claude Fable 5 è il modello più vicino che Okou esegue: stessa finestra di contesto da 1M di token e punteggio più alto sullo stesso Intelligence Index.
Quando è stato rilasciato Kimi K3?
Moonshot AI ha lanciato Kimi K3 il 16 luglio 2026 nell'app Kimi e nell'API Kimi, e ha pubblicato i pesi aperti su Hugging Face il 27 luglio 2026.
Qual è la finestra di contesto di Kimi K3?
1.048.576 token, input e output insieme, con prezzo uniforme su tutta la finestra. L'output è di 131.072 token di default e può essere configurato più alto nel contesto rimanente.
Quanto costa Kimi K3?
$3.00 per milione di token in input senza cache hit, $0.30 per milione con cache hit e $15.00 per milione di token in output, senza sovrapprezzo per contesti lunghi. Nell'app Kimi i piani a pagamento partono da $19 al mese con finestra da 256K, e la finestra completa da 1M si sblocca da $39 al mese.
Kimi K3 è open source?
I pesi sono aperti sotto la Kimi K3 License di Moonshot, che ricalca una MIT con due condizioni commerciali: un'attività di model-as-a-service deve firmare un accordo separato con Moonshot quando i ricavi superano i $20M in 12 mesi consecutivi, e ogni prodotto con più di 100 milioni di utenti attivi mensili o $20M di ricavi mensili deve mostrare "Kimi K3" nella propria interfaccia.
Alternative
Disponibilità di Kimi K3 su Okou
Kimi K3 non fa parte della gamma di modelli Okou: non può essere selezionato né in chat né in un workflow, e non può essere aggiunto con la tua chiave API. Claude Fable 5 è il modello più vicino che Okou esegue oggi.