L'arena · recensione di modello IA

Kimi K3

di Moonshot AI

Il modello MoE di Moonshot da 2.800 miliardi di parametri che ha scatenato il 'nuovo momento DeepSeek': punteggi da frontiera a $3/$15

Punteggio dell'arena 3.7/557% lo consiglia · 3 voti
Ragionamento4.5
Coding4.5
Scrittura4.0
Velocità2.0
Rapporto qualità-prezzo3.5
Visita Kimi K3coding di livello frontiera e agenti al di fuori dei cloud statunitensigenerazione frontend (in cima alla classifica di Arena.ai)automazione dei flussi di lavoro SaaS e orchestrazione di strumentiteam che pianificano l'auto-hosting di pesi aperti di classe 3T
Prezzo

$15/1M out

Prezzo di listino ufficiale dell'API Moonshot per kimi-k3: $3/1M in input (cache miss), $0,30/1M in caso di cache hit, $15/1M in output, inclusa la traccia di reasoning, tariffa piatta sull'intera finestra di contesto da 1M (nessun livello per lunghezza). Stesso prezzo $3/$15 su OpenRouter (dove non è esposto un prezzo differenziato per la cache). Un aumento di tre volte rispetto a $0,95/$4 di Kimi K2.6. Verificato su platform.kimi.ai/docs/pricing/chat-k3, luglio 2026.

Fornitore

Moonshot AI

Finestra di contesto

1M tokens

Prezzo in input

$3/1M in

Prezzo in output

$15/1M out

Modalità

text, vision, video input

Open weights

No

Che cos'è Kimi K3?

Rilasciato il 16/07/2026 da Moonshot AI, con sede a Pechino, e presentato alla World AI Conference di Shanghai. Kimi K3 è un modello Mixture-of-Experts da 2.800 miliardi di parametri (896 esperti, 16 attivi per token) con una finestra di contesto da 1M di token e input nativo di testo, immagini e video. ID API kimi-k3 a $3/1M in input ($0,30 in caso di cache hit) e $15/1M in output, tariffa piatta sull'intera finestra di contesto, disponibile anche su OpenRouter. Al lancio ha raggiunto il terzo posto nell'Artificial Analysis Intelligence Index, paragonabile a Claude Opus 4.8 e GPT-5.5, scatenando titoli sul 'nuovo momento DeepSeek' e un sell-off nel settore dei semiconduttori. I pesi aperti (circa 594 GB, MXFP4) sono stati annunciati per il 27/07/2026; non ancora pubblicati al momento di questa scheda, con una licenza in stile Modified-MIT attesa ma non confermata.

Kimi K3: pro e contro

Pro

  • Al lancio terzo posto nell'Artificial Analysis Intelligence Index (57), paragonabile a Claude Opus 4.8 e GPT-5.5: il risultato più vicino mai raggiunto da un laboratorio cinese alla frontiera chiusa statunitense
  • 93,4% su SWE-bench Verified nel banco di prova indipendente di Vals AI (GPT-5.6 Sol: 96,2%, Claude Fable 5: 95,0%) e primo posto nella Frontend Code Arena di Arena.ai con 1679 punti, davanti a Fable 5
  • 93,5% su GPQA Diamond (tra il 92,6% di Fable 5 e il 94,1% di GPT-5.6), 96,1% su AIME 2025 ed Elo 1668 su GDPval-AA v2 per il lavoro agentico, secondo solo a Fable 5
  • Profilo agentico solido: primo posto nei flussi di lavoro SaaS di AutomationBench-AA (53%), navigazione a lungo raggio di terminale e repository tramite Kimi Code, e circa il 21% in meno di token di output rispetto a K2 a parità di maggiore intelligenza
  • $3/$15 per 1M di token (l'input scende a $0,30 in caso di cache hit), tariffa piatta sull'intera finestra di contesto da 1M: comunque ben al di sotto dei prezzi della frontiera chiusa statunitense, con API compatibile OpenAI e disponibilità su OpenRouter
  • Input multimodale nativo (testo, immagini, video) e pesi aperti annunciati per il 27/07/2026 con una licenza attesa in stile Modified-MIT, posizionandolo come il primo modello di frontiera a pesi aperti della classe 3T

Contro

  • Aumento di prezzo di tre volte rispetto a Kimi K2.6 ($0,95/$4 contro $3/$15), il che lo rende il modello cinese più costoso mai lanciato, al livello di prezzo di listino di Claude Sonnet 5: l'era del '10 volte più economico dei modelli statunitensi' è finita (Simon Willison ha documentato l'aumento)
  • Lento: 33 token di output al secondo, al 145esimo posto su 190 modelli su Artificial Analysis, poco adatto all'uso interattivo
  • Il tasso di allucinazione è salito dal 39% (K2.6) al 51% su AA-Omniscience, poiché il modello ora tenta risposte che prima avrebbe rifiutato (Fable 5 si attesta su un valore comparabile del 54,9%)
  • Censura politica su argomenti sensibili in mandarino (elude domande su Xi, PCC, Tiananmen) e giurisdizione di Pechino sui dati dell'API, un ostacolo di conformità per molte implementazioni in UE e in ambito enterprise; anche UK AISI/CAISI ha rilevato che le protezioni informatiche non hanno bloccato tentativi di sviluppo di exploit durante i test
  • I 'pesi aperti' restano teorici per la maggior parte degli utenti: circa 594 GB in formato nativo MXFP4 richiedono un data center multi-GPU per l'auto-hosting, e i pesi (insieme alla licenza definitiva) non erano ancora stati pubblicati al momento della recensione

Il verdetto dell'arena

Kimi K3 è l'argomento più forte finora a favore dell'idea che la frontiera non sia più esclusivamente americana: terzo posto su Artificial Analysis, punteggi di alto livello su GPQA e SWE-bench Verified, e il miglior piazzamento nella classifica frontend-code del settore, a circa metà o un terzo dei prezzi della frontiera chiusa statunitense. Da scegliere per il coding agentico, il lavoro frontend e l'automazione SaaS, dove i suoi benchmark sono più forti, oppure se la roadmap prevede l'auto-hosting di un modello di livello frontiera una volta disponibili i pesi. Da evitare per i prodotti interattivi (33 token al secondo sono pochi), per tutto ciò che tocca contenuti politicamente sensibili o requisiti rigorosi di residenza dei dati nell'UE (censura in lingua mandarina, giurisdizione di Pechino), e per il retrieval ad alta precisione, dove il tasso di allucinazione del 51% su AA-Omniscience richiede un livello di verifica. I team attenti ai costi dovrebbero notare che DeepSeek V4 offre ancora molti più token per dollaro; il punto di forza di K3 è la massima capacità per dollaro, non i token più economici.

Pollice su o pollice verso

Emetti il tuo verdetto

Consiglieresti Kimi K3, o metteresti in guardia la folla?

57%punteggio della folla · 3

Migliori alternative a Kimi K3

Tutte le alternative
1
Claude Haiku 4.5

Il modello più veloce di Anthropic: circa il 90% delle capacità di coding di Sonnet 4.5 a $1/$5 per 1M di tokens, contesto 200K.

$5/1M out67%(2)
Visit
2
Claude Opus 5

L'aggiornamento di Opus firmato Anthropic di luglio 2026: intelligenza quasi al livello di Fable 5 a metà prezzo, sempre $5/$25 come Opus 4.8

$25/1M out63%(4)
Visit
3
Claude Fable 5

Il flagship di classe Mythos di Anthropic di giugno 2026: 80.3% su SWE-bench Pro, 11 punti sopra ogni altro modello di frontiera

$50/1M out63%(4)
Visit

Confronta Kimi K3 testa a testa

Cosa dice la folla

Capitan Churn

Tried it for our knowledge-base assistant and the hallucination rate is real: it confidently invented two API endpoints in one afternoon. 33 tokens per second on top of that. Back to waiting for the open weights to fine-tune.

Pollice d'Oro Maximus

Our Zapier-style automation stack runs on it now. Tool orchestration that GPT-5.5 fumbled works reliably, and the cache-hit pricing makes repeated workflows genuinely cheap.

San Deployus

The Frontend Arena ranking is deserved. Gave it the same dashboard spec I gave Fable 5 and K3's React came out cleaner, with fewer invented props. At $3/$15 through OpenRouter it was a drop-in swap.

Kimi K3: domande frequenti

Quanto costa Kimi K3 per 1M di token?

Kimi K3 costa $3/1M in per 1M di token in input e $15/1M out per 1M di token in output. Prezzo di listino ufficiale dell'API Moonshot per kimi-k3: $3/1M in input (cache miss), $0,30/1M in caso di cache hit, $15/1M in output, inclusa la traccia di reasoning, tariffa piatta sull'intera finestra di contesto da 1M (nessun livello per lunghezza). Stesso prezzo $3/$15 su OpenRouter (dove non è esposto un prezzo differenziato per la cache). Un aumento di tre volte rispetto a $0,95/$4 di Kimi K2.6. Verificato su platform.kimi.ai/docs/pricing/chat-k3, luglio 2026.