L'arène · test de modèle IA
Kimi K3
par Moonshot AI
Le MoE à 2,8 billions de paramètres de Moonshot qui a déclenché le « nouveau moment DeepSeek » : des scores proches de la frontière à 3 $/15 $
$15/1M out
Prix officiel de la liste API Moonshot pour kimi-k3 : 3 $ par million de tokens en entrée (cache miss), 0,30 $ par million en cas de cache hit, 15 $ par million en sortie trace de raisonnement incluse, tarif fixe sur toute la fenêtre de 1M de tokens (aucun palier selon la longueur). Même tarif de 3 $/15 $ sur OpenRouter (le tarif de cache n'y est pas indiqué). Une hausse de 3 fois par rapport aux 0,95 $/4 $ de Kimi K2.6. Vérifié sur platform.kimi.ai/docs/pricing/chat-k3 en juillet 2026.
Moonshot AI
1M tokens
$3/1M in
$15/1M out
text, vision, video input
Non
Qu'est-ce que Kimi K3 ?
Sorti le 16/07/2026 par Moonshot AI, basé à Pékin, et dévoilé lors de la World AI Conference à Shanghai. Kimi K3 est un modèle de type Mixture-of-Experts à 2,8 billions de paramètres (896 experts, 16 actifs par token) avec une fenêtre de contexte de 1M de tokens et une entrée native texte, image et vidéo. Sous l'identifiant API kimi-k3, il coûte 3 $ par million de tokens en entrée (0,30 $ en cas de cache hit) et 15 $ par million en sortie, un tarif fixe sur toute la fenêtre de contexte, également disponible sur OpenRouter. Il a atteint la 3e place de l'Artificial Analysis Intelligence Index au lancement, comparable à Claude Opus 4.8 et GPT-5.5, déclenchant des titres sur un « nouveau moment DeepSeek » et une chute des valeurs des semi-conducteurs. Des poids ouverts (environ 594 Go, MXFP4) ont été annoncés pour le 27/07/2026 ; non encore publiés au moment de la rédaction de cette fiche, sous une licence attendue de type Modified-MIT mais non confirmée.
Kimi K3 : points forts et points faibles
Points forts
- 3e place de l'Artificial Analysis Intelligence Index (57) au lancement, comparable à Claude Opus 4.8 et GPT-5.5 : le laboratoire chinois qui s'est le plus rapproché de la frontière fermée américaine
- 93,4 % sur SWE-bench Verified dans le harnais indépendant de Vals AI (GPT-5.6 Sol : 96,2 %, Claude Fable 5 : 95,0 %) et 1re place du Frontend Code Arena d'Arena.ai avec 1679 points, devant Fable 5
- 93,5 % sur GPQA Diamond (entre les 92,6 % de Fable 5 et les 94,1 % de GPT-5.6), 96,1 % sur AIME 2025, et un Elo de 1668 sur le travail agentique de GDPval-AA v2, juste derrière Fable 5
- Profil agentique solide : 1re place sur les workflows SaaS d'AutomationBench-AA (53 %), navigation autonome à long horizon dans un terminal et un dépôt via Kimi Code, et environ 21 % de tokens de sortie en moins que K2 pour plus d'intelligence
- 3 $/15 $ par million de tokens (l'entrée tombe à 0,30 $ en cas de cache hit), tarif fixe sur toute la fenêtre de 1M de tokens : encore bien en dessous des tarifs de la frontière fermée américaine, avec une API compatible OpenAI et une disponibilité sur OpenRouter
- Entrée multimodale native (texte, image, vidéo) et poids ouverts annoncés pour le 27/07/2026 sous une licence attendue de type Modified-MIT, ce qui en fait potentiellement le premier modèle de frontière à poids ouverts de classe 3 billions de paramètres
Points faibles
- Un bond de prix multiplié par 3 par rapport à Kimi K2.6 (de 0,95 $/4 $ à 3 $/15 $), ce qui en fait le modèle chinois le plus cher jamais lancé, au tarif de Claude Sonnet 5 : l'époque des modèles « 10 fois moins chers que les modèles américains » est révolue (hausse documentée par Simon Willison)
- Lent : 33 tokens de sortie par seconde, classé 145e sur 190 modèles sur Artificial Analysis, peu adapté aux usages interactifs
- Le taux d'hallucination est passé de 39 % (K2.6) à 51 % sur AA-Omniscience, le modèle tentant désormais de répondre là où il aurait refusé auparavant (Fable 5 se situe à un niveau comparable de 54,9 %)
- Censure politique sur les sujets sensibles en mandarin (élude les questions sur Xi, le PCC, Tiananmen) et juridiction de Pékin pour les données de l'API, un frein à la conformité pour de nombreux déploiements en entreprise et dans l'UE ; l'UK AISI/CAISI a également constaté que ses garde-fous en cybersécurité ne bloquaient pas les tentatives de développement d'exploits lors des tests
- Des « poids ouverts » théoriques pour la plupart des utilisateurs : environ 594 Go en MXFP4 natif nécessitant un datacenter multi-GPU pour un hébergement autonome, les poids (et la licence finale) n'étant toujours pas publiés au moment de la revue
Le verdict de l'arène
Kimi K3 est l'argument le plus solide à ce jour montrant que la frontière n'est plus exclusivement américaine : 3e place sur Artificial Analysis, des scores de haut niveau sur GPQA et SWE-bench Verified, et le meilleur classement du secteur sur l'arène de code frontend, le tout à environ la moitié voire le tiers des tarifs de la frontière fermée américaine. À privilégier pour le codage agentique, le travail frontend et l'automatisation SaaS, là où ses résultats sont les plus solides, ou si la feuille de route prévoit d'auto-héberger un modèle de classe frontière une fois les poids publiés. À éviter pour les produits interactifs (33 tokens par seconde, c'est lent), pour tout ce qui touche à des contenus politiquement sensibles ou à des exigences strictes de résidence des données dans l'UE (censure en langue mandarine, juridiction de Pékin), et pour la recherche d'information à haute précision, où son taux d'hallucination de 51 % sur AA-Omniscience impose une couche de vérification. Les équipes obsédées par le coût noteront que DeepSeek V4 offre toujours bien plus de tokens par dollar : l'argument de K3, c'est le pic de capacité par dollar, pas le token le moins cher.
Pouce levé ou pouce baissé
Rendez votre verdict
Recommanderiez-vous Kimi K3, ou mettriez-vous la foule en garde ?
Meilleures alternatives à Kimi K3
Toutes les alternativesLe modèle le plus rapide d'Anthropic : environ 90 % du niveau de codage de Sonnet 4.5 à $1/$5 par million de tokens, contexte 200K.
La mise à jour Opus de juillet 2026 signée Anthropic : une intelligence proche de Fable 5 pour moitié moins cher, au même tarif de 5 $/25 $ qu'Opus 4.8.
Le vaisseau amiral de classe Mythos d'Anthropic (juin 2026) : 80,3 % sur SWE-bench Pro, 11 points devant tous les autres modèles frontière
Comparez Kimi K3 en face-à-face
Ce qu'en dit la foule
“Tried it for our knowledge-base assistant and the hallucination rate is real: it confidently invented two API endpoints in one afternoon. 33 tokens per second on top of that. Back to waiting for the open weights to fine-tune.”
“Our Zapier-style automation stack runs on it now. Tool orchestration that GPT-5.5 fumbled works reliably, and the cache-hit pricing makes repeated workflows genuinely cheap.”
“The Frontend Arena ranking is deserved. Gave it the same dashboard spec I gave Fable 5 and K3's React came out cleaner, with fewer invented props. At $3/$15 through OpenRouter it was a drop-in swap.”
Kimi K3 : questions fréquentes
Combien coûte Kimi K3 par million de tokens ?
Kimi K3 coûte $3/1M in par million de tokens en entrée et $15/1M out par million de tokens en sortie. Prix officiel de la liste API Moonshot pour kimi-k3 : 3 $ par million de tokens en entrée (cache miss), 0,30 $ par million en cas de cache hit, 15 $ par million en sortie trace de raisonnement incluse, tarif fixe sur toute la fenêtre de 1M de tokens (aucun palier selon la longueur). Même tarif de 3 $/15 $ sur OpenRouter (le tarif de cache n'y est pas indiqué). Une hausse de 3 fois par rapport aux 0,95 $/4 $ de Kimi K2.6. Vérifié sur platform.kimi.ai/docs/pricing/chat-k3 en juillet 2026.