Die Arena · KI-Modell im Test

Kimi K3

von Moonshot AI

Moonshots MoE-Modell mit 2,8 Billionen Parametern, das den 'neuen DeepSeek-Moment' auslöste: frontiernahe Werte für $3/$15

Arena-Score 3.7/557% empfehlen es · 3 Stimmen
Reasoning4.5
Coding4.5
Schreiben4.0
Tempo2.0
Preis-Leistung3.5
Kimi K3 besuchenFrontier-Coding und Agenten auf Niveau außerhalb von US-CloudsFrontend-Generierung (Spitzenplatz im Arena.ai-Ranking)Automatisierung von SaaS-Workflows und Tool-OrchestrierungTeams, die den Eigenbetrieb offener Gewichte der 3-Billionen-Parameter-Klasse planen
Preis

$15/1M out

Offizieller Moonshot-API-Listenpreis für kimi-k3: $3/1M Eingabe (Cache-Miss), $0,30/1M bei Cache-Treffer, $15/1M Ausgabe inklusive Reasoning-Trace, flach über das gesamte 1M-Kontextfenster (keine Längenstufen). Gleicher Preis $3/$15 auf OpenRouter (dort keine gesonderte Cache-Preisgabe). Ein Anstieg um das Dreifache gegenüber $0,95/$4 bei Kimi K2.6. Geprüft anhand von platform.kimi.ai/docs/pricing/chat-k3, Stand Juli 2026.

Anbieter

Moonshot AI

Kontextfenster

1M tokens

Input-Preis

$3/1M in

Output-Preis

$15/1M out

Modalitäten

text, vision, video input

Open Weights

Nein

Was ist Kimi K3?

Veröffentlicht am 16.07.2026 vom in Peking ansässigen Unternehmen Moonshot AI und vorgestellt auf der World AI Conference in Shanghai. Kimi K3 ist ein Mixture-of-Experts-Modell mit 2,8 Billionen Parametern (896 Experten, 16 davon pro Token aktiv), einem Kontextfenster von 1M Tokens und nativer Eingabe von Text, Bild und Video. API-ID kimi-k3 zu $3/1M Eingabe ($0,30 bei Cache-Treffer) und $15/1M Ausgabe, flach über das gesamte Kontextfenster, auch über OpenRouter verfügbar. Beim Launch erreichte es Platz 3 im Artificial Analysis Intelligence Index, vergleichbar mit Claude Opus 4.8 und GPT-5.5, was Schlagzeilen über einen 'neuen DeepSeek-Moment' und einen Ausverkauf im Halbleitersektor auslöste. Offene Gewichte (rund 594 GB, MXFP4) wurden für den 27.07.2026 angekündigt; zum Zeitpunkt dieser Fiche noch nicht veröffentlicht, eine Lizenz nach Modified-MIT-Vorbild wird erwartet, ist aber unbestätigt.

Kimi K3: Vor- und Nachteile

Vorteile

  • Beim Launch Platz 3 im Artificial Analysis Intelligence Index (57), vergleichbar mit Claude Opus 4.8 und GPT-5.5: das bislang engste Heranreichen eines chinesischen Labors an die geschlossene US-Frontier
  • 93,4 % auf SWE-bench Verified im unabhängigen Testrahmen von Vals AI (GPT-5.6 Sol: 96,2 %, Claude Fable 5: 95,0 %) und Platz 1 auf der Frontend Code Arena von Arena.ai mit 1679 Punkten, vor Fable 5
  • 93,5 % auf GPQA Diamond (zwischen Fable 5 mit 92,6 % und GPT-5.6 mit 94,1 %), 96,1 % auf AIME 2025 und Elo 1668 auf GDPval-AA v2 für agentische Arbeit, nur hinter Fable 5
  • Starkes agentisches Profil: Platz 1 bei den SaaS-Workflows von AutomationBench-AA (53 %), Long-Horizon-Terminal- und Repo-Navigation über Kimi Code sowie rund 21 % weniger Ausgabe-Tokens als K2 bei höherer Intelligenz
  • $3/$15 pro 1M Tokens (Eingabe sinkt auf $0,30 bei Cache-Treffer), flach über das gesamte 1M-Kontextfenster: weiterhin deutlich unter den Preisen der geschlossenen US-Frontier, mit einer OpenAI-kompatiblen API und Verfügbarkeit auf OpenRouter
  • Native multimodale Eingabe (Text, Bild, Video) und offene Gewichte für den 27.07.2026 angekündigt, voraussichtlich unter einer Lizenz nach Modified-MIT-Vorbild, was es zum ersten Frontier-Modell der 3-Billionen-Parameter-Klasse mit offenen Gewichten macht

Nachteile

  • Preissprung um das Dreifache gegenüber Kimi K2.6 ($0,95/$4 auf $3/$15), damit das teuerste je veröffentlichte chinesische Modell, auf Listenpreisniveau von Claude Sonnet 5: die Ära '10-mal günstiger als US-Modelle' ist vorbei (Simon Willison dokumentierte den Anstieg)
  • Langsam: 33 Ausgabe-Tokens/s, Platz 145 von 190 Modellen bei Artificial Analysis, schlecht geeignet für interaktive Nutzung
  • Halluzinationsrate stieg von 39 % (K2.6) auf 51 % bei AA-Omniscience, da das Modell nun Antworten versucht, die es zuvor verweigert hätte (Fable 5 liegt mit 54,9 % in vergleichbarem Bereich)
  • Politische Zensur bei heiklen Themen auf Mandarin (weicht bei Xi, KP Chinas, Tiananmen aus) und Datenverarbeitung der API unter Pekinger Jurisdiktion, ein Compliance-Hindernis für viele EU- und Unternehmenseinsätze; auch UK AISI/CAISI stellte fest, dass die Cyber-Schutzmechanismen Versuche zur Exploit-Entwicklung im Test nicht blockierten
  • 'Offene Gewichte' bleiben für die meisten theoretisch: rund 594 GB im nativen MXFP4-Format erfordern ein Multi-GPU-Rechenzentrum für den Eigenbetrieb, und die Gewichte (samt endgültiger Lizenz) waren zum Zeitpunkt der Bewertung noch nicht veröffentlicht

Das Urteil der Arena

Kimi K3 ist bislang das stärkste Argument dafür, dass die Frontier nicht mehr ausschließlich amerikanisch ist: Platz 3 bei Artificial Analysis, Spitzenwerte bei GPQA und SWE-bench Verified und das beste Frontend-Code-Arena-Ranking der Branche, zu etwa der Hälfte bis einem Drittel der Preise der geschlossenen US-Frontier. Geeignet für agentisches Coding, Frontend-Arbeit und SaaS-Automatisierung, wo die Benchmarks am stärksten sind, oder wenn die Roadmap den Eigenbetrieb eines Frontier-Modells vorsieht, sobald die Gewichte verfügbar sind. Nicht geeignet für interaktive Produkte (33 Tokens/s sind langsam), für alles mit politisch heiklen Inhalten oder strengen EU-Anforderungen an die Datenresidenz (Zensur auf Mandarin, Pekinger Jurisdiktion) sowie für hochpräzise Suche, wo die Halluzinationsrate von 51 % bei AA-Omniscience eine Verifizierungsebene erfordert. Kostenbewusste Teams sollten beachten, dass DeepSeek V4 weiterhin deutlich mehr Tokens pro Dollar liefert; K3 punktet mit maximaler Fähigkeit pro Dollar, nicht mit den günstigsten Tokens.

Daumen hoch oder Daumen runter

Fällen Sie Ihr Urteil

Würden Sie Kimi K3 empfehlen oder die Menge davor warnen?

57%Crowd-Score · 3

Top-Alternativen zu Kimi K3

Alle Alternativen
1
Claude Haiku 4.5

Anthropics schnellstes Modell: etwa 90% der Coding-Stärke von Sonnet 4.5 für $1/$5 pro 1M Tokens, 200K Kontext.

$5/1M out67%(2)
Visit
2
Claude Opus 5

Anthropics Opus-Auffrischung vom Juli 2026: nahezu die Intelligenz von Fable 5 zum halben Preis, weiterhin $5/$25 wie bei Opus 4.8

$25/1M out63%(4)
Visit
3
Claude Fable 5

Anthropics Mythos-Klasse-Flaggschiff vom Juni 2026: 80.3% auf SWE-bench Pro, 11 Punkte vor jedem anderen Frontier-Modell

$50/1M out63%(4)
Visit

Kimi K3 im direkten Vergleich

Was die Menge sagt

Käpt'n Churn

Tried it for our knowledge-base assistant and the hallucination rate is real: it confidently invented two API endpoints in one afternoon. 33 tokens per second on top of that. Back to waiting for the open weights to fine-tune.

Goldener Daumicus

Our Zapier-style automation stack runs on it now. Tool orchestration that GPT-5.5 fumbled works reliably, and the cache-hit pricing makes repeated workflows genuinely cheap.

Sankt Deployus

The Frontend Arena ranking is deserved. Gave it the same dashboard spec I gave Fable 5 and K3's React came out cleaner, with fewer invented props. At $3/$15 through OpenRouter it was a drop-in swap.

Kimi K3: häufige Fragen

Was kostet Kimi K3 pro 1M Tokens?

Kimi K3 kostet $3/1M in pro 1M Input-Tokens und $15/1M out pro 1M Output-Tokens. Offizieller Moonshot-API-Listenpreis für kimi-k3: $3/1M Eingabe (Cache-Miss), $0,30/1M bei Cache-Treffer, $15/1M Ausgabe inklusive Reasoning-Trace, flach über das gesamte 1M-Kontextfenster (keine Längenstufen). Gleicher Preis $3/$15 auf OpenRouter (dort keine gesonderte Cache-Preisgabe). Ein Anstieg um das Dreifache gegenüber $0,95/$4 bei Kimi K2.6. Geprüft anhand von platform.kimi.ai/docs/pricing/chat-k3, Stand Juli 2026.