A arena · análise de modelo de IA

Kimi K3

por Moonshot AI

O modelo MoE de 2,8 trilhões de parâmetros da Moonshot que provocou o “novo momento DeepSeek”: pontuações próximas da fronteira a $3/$15

Pontuação da arena 3.7/557% recomendam · 3 votos
Raciocínio4.5
Programação4.5
Escrita4.0
Velocidade2.0
Custo-benefício3.5
Visitar Kimi K3codificação e agentes de nível fronteira fora das nuvens americanasgeração de frontend (no topo do ranking da Arena.ai)automação de fluxos de trabalho SaaS e orquestração de ferramentasequipes que planejam hospedar por conta própria pesos abertos da classe de 3 trilhões de parâmetros
Preço

$15/1M out

Preço oficial de tabela da API da Moonshot para kimi-k3: $3 por milhão de tokens de entrada (erro de cache), $0,30 por milhão em caso de acerto de cache, $15 por milhão de saída incluindo o rastro de raciocínio, preço fixo em toda a janela de 1M de tokens (sem níveis por tamanho). Mesmo preço de $3/$15 na OpenRouter (o preço de cache não é exibido lá). Um aumento de 3 vezes em relação aos $0,95/$4 do Kimi K2.6. Verificado em platform.kimi.ai/docs/pricing/chat-k3, em julho de 2026.

Provedor

Moonshot AI

Janela de contexto

1M tokens

Preço de entrada

$3/1M in

Preço de saída

$15/1M out

Modalidades

text, vision, video input

Open weights

Não

O que é o Kimi K3?

Lançado em 16/07/2026 pela Moonshot AI, sediada em Pequim, e revelado na World AI Conference em Xangai. O Kimi K3 é um modelo Mixture-of-Experts de 2,8 trilhões de parâmetros (896 especialistas, 16 ativos por token) com janela de contexto de 1M de tokens e entrada nativa de texto, imagem e vídeo. Com o ID de API kimi-k3, custa $3 por milhão de tokens de entrada ($0,30 em caso de acerto de cache) e $15 por milhão de saída, preço fixo em toda a janela de contexto, também disponível na OpenRouter. Alcançou o 3º lugar no Artificial Analysis Intelligence Index no lançamento, comparável à Claude Opus 4.8 e ao GPT-5.5, gerando manchetes sobre um “novo momento DeepSeek” e uma queda no setor de semicondutores. Pesos abertos (cerca de 594 GB, MXFP4) foram anunciados para 27/07/2026; ainda não publicados no momento desta ficha, sob uma licença esperada do tipo Modified-MIT, mas ainda não confirmada.

Kimi K3: prós e contras

Prós

  • 3º lugar no Artificial Analysis Intelligence Index (57) no lançamento, comparável à Claude Opus 4.8 e ao GPT-5.5: o laboratório chinês que mais se aproximou da fronteira fechada dos Estados Unidos
  • 93,4% no SWE-bench Verified no ambiente de teste independente da Vals AI (GPT-5.6 Sol: 96,2%, Claude Fable 5: 95,0%) e 1º lugar no Frontend Code Arena da Arena.ai, com 1679 pontos, à frente da Fable 5
  • 93,5% no GPQA Diamond (entre os 92,6% da Fable 5 e os 94,1% do GPT-5.6), 96,1% no AIME 2025, e Elo de 1668 no trabalho agêntico do GDPval-AA v2, atrás apenas da Fable 5
  • Perfil agêntico forte: 1º lugar nos fluxos de trabalho SaaS do AutomationBench-AA (53%), navegação autônoma de longo horizonte em terminal e repositório via Kimi Code, e cerca de 21% menos tokens de saída que o K2 para mais inteligência
  • $3/$15 por milhão de tokens (a entrada cai para $0,30 em caso de acerto de cache), preço fixo em toda a janela de 1M de tokens: ainda bem abaixo dos preços da fronteira fechada dos Estados Unidos, com API compatível com a OpenAI e disponibilidade na OpenRouter
  • Entrada multimodal nativa (texto, imagem, vídeo) e pesos abertos anunciados para 27/07/2026 sob uma licença esperada do tipo Modified-MIT, posicionando-o como o primeiro modelo de fronteira de pesos abertos da classe de 3 trilhões de parâmetros

Contras

  • Um salto de preço de 3 vezes em relação ao Kimi K2.6 ($0,95/$4 para $3/$15), tornando-o o modelo chinês mais caro já lançado, no preço de tabela do Claude Sonnet 5: a era do “10 vezes mais barato que os modelos americanos” acabou (alta documentada por Simon Willison)
  • Lento: 33 tokens de saída por segundo, na 145ª posição entre 190 modelos no Artificial Analysis, pouco adequado para uso interativo
  • A taxa de alucinação subiu de 39% (K2.6) para 51% no AA-Omniscience, já que o modelo agora tenta responder onde antes recusaria (a Fable 5 fica em um nível comparável de 54,9%)
  • Censura política em temas sensíveis em mandarim (evita responder sobre Xi, o PCC, Tiananmen) e jurisdição de Pequim para os dados da API, um obstáculo de conformidade para muitas implantações corporativas e da UE; o UK AISI/CAISI também constatou que suas salvaguardas de cibersegurança falharam em bloquear tentativas de desenvolvimento de exploits durante os testes
  • “Pesos abertos” que por ora são teóricos para a maioria: cerca de 594 GB em MXFP4 nativo, exigindo um datacenter multi-GPU para hospedagem própria, e os pesos (além da licença final) ainda não haviam sido publicados no momento desta análise

O veredicto da arena

O Kimi K3 é o argumento mais forte até agora de que a fronteira deixou de ser exclusivamente americana: 3º lugar no Artificial Analysis, pontuações de alto nível em GPQA e SWE-bench Verified, e o melhor ranking do setor na arena de código frontend, tudo a cerca de metade ou um terço dos preços da fronteira fechada dos Estados Unidos. Vale escolhê-lo para codificação agêntica, trabalho de frontend e automação SaaS, onde seus benchmarks são mais fortes, ou se o roadmap prevê hospedar por conta própria um modelo de classe fronteira assim que os pesos forem publicados. Vale evitá-lo em produtos interativos (33 tokens por segundo é lento), em qualquer coisa que envolva conteúdo politicamente sensível ou exigências rígidas de residência de dados na UE (censura em mandarim, jurisdição de Pequim), e em buscas de alta precisão, nas quais sua taxa de alucinação de 51% no AA-Omniscience exige uma camada de verificação. Equipes obcecadas por custo devem notar que o DeepSeek V4 ainda entrega muito mais tokens por dólar: a proposta do K3 é o pico de capacidade por dólar, não o token mais barato.

Polegar para cima ou para baixo

Dê seu veredicto

Você recomendaria o Kimi K3 ou avisaria a multidão para ficar longe?

57%pontuação da multidão · 3

Melhores alternativas ao Kimi K3

Todas as alternativas
1
Claude Haiku 4.5

O modelo mais rápido da Anthropic: cerca de 90% da habilidade de código do Sonnet 4.5 a $1/$5 por 1M de tokens, contexto de 200K.

$5/1M out67%(2)
Visit
2
Claude Opus 5

A atualização Opus de julho de 2026 da Anthropic: inteligência próxima da Fable 5 pela metade do preço, com o mesmo valor de $5/$25 da Opus 4.8.

$25/1M out63%(4)
Visit
3
Claude Fable 5

O carro-chefe da classe Mythos da Anthropic de junho de 2026: 80.3% no SWE-bench Pro, 11 pontos à frente de todos os outros modelos de fronteira

$50/1M out63%(4)
Visit

Compare o Kimi K3 frente a frente

O que a multidão diz

Capitão Churn

Tried it for our knowledge-base assistant and the hallucination rate is real: it confidently invented two API endpoints in one afternoon. 33 tokens per second on top of that. Back to waiting for the open weights to fine-tune.

Polegar Dourado

Our Zapier-style automation stack runs on it now. Tool orchestration that GPT-5.5 fumbled works reliably, and the cache-hit pricing makes repeated workflows genuinely cheap.

São Deployus

The Frontend Arena ranking is deserved. Gave it the same dashboard spec I gave Fable 5 and K3's React came out cleaner, with fewer invented props. At $3/$15 through OpenRouter it was a drop-in swap.

Kimi K3: perguntas frequentes

Quanto custa o Kimi K3 por 1M de tokens?

O Kimi K3 custa $3/1M in por 1M de tokens de entrada e $15/1M out por 1M de tokens de saída. Preço oficial de tabela da API da Moonshot para kimi-k3: $3 por milhão de tokens de entrada (erro de cache), $0,30 por milhão em caso de acerto de cache, $15 por milhão de saída incluindo o rastro de raciocínio, preço fixo em toda a janela de 1M de tokens (sem níveis por tamanho). Mesmo preço de $3/$15 na OpenRouter (o preço de cache não é exibido lá). Um aumento de 3 vezes em relação aos $0,95/$4 do Kimi K2.6. Verificado em platform.kimi.ai/docs/pricing/chat-k3, em julho de 2026.