Frente a frente

Logo de Kimi K3vsLogo de Claude Fable 5

Kimi K3 vs Claude Fable 5: qual modelo de IA vence em 2026?

Kimi K3 ($15/1M out) e Claude Fable 5 ($50/1M out) estão entre os modelos de IA mais usados de 2026. Em 7 votos da comunidade, Claude Fable 5 lidera com 63% de aprovação.

Veredicto rápido

Em Raciocínio, escolha Claude Fable 5: a arena o avalia em 5/5 contra 4.5/5 de Kimi K3. No orçamento, Kimi K3 vence: começa em $15/1M out contra $50/1M out de Claude Fable 5.

Comparação linha por linha

A partir de
$15/1M outPreço oficial de tabela da API da Moonshot para kimi-k3: $3 por milhão de tokens de entrada (erro de cache), $0,30 por milhão em caso de acerto de cache, $15 por milhão de saída incluindo o rastro de raciocínio, preço fixo em toda a janela de 1M de tokens (sem níveis por tamanho). Mesmo preço de $3/$15 na OpenRouter (o preço de cache não é exibido lá). Um aumento de 3 vezes em relação aos $0,95/$4 do Kimi K2.6. Verificado em platform.kimi.ai/docs/pricing/chat-k3, em julho de 2026.
$50/1M outPreço de tabela oficial da API da Anthropic para o claude-fable-5: $10/1M de entrada, $50/1M de saída, nível único com contexto de 1M por padrão (sem sobretaxa de contexto longo), saída máxima de 128K; requisições recusadas antes de qualquer saída não são cobradas. Verificado em platform.claude.com (Introducing Claude Fable 5) em 2026-07.
Provedor
Moonshot AI
Anthropic
Janela de contexto
1M tokens
1M tokens
Preço de entrada
$3/1M in
$10/1M in
Preço de saída
$15/1M out
$50/1M out
Modalidades
text, vision, video input
text, vision
Open weights
Não
Não
Pontuação da multidão
57%(3)
63%(4)
Notas da arena (1-5)
Raciocínio
4.5
5.0
Programação
4.5
5.0
Escrita
4.0
4.5
Velocidade
2.0
2.0
Custo-benefício
3.5
3.0

Pontos fortes e fracos

Kimi K3

  • 3º lugar no Artificial Analysis Intelligence Index (57) no lançamento, comparável à Claude Opus 4.8 e ao GPT-5.5: o laboratório chinês que mais se aproximou da fronteira fechada dos Estados Unidos
  • 93,4% no SWE-bench Verified no ambiente de teste independente da Vals AI (GPT-5.6 Sol: 96,2%, Claude Fable 5: 95,0%) e 1º lugar no Frontend Code Arena da Arena.ai, com 1679 pontos, à frente da Fable 5
  • 93,5% no GPQA Diamond (entre os 92,6% da Fable 5 e os 94,1% do GPT-5.6), 96,1% no AIME 2025, e Elo de 1668 no trabalho agêntico do GDPval-AA v2, atrás apenas da Fable 5
  • Perfil agêntico forte: 1º lugar nos fluxos de trabalho SaaS do AutomationBench-AA (53%), navegação autônoma de longo horizonte em terminal e repositório via Kimi Code, e cerca de 21% menos tokens de saída que o K2 para mais inteligência
  • $3/$15 por milhão de tokens (a entrada cai para $0,30 em caso de acerto de cache), preço fixo em toda a janela de 1M de tokens: ainda bem abaixo dos preços da fronteira fechada dos Estados Unidos, com API compatível com a OpenAI e disponibilidade na OpenRouter
  • Entrada multimodal nativa (texto, imagem, vídeo) e pesos abertos anunciados para 27/07/2026 sob uma licença esperada do tipo Modified-MIT, posicionando-o como o primeiro modelo de fronteira de pesos abertos da classe de 3 trilhões de parâmetros
  • Um salto de preço de 3 vezes em relação ao Kimi K2.6 ($0,95/$4 para $3/$15), tornando-o o modelo chinês mais caro já lançado, no preço de tabela do Claude Sonnet 5: a era do “10 vezes mais barato que os modelos americanos” acabou (alta documentada por Simon Willison)
  • Lento: 33 tokens de saída por segundo, na 145ª posição entre 190 modelos no Artificial Analysis, pouco adequado para uso interativo
  • A taxa de alucinação subiu de 39% (K2.6) para 51% no AA-Omniscience, já que o modelo agora tenta responder onde antes recusaria (a Fable 5 fica em um nível comparável de 54,9%)
  • Censura política em temas sensíveis em mandarim (evita responder sobre Xi, o PCC, Tiananmen) e jurisdição de Pequim para os dados da API, um obstáculo de conformidade para muitas implantações corporativas e da UE; o UK AISI/CAISI também constatou que suas salvaguardas de cibersegurança falharam em bloquear tentativas de desenvolvimento de exploits durante os testes
  • “Pesos abertos” que por ora são teóricos para a maioria: cerca de 594 GB em MXFP4 nativo, exigindo um datacenter multi-GPU para hospedagem própria, e os pesos (além da licença final) ainda não haviam sido publicados no momento desta análise

Claude Fable 5

  • 80.3% no SWE-bench Pro contra 69.2% do Opus 4.8, 58.6% do GPT-5.5 e 54.2% do Gemini 3.1 Pro, cerca de 11 pontos à frente do próximo modelo de fronteira
  • 95.0% no SWE-bench Verified (Opus 4.8: 88.6%, GPT-5.5: 82.6%) e 29.3% no split Diamond do FrontierCode da Cognition, mais que o dobro dos 13.4% do Opus 4.8
  • A autonomia de longo horizonte é a verdadeira história: a Stripe reportou uma migração de base de código Ruby de 50 milhões de linhas feita em um dia em vez de 2+ meses, e o CEO da Cursor o chama de estado da arte no CursorBench
  • Relatos de campo batem com os benchmarks: engenheiros no HN o descrevem trabalhando 'como um engenheiro de verdade' (CRDTs com supervisão mínima, escrevendo os próprios fuzzers, uma redução de alocação de 46x), Simon Willison mediu 'vários dias de trabalho' em uma única sessão
  • Janela de contexto de 1M de tokens por padrão mais 128K de saída, e visão estado da arte em documentos densos (29.8% no GDP.pdf contra 24.9% do GPT-5.5 e 22.5% do Opus 4.8)
  • Requisições recusadas antes de qualquer saída não são cobradas, e o fallback do lado do servidor para o Opus 4.8, com crédito de fallback, é nativo da API
  • O dobro do preço do Opus 4.8 ($10/$50 vs $5/$25) e lento: requisições únicas em tarefas difíceis rotineiramente levam muitos minutos, Simon Willison o chama sem rodeios de 'lento, caro'
  • Os classificadores de segurança de uso dual disparam em trabalho legítimo: um físico médico relatou problemas de dinâmica de fluidos e código de segmentação de MRI recusados como riscos de biossegurança, com requisições silenciosamente redirecionadas ao Opus 4.8 (a thread viral no HN se chamava 'If Claude Fable stops helping you, you'll never know'; a Anthropic fala em menos de 5% das sessões)
  • Lançamento turbulento: controles de exportação dos EUA forçaram a Anthropic a suspender o acesso mundialmente de 12 a 30 de junho de 2026, três dias após o lançamento, com restauração completa apenas em 1º de julho
  • Exige retenção de dados de 30 dias e não está disponível sob zero data retention, um bloqueio duro para organizações de compliance estrita; também sem modo thinking desligado, a cadeia de pensamento bruta nunca é retornada, e o prefill de assistente retorna 400
  • Não é universalmente estado da arte: o GPT-5.5 ainda lidera o ARC-AGI-2 (85.0% vs 77.1%), e a Andon Labs constatou que o Mythos 5 desbloqueado ficou abaixo do Opus 4.7 e do GPT-5.5 no Vending-Bench, com raciocínio que otimizava para detectabilidade em vez de dano real

Dê seu veredicto

Uma recomendação por ferramenta por gladiador. Ela redefine a pontuação da multidão que todos veem.

Kimi K3$15/1M out
57%pontuação da multidão · 3
Claude Fable 5$50/1M out
63%pontuação da multidão · 4

O veredicto da arena sobre o Kimi K3

O Kimi K3 é o argumento mais forte até agora de que a fronteira deixou de ser exclusivamente americana: 3º lugar no Artificial Analysis, pontuações de alto nível em GPQA e SWE-bench Verified, e o melhor ranking do setor na arena de código frontend, tudo a cerca de metade ou um terço dos preços da fronteira fechada dos Estados Unidos. Vale escolhê-lo para codificação agêntica, trabalho de frontend e automação SaaS, onde seus benchmarks são mais fortes, ou se o roadmap prevê hospedar por conta própria um modelo de classe fronteira assim que os pesos forem publicados. Vale evitá-lo em produtos interativos (33 tokens por segundo é lento), em qualquer coisa que envolva conteúdo politicamente sensível ou exigências rígidas de residência de dados na UE (censura em mandarim, jurisdição de Pequim), e em buscas de alta precisão, nas quais sua taxa de alucinação de 51% no AA-Omniscience exige uma camada de verificação. Equipes obcecadas por custo devem notar que o DeepSeek V4 ainda entrega muito mais tokens por dólar: a proposta do K3 é o pico de capacidade por dólar, não o token mais barato.

O veredicto da arena sobre o Claude Fable 5

Fique com o Claude Fable 5 se sua carga de trabalho é genuinamente de longo horizonte: execuções agênticas noturnas, migrações monstruosas, tarefas em que uma sessão de várias horas substitui dias de trabalho supervisionado. Aí o prêmio de 2x sobre o Opus 4.8 se paga em compressão de tarefas, e os benchmarks (80.3% no SWE-bench Pro, 11 pontos à frente do pelotão) são respaldados por deploys reais na Stripe e na Cursor. Para código interativo e trabalho do dia a dia, fique no Opus 4.8: 88.6% no SWE-bench Verified pela metade do preço, sem disparos indevidos de classificador, turnos mais rápidos. Equipes sensíveis a custo obtêm código quase nível Opus com o Sonnet 5 a $3/$15 (promocional $2/$10 até agosto de 2026). Evite o Fable 5 completamente se sua organização exige zero data retention ou se você trabalha perto de biologia, imagem médica ou ferramentas de segurança, onde os classificadores de uso dual ainda produzem falsos positivos e trocam silenciosamente para o Opus 4.8 no meio da sessão.

O que a multidão diz

Sobre o Kimi K3

Capitão Churn

Tried it for our knowledge-base assistant and the hallucination rate is real: it confidently invented two API endpoints in one afternoon. 33 tokens per second on top of that. Back to waiting for the open weights to fine-tune.

Polegar Dourado

Our Zapier-style automation stack runs on it now. Tool orchestration that GPT-5.5 fumbled works reliably, and the cache-hit pricing makes repeated workflows genuinely cheap.

São Deployus

The Frontend Arena ranking is deserved. Gave it the same dashboard spec I gave Fable 5 and K3's React came out cleaner, with fewer invented props. At $3/$15 through OpenRouter it was a drop-in swap.

Sobre o Claude Fable 5

Polegar Abaixus

I do medical imaging research and the bio classifier keeps flagging my MRI segmentation prompts, then it silently falls back to Opus 4.8 mid-session. At $50 per million output tokens I expect to at least know which model actually answered me.

Glorius Maximus

Yes it's 2x the price of Opus and yes the turns are slow. But one overnight Fable run replaced what used to be a week of supervising shorter runs. On a per-task basis it's actually the cheapest model we use.

Polegar Dourado

The 1M context is real, not marketing. I fed it our entire service mesh config plus six months of incident postmortems and it traced a flaky timeout to a retry policy nobody remembered writing. Opus 4.8 never connected those dots.

São Deployus

Gave it a monorepo migration that Opus 4.8 kept stalling on. It ran for about 40 minutes, came back with the whole thing done plus a test harness it wrote for itself. Felt like reviewing a senior engineer's PR, not babysitting a chatbot.

Perguntas frequentes

O Kimi K3 é melhor que o Claude Fable 5?

A multidão está atualmente com o Claude Fable 5: 63% o recomendam, contra 57% para o Kimi K3 (7 votos). Em Raciocínio, o Claude Fable 5 pontua mais alto (5/5 vs 4.5/5). A escolha certa depende do seu caso de uso. A comparação linha por linha nesta página detalha preços, especificações principais e notas da arena.

Qual é mais barato, Kimi K3 ou Claude Fable 5?

O Kimi K3 é mais barato: começa em $15/1M out, enquanto o Claude Fable 5 começa em $50/1M out.

Quanto custam Kimi K3 e Claude Fable 5 por 1M de tokens?

Kimi K3: $3/1M in por 1M de tokens de entrada, $15/1M out por 1M de tokens de saída. Claude Fable 5: $10/1M in por 1M de tokens de entrada, $50/1M out por 1M de tokens de saída.