Hall of Fame · Ranking ao vivo da multidão
O ranking de Modelos LLM
Cada concorrente desta arena, classificado ao vivo por veredictos reais da multidão: recomendar ou evitar, um veredicto por pessoa. A ordem muda a cada voto.
Atualizado em 21 de julho de 2026
- Claude Haiku 4.5Visitar
O modelo mais rápido da Anthropic: cerca de 90% da habilidade de código do Sonnet 4.5 a $1/$5 por 1M de tokens, contexto de 200K.
Raciocínio3.0Programação3.5Escrita3.0Velocidade4.5Custo-benefício4.0Preço$5/1M out - 2Claude Fable 5Visitar
O carro-chefe da classe Mythos da Anthropic de junho de 2026: 80.3% no SWE-bench Pro, 11 pontos à frente de todos os outros modelos de fronteira
Raciocínio5.0Programação5.0Escrita4.5Velocidade2.0Custo-benefício3.0Preço$50/1M out - 3Claude Opus 4.7Visitar
O Opus da Anthropic de abril de 2026: 87.6% no SWE-bench Verified, contexto de 1M, visão de alta resolução, hoje atrás do Opus 4.8
Raciocínio4.5Programação4.5Escrita4.5Velocidade2.5Custo-benefício3.0Preço$25/1M out - 4Claude Sonnet 5Visitar
O Sonnet mais agêntico da Anthropic: qualidade próxima do Opus 4.8 em código e agentes a $3/$15 com contexto de 1M
Raciocínio4.5Programação4.5Escrita4.5Velocidade4.0Custo-benefício4.5Preço$15/1M out ($10 intro until 2026-08-31) - 5Gemini 3 ProVisitar
O modelo de fronteira do Google de nov 2025: contexto de 1M, primeiro a passar de 1500 de Elo no LMArena, substituído pelo Gemini 3.1 Pro.
Raciocínio4.5Programação4.5Escrita3.5Velocidade3.5Custo-benefício4.0Preço$12/1M out (prompts ≤200K) - 6DeepSeek-V4Visitar
MoE de open weights de 1.6T com contexto de 1M de tokens e código agêntico quase de fronteira a $0.87 por 1M de tokens de saída
Raciocínio4.5Programação4.5Escrita3.5Velocidade3.0Custo-benefício5.0Preço$0.87/1M out - 7Claude Opus 4.8Visitar
O modelo carro-chefe da classe Opus da Anthropic para código agêntico de longo horizonte; contexto de 1M a $5/$25 por 1M de tokens.
Raciocínio4.5Programação5.0Escrita5.0Velocidade3.0Custo-benefício3.5Preço$25/1M out - 8GPT-5.5Visitar
O carro-chefe agêntico da OpenAI: contexto de 1M, SOTA no ARC-AGI-2 e no Terminal-Bench 2.0, $5/$30 por 1M de tokens.
Raciocínio5.0Programação4.5Escrita4.0Velocidade3.5Custo-benefício3.0Preço$30/1M out - 9Claude Opus 4.5Visitar
O coder de fronteira da Anthropic de nov 2025: primeiro a passar de 80% no SWE-bench Verified, com preço 66% abaixo do Opus 4.1
Raciocínio3.5Programação3.5Escrita3.5Velocidade2.5Custo-benefício2.5Preço$25/1M out - 10GPT-5.2Visitar
O modelo de fronteira da OpenAI de dez 2025: contexto de 400K, 80% no SWE-bench Verified, raciocínio forte mas saída lenta.
Raciocínio4.0Programação4.0Escrita3.5Velocidade2.5Custo-benefício3.5Preço$14/1M out - 11Grok 4.3Visitar
O modelo de fronteira da xAI com contexto de 1M a $1.25/$2.50 por 1M de tokens, ajustado para uso agêntico de ferramentas.
Raciocínio4.0Programação3.5Escrita4.5Velocidade3.5Custo-benefício4.5Preço$2.50/1M out - 12Claude Opus 4.6Visitar
O Opus da Anthropic de fev 2026: contexto de 1M, thinking adaptativo, 80.8% no SWE-bench, hoje superado pelo Opus 4.8.
Raciocínio4.0Programação4.0Escrita4.0Velocidade2.5Custo-benefício3.0Preço$25/1M out - 13Gemini 3.5 FlashVisitar
O carro-chefe da linha rápida do Google: supera o Gemini 3.1 Pro em código agêntico a $1.50/$9, 3x mais caro que o 3 Flash
Raciocínio3.5Programação4.0Escrita3.0Velocidade5.0Custo-benefício4.5Preço$9.00/1M out - 14Llama 4 (Scout / Maverick)Visitar
A dupla MoE de open weights da Meta: 17B de parâmetros ativos, entrada nativa de imagem, contexto de 10M de tokens no papel
Raciocínio2.5Programação2.0Escrita2.5Velocidade4.5Custo-benefício3.5Preço$0.60/1M out (Maverick, hosted) - 15Mistral Large 3Visitar
Carro-chefe MoE de open weights com 675B (41B ativos), contexto de 256K, entrada de visão e preço de $0.50/$1.50 por 1M.
Raciocínio3.0Programação3.0Escrita4.0Velocidade3.5Custo-benefício4.0Preço$1.50/1M out
Principais duelos
Comparações diretas entre os donos do pódio.