Hall of Fame · Ranking ao vivo da multidão

O ranking de Modelos LLM

Cada concorrente desta arena, classificado ao vivo por veredictos reais da multidão: recomendar ou evitar, um veredicto por pessoa. A ordem muda a cada voto.

Atualizado em 21 de julho de 2026

Prefere uma seleção curada?Melhores modelos LLM
  1. Claude Haiku 4.5

    O modelo mais rápido da Anthropic: cerca de 90% da habilidade de código do Sonnet 4.5 a $1/$5 por 1M de tokens, contexto de 200K.

    Raciocínio3.0
    Programação3.5
    Escrita3.0
    Velocidade4.5
    Custo-benefício4.0
    Preço$5/1M out
  2. 2
    Claude Fable 5

    O carro-chefe da classe Mythos da Anthropic de junho de 2026: 80.3% no SWE-bench Pro, 11 pontos à frente de todos os outros modelos de fronteira

    Raciocínio5.0
    Programação5.0
    Escrita4.5
    Velocidade2.0
    Custo-benefício3.0
    Preço$50/1M out
  3. 3
    Claude Opus 4.7

    O Opus da Anthropic de abril de 2026: 87.6% no SWE-bench Verified, contexto de 1M, visão de alta resolução, hoje atrás do Opus 4.8

    Raciocínio4.5
    Programação4.5
    Escrita4.5
    Velocidade2.5
    Custo-benefício3.0
    Preço$25/1M out
  4. 4
    Claude Sonnet 5

    O Sonnet mais agêntico da Anthropic: qualidade próxima do Opus 4.8 em código e agentes a $3/$15 com contexto de 1M

    Raciocínio4.5
    Programação4.5
    Escrita4.5
    Velocidade4.0
    Custo-benefício4.5
    Preço$15/1M out ($10 intro until 2026-08-31)
  5. 5
    Gemini 3 Pro

    O modelo de fronteira do Google de nov 2025: contexto de 1M, primeiro a passar de 1500 de Elo no LMArena, substituído pelo Gemini 3.1 Pro.

    Raciocínio4.5
    Programação4.5
    Escrita3.5
    Velocidade3.5
    Custo-benefício4.0
    Preço$12/1M out (prompts ≤200K)
  6. 6
    DeepSeek-V4

    MoE de open weights de 1.6T com contexto de 1M de tokens e código agêntico quase de fronteira a $0.87 por 1M de tokens de saída

    Raciocínio4.5
    Programação4.5
    Escrita3.5
    Velocidade3.0
    Custo-benefício5.0
    Preço$0.87/1M out
  7. 7
    Claude Opus 4.8

    O modelo carro-chefe da classe Opus da Anthropic para código agêntico de longo horizonte; contexto de 1M a $5/$25 por 1M de tokens.

    Raciocínio4.5
    Programação5.0
    Escrita5.0
    Velocidade3.0
    Custo-benefício3.5
    Preço$25/1M out
  8. 8
    GPT-5.5

    O carro-chefe agêntico da OpenAI: contexto de 1M, SOTA no ARC-AGI-2 e no Terminal-Bench 2.0, $5/$30 por 1M de tokens.

    Raciocínio5.0
    Programação4.5
    Escrita4.0
    Velocidade3.5
    Custo-benefício3.0
    Preço$30/1M out
  9. 9
    Claude Opus 4.5

    O coder de fronteira da Anthropic de nov 2025: primeiro a passar de 80% no SWE-bench Verified, com preço 66% abaixo do Opus 4.1

    Raciocínio3.5
    Programação3.5
    Escrita3.5
    Velocidade2.5
    Custo-benefício2.5
    Preço$25/1M out
  10. 10
    GPT-5.2

    O modelo de fronteira da OpenAI de dez 2025: contexto de 400K, 80% no SWE-bench Verified, raciocínio forte mas saída lenta.

    Raciocínio4.0
    Programação4.0
    Escrita3.5
    Velocidade2.5
    Custo-benefício3.5
    Preço$14/1M out
  11. 11
    Grok 4.3

    O modelo de fronteira da xAI com contexto de 1M a $1.25/$2.50 por 1M de tokens, ajustado para uso agêntico de ferramentas.

    Raciocínio4.0
    Programação3.5
    Escrita4.5
    Velocidade3.5
    Custo-benefício4.5
    Preço$2.50/1M out
  12. 12
    Claude Opus 4.6

    O Opus da Anthropic de fev 2026: contexto de 1M, thinking adaptativo, 80.8% no SWE-bench, hoje superado pelo Opus 4.8.

    Raciocínio4.0
    Programação4.0
    Escrita4.0
    Velocidade2.5
    Custo-benefício3.0
    Preço$25/1M out
  13. 13
    Gemini 3.5 Flash

    O carro-chefe da linha rápida do Google: supera o Gemini 3.1 Pro em código agêntico a $1.50/$9, 3x mais caro que o 3 Flash

    Raciocínio3.5
    Programação4.0
    Escrita3.0
    Velocidade5.0
    Custo-benefício4.5
    Preço$9.00/1M out
  14. 14
    Llama 4 (Scout / Maverick)

    A dupla MoE de open weights da Meta: 17B de parâmetros ativos, entrada nativa de imagem, contexto de 10M de tokens no papel

    Raciocínio2.5
    Programação2.0
    Escrita2.5
    Velocidade4.5
    Custo-benefício3.5
    Preço$0.60/1M out (Maverick, hosted)
  15. 15
    Mistral Large 3

    Carro-chefe MoE de open weights com 675B (41B ativos), contexto de 256K, entrada de visão e preço de $0.50/$1.50 por 1M.

    Raciocínio3.0
    Programação3.0
    Escrita4.0
    Velocidade3.5
    Custo-benefício4.0
    Preço$1.50/1M out