Hall of Fame · Klasyfikacja tłumu na żywo

Ranking: Modele LLM

Każdy pretendent tej areny, szeregowany na żywo prawdziwymi werdyktami tłumu: polecam albo odradzam, jeden werdykt na osobę. Kolejność zmienia się z każdym głosem.

Zaktualizowano 21 lipca 2026

Wolisz wyselekcjonowaną krótką listę?Najlepsze modele LLM
  1. Claude Haiku 4.5

    Najszybszy model Anthropic: około 90% umiejętności kodowania Sonnet 4.5 za $1/$5 za 1M tokenów, 200K kontekstu.

    Rozumowanie3.0
    Kodowanie3.5
    Pisanie3.0
    Szybkość4.5
    Stosunek jakości do ceny4.0
    Cena$5/1M out
  2. 2
    Claude Fable 5

    Flagowiec Anthropic klasy Mythos z czerwca 2026: 80.3% na SWE-bench Pro, 11 punktów przewagi nad każdym innym modelem frontierowym

    Rozumowanie5.0
    Kodowanie5.0
    Pisanie4.5
    Szybkość2.0
    Stosunek jakości do ceny3.0
    Cena$50/1M out
  3. 3
    Claude Opus 4.7

    Opus Anthropic z kwietnia 2026: 87.6% SWE-bench Verified, 1M kontekstu, wizja wysokiej rozdzielczości, dziś za Opus 4.8

    Rozumowanie4.5
    Kodowanie4.5
    Pisanie4.5
    Szybkość2.5
    Stosunek jakości do ceny3.0
    Cena$25/1M out
  4. 4
    Claude Sonnet 5

    Najbardziej agentowy Sonnet od Anthropic: jakość bliska Opus 4.8 w kodowaniu i agentach za $3/$15 z kontekstem 1M

    Rozumowanie4.5
    Kodowanie4.5
    Pisanie4.5
    Szybkość4.0
    Stosunek jakości do ceny4.5
    Cena$15/1M out ($10 intro until 2026-08-31)
  5. 5
    Gemini 3 Pro

    Frontierowy model Google z listopada 2025: 1M kontekstu, pierwszy powyżej 1500 Elo na LMArena, zastąpiony przez Gemini 3.1 Pro.

    Rozumowanie4.5
    Kodowanie4.5
    Pisanie3.5
    Szybkość3.5
    Stosunek jakości do ceny4.0
    Cena$12/1M out (prompts ≤200K)
  6. 6
    DeepSeek-V4

    Otwarte wagi, 1.6T MoE z kontekstem 1M tokenów i niemal frontierowym kodowaniem agentowym za $0.87 za 1M tokenów wyjścia

    Rozumowanie4.5
    Kodowanie4.5
    Pisanie3.5
    Szybkość3.0
    Stosunek jakości do ceny5.0
    Cena$0.87/1M out
  7. 7
    Claude Opus 4.8

    Flagowy model klasy Opus od Anthropic do długoterminowego kodowania agentowego; 1M kontekstu za $5/$25 za 1M tokenów.

    Rozumowanie4.5
    Kodowanie5.0
    Pisanie5.0
    Szybkość3.0
    Stosunek jakości do ceny3.5
    Cena$25/1M out
  8. 8
    GPT-5.5

    Agentowy flagowiec OpenAI: 1M kontekstu, SOTA na ARC-AGI-2 i Terminal-Bench 2.0, $5/$30 za 1M tokenów.

    Rozumowanie5.0
    Kodowanie4.5
    Pisanie4.0
    Szybkość3.5
    Stosunek jakości do ceny3.0
    Cena$30/1M out
  9. 9
    Claude Opus 4.5

    Frontierowy koder Anthropic z listopada 2025: pierwszy powyżej 80% na SWE-bench Verified, wyceniony 66% taniej niż Opus 4.1

    Rozumowanie3.5
    Kodowanie3.5
    Pisanie3.5
    Szybkość2.5
    Stosunek jakości do ceny2.5
    Cena$25/1M out
  10. 10
    GPT-5.2

    Frontierowy model OpenAI z grudnia 2025: 400K kontekstu, 80% SWE-bench Verified, mocne rozumowanie, ale wolne wyjście.

    Rozumowanie4.0
    Kodowanie4.0
    Pisanie3.5
    Szybkość2.5
    Stosunek jakości do ceny3.5
    Cena$14/1M out
  11. 11
    Grok 4.3

    Frontierowy model xAI z kontekstem 1M za $1.25/$2.50 za 1M tokenów, dostrojony pod agentowe użycie narzędzi.

    Rozumowanie4.0
    Kodowanie3.5
    Pisanie4.5
    Szybkość3.5
    Stosunek jakości do ceny4.5
    Cena$2.50/1M out
  12. 12
    Claude Opus 4.6

    Opus Anthropic z lutego 2026: 1M kontekstu, adaptacyjne myślenie, 80.8% SWE-bench, dziś zastąpiony przez Opus 4.8.

    Rozumowanie4.0
    Kodowanie4.0
    Pisanie4.0
    Szybkość2.5
    Stosunek jakości do ceny3.0
    Cena$25/1M out
  13. 13
    Gemini 3.5 Flash

    Flagowiec Google w klasie szybkościowej: bije Gemini 3.1 Pro w kodowaniu agentowym za $1.50/$9, 3x drożej niż 3 Flash

    Rozumowanie3.5
    Kodowanie4.0
    Pisanie3.0
    Szybkość5.0
    Stosunek jakości do ceny4.5
    Cena$9.00/1M out
  14. 14
    Llama 4 (Scout / Maverick)

    Otwarty duet MoE od Mety: 17B aktywnych parametrów, natywne wejście obrazowe, 10M tokenów kontekstu na papierze

    Rozumowanie2.5
    Kodowanie2.0
    Pisanie2.5
    Szybkość4.5
    Stosunek jakości do ceny3.5
    Cena$0.60/1M out (Maverick, hosted)
  15. 15
    Mistral Large 3

    Otwarty flagowiec MoE 675B (41B aktywnych) z kontekstem 256K, wejściem obrazowym i ceną $0.50/$1.50 za 1M.

    Rozumowanie3.0
    Kodowanie3.0
    Pisanie4.0
    Szybkość3.5
    Stosunek jakości do ceny4.0
    Cena$1.50/1M out