Hall of Fame · Klasyfikacja tłumu na żywo
Ranking: Modele LLM
Każdy pretendent tej areny, szeregowany na żywo prawdziwymi werdyktami tłumu: polecam albo odradzam, jeden werdykt na osobę. Kolejność zmienia się z każdym głosem.
Zaktualizowano 21 lipca 2026
- Claude Haiku 4.5Odwiedź
Najszybszy model Anthropic: około 90% umiejętności kodowania Sonnet 4.5 za $1/$5 za 1M tokenów, 200K kontekstu.
Rozumowanie3.0Kodowanie3.5Pisanie3.0Szybkość4.5Stosunek jakości do ceny4.0Cena$5/1M out - 2Claude Fable 5Odwiedź
Flagowiec Anthropic klasy Mythos z czerwca 2026: 80.3% na SWE-bench Pro, 11 punktów przewagi nad każdym innym modelem frontierowym
Rozumowanie5.0Kodowanie5.0Pisanie4.5Szybkość2.0Stosunek jakości do ceny3.0Cena$50/1M out - 3Claude Opus 4.7Odwiedź
Opus Anthropic z kwietnia 2026: 87.6% SWE-bench Verified, 1M kontekstu, wizja wysokiej rozdzielczości, dziś za Opus 4.8
Rozumowanie4.5Kodowanie4.5Pisanie4.5Szybkość2.5Stosunek jakości do ceny3.0Cena$25/1M out - 4Claude Sonnet 5Odwiedź
Najbardziej agentowy Sonnet od Anthropic: jakość bliska Opus 4.8 w kodowaniu i agentach za $3/$15 z kontekstem 1M
Rozumowanie4.5Kodowanie4.5Pisanie4.5Szybkość4.0Stosunek jakości do ceny4.5Cena$15/1M out ($10 intro until 2026-08-31) - 5Gemini 3 ProOdwiedź
Frontierowy model Google z listopada 2025: 1M kontekstu, pierwszy powyżej 1500 Elo na LMArena, zastąpiony przez Gemini 3.1 Pro.
Rozumowanie4.5Kodowanie4.5Pisanie3.5Szybkość3.5Stosunek jakości do ceny4.0Cena$12/1M out (prompts ≤200K) - 6DeepSeek-V4Odwiedź
Otwarte wagi, 1.6T MoE z kontekstem 1M tokenów i niemal frontierowym kodowaniem agentowym za $0.87 za 1M tokenów wyjścia
Rozumowanie4.5Kodowanie4.5Pisanie3.5Szybkość3.0Stosunek jakości do ceny5.0Cena$0.87/1M out - 7Claude Opus 4.8Odwiedź
Flagowy model klasy Opus od Anthropic do długoterminowego kodowania agentowego; 1M kontekstu za $5/$25 za 1M tokenów.
Rozumowanie4.5Kodowanie5.0Pisanie5.0Szybkość3.0Stosunek jakości do ceny3.5Cena$25/1M out - 8GPT-5.5Odwiedź
Agentowy flagowiec OpenAI: 1M kontekstu, SOTA na ARC-AGI-2 i Terminal-Bench 2.0, $5/$30 za 1M tokenów.
Rozumowanie5.0Kodowanie4.5Pisanie4.0Szybkość3.5Stosunek jakości do ceny3.0Cena$30/1M out - 9Claude Opus 4.5Odwiedź
Frontierowy koder Anthropic z listopada 2025: pierwszy powyżej 80% na SWE-bench Verified, wyceniony 66% taniej niż Opus 4.1
Rozumowanie3.5Kodowanie3.5Pisanie3.5Szybkość2.5Stosunek jakości do ceny2.5Cena$25/1M out - 10GPT-5.2Odwiedź
Frontierowy model OpenAI z grudnia 2025: 400K kontekstu, 80% SWE-bench Verified, mocne rozumowanie, ale wolne wyjście.
Rozumowanie4.0Kodowanie4.0Pisanie3.5Szybkość2.5Stosunek jakości do ceny3.5Cena$14/1M out - 11Grok 4.3Odwiedź
Frontierowy model xAI z kontekstem 1M za $1.25/$2.50 za 1M tokenów, dostrojony pod agentowe użycie narzędzi.
Rozumowanie4.0Kodowanie3.5Pisanie4.5Szybkość3.5Stosunek jakości do ceny4.5Cena$2.50/1M out - 12Claude Opus 4.6Odwiedź
Opus Anthropic z lutego 2026: 1M kontekstu, adaptacyjne myślenie, 80.8% SWE-bench, dziś zastąpiony przez Opus 4.8.
Rozumowanie4.0Kodowanie4.0Pisanie4.0Szybkość2.5Stosunek jakości do ceny3.0Cena$25/1M out - 13Gemini 3.5 FlashOdwiedź
Flagowiec Google w klasie szybkościowej: bije Gemini 3.1 Pro w kodowaniu agentowym za $1.50/$9, 3x drożej niż 3 Flash
Rozumowanie3.5Kodowanie4.0Pisanie3.0Szybkość5.0Stosunek jakości do ceny4.5Cena$9.00/1M out - 14Llama 4 (Scout / Maverick)Odwiedź
Otwarty duet MoE od Mety: 17B aktywnych parametrów, natywne wejście obrazowe, 10M tokenów kontekstu na papierze
Rozumowanie2.5Kodowanie2.0Pisanie2.5Szybkość4.5Stosunek jakości do ceny3.5Cena$0.60/1M out (Maverick, hosted) - 15Mistral Large 3Odwiedź
Otwarty flagowiec MoE 675B (41B aktywnych) z kontekstem 256K, wejściem obrazowym i ceną $0.50/$1.50 za 1M.
Rozumowanie3.0Kodowanie3.0Pisanie4.0Szybkość3.5Stosunek jakości do ceny4.0Cena$1.50/1M out
Najlepsze pojedynki
Bezpośrednie starcia między zdobywcami podium.