Hall of Fame · Живий рейтинг натовпу
Рейтинг: LLM-моделі
Усі учасники цієї арени, ранжовані наживо реальними вердиктами натовпу: рекомендувати чи уникати, один вердикт на людину. Порядок змінюється з кожним голосом.
Оновлено 21 липня 2026 р.
- Claude Haiku 4.5Відвідати
Найшвидша модель Anthropic: близько 90% навичок кодування Sonnet 4.5 за $1/$5 за 1M токенів, контекст 200K.
Міркування3.0Код3.5Тексти3.0Швидкість4.5Ціна-якість4.0Ціна$5/1M out - 2Claude Fable 5Відвідати
Флагман Anthropic класу Mythos від червня 2026: 80.3% на SWE-bench Pro, на 11 пунктів попереду кожної іншої флагманської моделі
Міркування5.0Код5.0Тексти4.5Швидкість2.0Ціна-якість3.0Ціна$50/1M out - 3Claude Opus 4.7Відвідати
Opus від Anthropic, квітень 2026: 87.6% SWE-bench Verified, контекст 1M, зір високої роздільності, нині позаду Opus 4.8
Міркування4.5Код4.5Тексти4.5Швидкість2.5Ціна-якість3.0Ціна$25/1M out - 4Claude Sonnet 5Відвідати
Найагентніший Sonnet від Anthropic: майже якість Opus 4.8 у кодуванні й агентах за $3/$15 із контекстом 1M
Міркування4.5Код4.5Тексти4.5Швидкість4.0Ціна-якість4.5Ціна$15/1M out ($10 intro until 2026-08-31) - 5Gemini 3 ProВідвідати
Флагманська модель Google від листопада 2025: контекст 1M, перша понад 1500 Elo на LMArena, замінена Gemini 3.1 Pro.
Міркування4.5Код4.5Тексти3.5Швидкість3.5Ціна-якість4.0Ціна$12/1M out (prompts ≤200K) - 6DeepSeek-V4Відвідати
Open weights MoE на 1.6T із контекстом 1M токенів і майже флагманським агентним кодуванням за $0.87 за 1M вихідних токенів
Міркування4.5Код4.5Тексти3.5Швидкість3.0Ціна-якість5.0Ціна$0.87/1M out - 7Claude Opus 4.8Відвідати
Флагманська модель Anthropic рівня Opus для агентного кодування з довгим горизонтом; контекст 1M за $5/$25 за 1M токенів.
Міркування4.5Код5.0Тексти5.0Швидкість3.0Ціна-якість3.5Ціна$25/1M out - 8GPT-5.5Відвідати
Агентний флагман OpenAI: контекст 1M, SOTA на ARC-AGI-2 і Terminal-Bench 2.0, $5/$30 за 1M токенів.
Міркування5.0Код4.5Тексти4.0Швидкість3.5Ціна-якість3.0Ціна$30/1M out - 9Claude Opus 4.5Відвідати
Флагманський кодер Anthropic від листопада 2025: перший подолав 80% на SWE-bench Verified, на 66% дешевший за Opus 4.1
Міркування3.5Код3.5Тексти3.5Швидкість2.5Ціна-якість2.5Ціна$25/1M out - 10GPT-5.2Відвідати
Флагманська модель OpenAI від грудня 2025: контекст 400K, 80% SWE-bench Verified, сильне міркування, але повільний вивід.
Міркування4.0Код4.0Тексти3.5Швидкість2.5Ціна-якість3.5Ціна$14/1M out - 11Grok 4.3Відвідати
Флагманська модель xAI з контекстом 1M за $1.25/$2.50 за 1M токенів, налаштована на агентне використання інструментів.
Міркування4.0Код3.5Тексти4.5Швидкість3.5Ціна-якість4.5Ціна$2.50/1M out - 12Claude Opus 4.6Відвідати
Opus від Anthropic, лютий 2026: контекст 1M, адаптивне мислення, 80.8% SWE-bench, нині витіснений Opus 4.8.
Міркування4.0Код4.0Тексти4.0Швидкість2.5Ціна-якість3.0Ціна$25/1M out - 13Gemini 3.5 FlashВідвідати
Флагман швидкісного рівня Google: обходить Gemini 3.1 Pro в агентному кодуванні за $1.50/$9, утричі дорожчий за 3 Flash
Міркування3.5Код4.0Тексти3.0Швидкість5.0Ціна-якість4.5Ціна$9.00/1M out - 14Llama 4 (Scout / Maverick)Відвідати
Пара open-weight MoE від Meta: 17B активних параметрів, нативний вхід зображеннями, контекст 10M токенів на папері
Міркування2.5Код2.0Тексти2.5Швидкість4.5Ціна-якість3.5Ціна$0.60/1M out (Maverick, hosted) - 15Mistral Large 3Відвідати
Флагман open-weight MoE на 675B (41B активних) із контекстом 256K, входом зображеннями й цінами $0.50/$1.50 за 1M.
Міркування3.0Код3.0Тексти4.0Швидкість3.5Ціна-якість4.0Ціна$1.50/1M out
Головні дуелі
Порівняння віч-на-віч між призерами подіуму.