Hall of Fame · 観客ライブランキング

LLMモデル ランキング

このアリーナの全出場者を、リアルな観客の審判でライブランキング:推薦か回避か、1人1票。順位は一票ごとに動きます。

2026年7月21日 更新

厳選ショートリストの方がお好みですか?ベストLLMモデル
  1. Claude Haiku 4.5

    Anthropic最速のモデル:Sonnet 4.5の約90%のコーディング力を$1/$5 per 1M tokensで、200Kコンテキスト。

    推論3.0
    コーディング3.5
    ライティング3.0
    速度4.5
    コスパ4.0
    価格$5/1M out
  2. 2
    Claude Fable 5

    Anthropicの2026年6月Mythosクラスフラッグシップ:SWE-bench Proで80.3%、他のあらゆるフロンティアモデルに11ポイントの差

    推論5.0
    コーディング5.0
    ライティング4.5
    速度2.0
    コスパ3.0
    価格$50/1M out
  3. 3
    Claude Opus 4.7

    Anthropicの2026年4月Opus:SWE-bench Verified 87.6%、1Mコンテキスト、高解像度ビジョン、現在はOpus 4.8に後れ

    推論4.5
    コーディング4.5
    ライティング4.5
    速度2.5
    コスパ3.0
    価格$25/1M out
  4. 4
    Claude Sonnet 5

    Anthropicの最もエージェント的なSonnet:コーディングとエージェントでOpus 4.8に迫る品質を$3/$15、1Mコンテキストで

    推論4.5
    コーディング4.5
    ライティング4.5
    速度4.0
    コスパ4.5
    価格$15/1M out ($10 intro until 2026-08-31)
  5. 5
    Gemini 3 Pro

    Googleの2025年11月フロンティアモデル:1Mコンテキスト、LMArenaで初の1500 Elo超え、現在はGemini 3.1 Proが後継。

    推論4.5
    コーディング4.5
    ライティング3.5
    速度3.5
    コスパ4.0
    価格$12/1M out (prompts ≤200K)
  6. 6
    DeepSeek-V4

    1M tokensコンテキストとフロンティア級に迫るエージェント型コーディングを出力1M tokensあたり$0.87で提供するオープンウェイト1.6T MoE

    推論4.5
    コーディング4.5
    ライティング3.5
    速度3.0
    コスパ5.0
    価格$0.87/1M out
  7. 7
    Claude Opus 4.8

    長期エージェント型コーディング向けAnthropicのフラッグシップOpusクラスモデル。1Mコンテキストを$5/$25 per 1M tokensで。

    推論4.5
    コーディング5.0
    ライティング5.0
    速度3.0
    コスパ3.5
    価格$25/1M out
  8. 8
    GPT-5.5

    OpenAIのエージェント特化フラッグシップ:1Mコンテキスト、ARC-AGI-2とTerminal-Bench 2.0でSOTA、$5/$30 per 1M tokens。

    推論5.0
    コーディング4.5
    ライティング4.0
    速度3.5
    コスパ3.0
    価格$30/1M out
  9. 9
    Claude Opus 4.5

    Anthropicの2025年11月フロンティアコーダー:SWE-bench Verifiedで初の80%超え、Opus 4.1比66%の値下げ

    推論3.5
    コーディング3.5
    ライティング3.5
    速度2.5
    コスパ2.5
    価格$25/1M out
  10. 10
    GPT-5.2

    OpenAIの2025年12月フロンティアモデル:400Kコンテキスト、SWE-bench Verified 80%、推論は強力だが出力は遅め。

    推論4.0
    コーディング4.0
    ライティング3.5
    速度2.5
    コスパ3.5
    価格$14/1M out
  11. 11
    Grok 4.3

    エージェント型ツール使用に調整された、xAIの1Mコンテキストフロンティアモデル、$1.25/$2.50 per 1M tokens。

    推論4.0
    コーディング3.5
    ライティング4.5
    速度3.5
    コスパ4.5
    価格$2.50/1M out
  12. 12
    Claude Opus 4.6

    Anthropicの2026年2月Opus:1Mコンテキスト、適応思考、SWE-bench 80.8%、現在はOpus 4.8が後継。

    推論4.0
    コーディング4.0
    ライティング4.0
    速度2.5
    コスパ3.0
    価格$25/1M out
  13. 13
    Gemini 3.5 Flash

    Google速度ティアのフラッグシップ:エージェント型コーディングでGemini 3.1 Proを上回り$1.50/$9、ただし3 Flashの3倍の価格

    推論3.5
    コーディング4.0
    ライティング3.0
    速度5.0
    コスパ4.5
    価格$9.00/1M out
  14. 14
    Llama 4 (Scout / Maverick)

    MetaのオープンウェイトMoEデュオ:アクティブ17Bパラメータ、ネイティブ画像入力、公称10M tokensコンテキスト

    推論2.5
    コーディング2.0
    ライティング2.5
    速度4.5
    コスパ3.5
    価格$0.60/1M out (Maverick, hosted)
  15. 15
    Mistral Large 3

    256Kコンテキスト、ビジョン入力、$0.50/$1.50 per 1Mの価格を備えたオープンウェイト675B MoEフラッグシップ(アクティブ41B)。

    推論3.0
    コーディング3.0
    ライティング4.0
    速度3.5
    コスパ4.0
    価格$1.50/1M out