Hall of Fame · 실시간 대중 랭킹

LLM 모델 리더보드

이 아레나의 모든 경쟁자가 진짜 대중 평결로 실시간 순위가 매겨집니다: 추천 또는 비추천, 1인 1평결. 순위는 매 투표마다 움직입니다.

2026년 7월 21일 업데이트

엄선된 추천 목록이 더 편하신가요?최고의 LLM 모델
  1. Claude Haiku 4.5

    Anthropic의 최고속 모델: Sonnet 4.5 코딩 실력의 약 90%를 1M 토큰당 $1/$5에, 200K 컨텍스트.

    추론3.0
    코딩3.5
    글쓰기3.0
    속도4.5
    가성비4.0
    가격$5/1M out
  2. 2
    Claude Fable 5

    Anthropic의 2026년 6월 Mythos급 플래그십: SWE-bench Pro 80.3%, 다른 모든 프런티어 모델을 11점 차로 앞섬

    추론5.0
    코딩5.0
    글쓰기4.5
    속도2.0
    가성비3.0
    가격$50/1M out
  3. 3
    Claude Opus 4.7

    Anthropic의 2026년 4월 Opus: SWE-bench Verified 87.6%, 1M 컨텍스트, 고해상도 비전, 현재는 Opus 4.8에 뒤처짐

    추론4.5
    코딩4.5
    글쓰기4.5
    속도2.5
    가성비3.0
    가격$25/1M out
  4. 4
    Claude Sonnet 5

    Anthropic의 가장 에이전트다운 Sonnet: 코딩과 에이전트에서 Opus 4.8에 근접한 품질을 $3/$15와 1M 컨텍스트로 제공

    추론4.5
    코딩4.5
    글쓰기4.5
    속도4.0
    가성비4.5
    가격$15/1M out ($10 intro until 2026-08-31)
  5. 5
    Gemini 3 Pro

    Google의 2025년 11월 프런티어 모델: 1M 컨텍스트, LMArena 1500 Elo 최초 돌파, Gemini 3.1 Pro로 대체됨.

    추론4.5
    코딩4.5
    글쓰기3.5
    속도3.5
    가성비4.0
    가격$12/1M out (prompts ≤200K)
  6. 6
    DeepSeek-V4

    1M 토큰 컨텍스트와 프런티어급에 근접한 에이전트 코딩을 출력 1M 토큰당 $0.87에 제공하는 오픈 웨이트 1.6T MoE

    추론4.5
    코딩4.5
    글쓰기3.5
    속도3.0
    가성비5.0
    가격$0.87/1M out
  7. 7
    Claude Opus 4.8

    장기 에이전트 코딩을 위한 Anthropic의 플래그십 Opus급 모델. 1M 컨텍스트를 1M 토큰당 $5/$25에 제공.

    추론4.5
    코딩5.0
    글쓰기5.0
    속도3.0
    가성비3.5
    가격$25/1M out
  8. 8
    GPT-5.5

    OpenAI의 에이전트 플래그십: 1M 컨텍스트, ARC-AGI-2와 Terminal-Bench 2.0 SOTA, 1M 토큰당 $5/$30.

    추론5.0
    코딩4.5
    글쓰기4.0
    속도3.5
    가성비3.0
    가격$30/1M out
  9. 9
    Claude Opus 4.5

    Anthropic의 2025년 11월 프런티어 코딩 모델: SWE-bench Verified 80% 돌파 최초 모델, Opus 4.1 대비 66% 저렴한 가격

    추론3.5
    코딩3.5
    글쓰기3.5
    속도2.5
    가성비2.5
    가격$25/1M out
  10. 10
    GPT-5.2

    OpenAI의 2025년 12월 프런티어 모델: 400K 컨텍스트, SWE-bench Verified 80%, 강한 추론이지만 느린 출력.

    추론4.0
    코딩4.0
    글쓰기3.5
    속도2.5
    가성비3.5
    가격$14/1M out
  11. 11
    Grok 4.3

    에이전트 툴 사용에 맞춰 튜닝된 xAI의 1M 컨텍스트 프런티어 모델, 1M 토큰당 $1.25/$2.50.

    추론4.0
    코딩3.5
    글쓰기4.5
    속도3.5
    가성비4.5
    가격$2.50/1M out
  12. 12
    Claude Opus 4.6

    Anthropic의 2026년 2월 Opus: 1M 컨텍스트, 적응형 사고, SWE-bench 80.8%, 현재는 Opus 4.8에 자리를 내줌.

    추론4.0
    코딩4.0
    글쓰기4.0
    속도2.5
    가성비3.0
    가격$25/1M out
  13. 13
    Gemini 3.5 Flash

    Google의 속도 티어 플래그십: 에이전트 코딩에서 Gemini 3.1 Pro를 $1.50/$9에 능가, 다만 3 Flash보다 3배 비쌈

    추론3.5
    코딩4.0
    글쓰기3.0
    속도5.0
    가성비4.5
    가격$9.00/1M out
  14. 14
    Llama 4 (Scout / Maverick)

    Meta의 오픈 웨이트 MoE 듀오: 활성 파라미터 17B, 네이티브 이미지 입력, 서류상 10M 토큰 컨텍스트

    추론2.5
    코딩2.0
    글쓰기2.5
    속도4.5
    가성비3.5
    가격$0.60/1M out (Maverick, hosted)
  15. 15
    Mistral Large 3

    256K 컨텍스트, 비전 입력, 1M당 $0.50/$1.50 가격의 오픈 웨이트 675B MoE 플래그십(활성 41B).

    추론3.0
    코딩3.0
    글쓰기4.0
    속도3.5
    가성비4.0
    가격$1.50/1M out