アリーナ · AIモデルレビュー

Claude Opus 4.6

開発:Anthropic

Anthropicの2026年2月Opus:1Mコンテキスト、適応思考、SWE-bench 80.8%、現在はOpus 4.8が後継。

アリーナスコア 3.5/5
推論4.0
コーディング4.0
ライティング4.0
速度2.5
コスパ3.0
Claude Opus 4.6 のサイトへエージェント型コーディング長文コンテキスト分析マルチステップのエージェントワークフロー大規模コードベースのリファクタリング
価格

$25/1M out

標準ティアは$5/$25 per 1M tokens。1Mコンテキスト全体が現在は標準料金です(発売時の200K tokens超に対する$10/$37.50の割増は後に撤廃)。バッチAPIは50%オフ($2.50/$12.50)、米国限定推論(inference_geo)は1.1x倍率です。

プロバイダー

Anthropic

コンテキストウィンドウ

1M tokens (128K max output)

入力料金

$5/1M in

出力料金

$25/1M out

モダリティ

text, vision (image input), text output

オープンウェイト

なし

Claude Opus 4.6 とは?

2026年2月5日にリリースされたフロンティアOpusクラスモデルです。Opusとして初めて1M tokensのコンテキストウィンドウ、適応思考、effortパラメータ(lowからmax)を搭載しました。発売時にSWE-bench Verifiedで80.8%、Terminal-Bench 2.0で首位のスコアを記録。その後、同一価格のOpus 4.7と4.8に取って代わられました。

Claude Opus 4.6 の長所と短所

長所

  • 発売時にSWE-bench Verified 80.8%(25回試行平均)とTerminal-Bench 2.0首位を記録した、その世代(2026年2月)を代表するエージェント型コーディングモデルです
  • 1M tokensコンテキストウィンドウを備えた初のOpus:1M tokensでのMRCR v2 8-needleが76%、Sonnet 4.5は18.5%です
  • Opus 4.5から推論力が大幅に向上:ARC-AGI-2は68.8% vs 37.6%、経済価値タスクGDPval-AAで+190 Elo(GPT-5.2に約144 Eloの差)です
  • 性能向上にもかかわらずOpus 4.5の価格($5/$25 per 1M tokens)を維持。1Mコンテキスト全体が標準料金で課金され、50%のバッチ割引もあります
  • 適応思考に加えてeffortパラメータ(low/medium/high/max)で、リクエストごとに知能・レイテンシ・コストを調整できます
  • 自律エージェントとしての挙動が優秀:作業を並列化し、Opus 4.5より手助けが少なくて済みます(Every.to Vibe Check)

短所

  • Opus 4.5より遅く冗長で、長いエージェント実行では「負荷でペースが揺らぐ」とレビュアーが報告しています(Every.to)
  • 文章力は後退:ブラインドテストでEvery.toのチームはOpus 4.5の文章を好み、4.6は「XではなくY」構文のようなAI臭さが増えています
  • 予期しない変更を加えることがあり、「自分のスキルを常に把握しているわけではない」ため、レビュアーによればGPT-5.x Codexより綿密な監督が必要です
  • 数か月で同じ$5/$25のOpus 4.7と4.8に抜かれ、2026年6月以降4.6ではfastモードが利用できません(リクエストは標準速度で実行されます)
  • ベンチマーク疲れを指摘する開発者もいます:日常のコーディングでの4.5からの向上はスコアほど体感しにくく、SWE-bench自体は4.5と横ばいでした(80.8% vs 80.9%)

アリーナの評決

エージェント型コーディングと長文コンテキスト作業において、同一価格でOpus 4.5から明確にアップグレードされたモデルであり、発売時はエージェント型コーディングのベンチマーク首位を守っていました。しかし2026年半ばの時点で、新規プロジェクトをこれで始める理由はほとんどありません。Opus 4.8が同じ$5/$25で全面的に上回るため、4.6を選ぶのは主に検証済みの挙動を固定したい場合です。ブラインドテストでOpus 4.5の文章が好まれた以上、ライターは避けるべきですし、レイテンシ重視のユーザーは4.5より遅くfastモードの選択肢がない点に注意してください。

親指を上げるか、下げるか

あなたの審判を下す

Claude Opus 4.6 を推薦しますか?それとも観客に警告しますか?

50%観客スコア · 0

Claude Opus 4.6 の代替ツールTOP

すべての代替ツール
1
Claude Haiku 4.5

Anthropic最速のモデル:Sonnet 4.5の約90%のコーディング力を$1/$5 per 1M tokensで、200Kコンテキスト。

$5/1M out67%(2)
Visit
2
Claude Fable 5

Anthropicの2026年6月Mythosクラスフラッグシップ:SWE-bench Proで80.3%、他のあらゆるフロンティアモデルに11ポイントの差

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Anthropicの2026年4月Opus:SWE-bench Verified 87.6%、1Mコンテキスト、高解像度ビジョン、現在はOpus 4.8に後れ

$25/1M out57%(3)
Visit

Claude Opus 4.6 を1対1で比較

Claude Opus 4.6:よくある質問

Claude Opus 4.6 の100万トークンあたりの料金は?

Claude Opus 4.6 の料金は、入力100万トークンあたり$5/1M in、出力100万トークンあたり$25/1M outです。 標準ティアは$5/$25 per 1M tokens。1Mコンテキスト全体が現在は標準料金です(発売時の200K tokens超に対する$10/$37.50の割増は後に撤廃)。バッチAPIは50%オフ($2.50/$12.50)、米国限定推論(inference_geo)は1.1x倍率です。