アリーナ · AIモデルレビュー

Claude Opus 4.8

開発:Anthropic

長期エージェント型コーディング向けAnthropicのフラッグシップOpusクラスモデル。1Mコンテキストを$5/$25 per 1M tokensで。

アリーナスコア 4.2/557%が推薦 · 3票
推論4.5
コーディング5.0
ライティング5.0
速度3.0
コスパ3.5
Claude Opus 4.8 のサイトへ長期コーディングエージェント大規模リファクタとコードベース移行コードレビューとデバッグエンタープライズのナレッジワーク(法務、金融、リサーチ)
価格

$25/1M out

標準ティアは$5/$25 per 1M tokens(Opus 4.7から据え置き)。fastモードのリサーチプレビューは$10/$50(Opus 4.7の非推奨fastティア$30/$150に対して)。バッチAPIは50%オフの$2.50/$12.50。1M tokensまで長文コンテキスト割増なし、プロンプトキャッシュ読み取りは$0.50/1Mです。

プロバイダー

Anthropic

コンテキストウィンドウ

1M tokens (128K max output)

入力料金

$5/1M in

出力料金

$25/1M out

モダリティ

text, vision (image input up to 2576px, text output)

オープンウェイト

なし

Claude Opus 4.8 とは?

2026年5月28日にリリースされた、Anthropicの最も高性能なOpusクラスモデルです。長期のエージェント型コーディング、ツール使用、自身の成果物に対する正直な自己評価に向けてチューニングされ、1M tokensのコンテキストウィンドウ、128Kの最大出力、エフォート制御付きの適応思考を備えます。API仕様と価格はOpus 4.7と完全に同一です。

Claude Opus 4.8 の長所と短所

長所

  • SWE-Bench Pro 69.2%(Opus 4.7は64.3%)、CursorBenchでは全エフォートレベルで歴代Opusを上回ります。大規模リファクタや複数ファイルにまたがるバグ調査での実地報告も好評です
  • 自身が生成したコードの欠陥を指摘せずに見逃す確率がOpus 4.7の約4分の1。数学推論も大幅向上(USAMO 2026:96.7% vs 69.3%)です
  • 1M tokensコンテキストと128K出力を据え置きの$5/$25で提供、長文コンテキスト割増なし。バッチAPIは50%オフ($2.50/$12.50)です
  • fastモード(リサーチプレビュー)は最大2.5倍の出力速度を$10/$50で提供し、Opus 4.7のfastティア($30/$150)より3倍安価です
  • エージェント向けの独自API機能:プロンプトキャッシュを保持する会話途中のシステムメッセージと、Claude Codeで並列サブエージェントを起動するDynamic Workflows
  • ブラウザ自動化のOnline-Mind2Webで84%、Legal Agent Benchmarkで記録的スコア(all-passで10%を超えた初のモデル)。エンタープライズのナレッジワークも強力です(Boxの社内比較で87% vs 77%)

短所

  • ターン単位の後退報告:計画ドキュメント内の明白な指示の見落とし、目標の一部だけへの回答、単純なUIの一発生成では4.7より劣るとの声があります
  • ヘビーユーザーから文体への批判:過剰なヘッジ、「大胆さやユーモアを削ってしまう」慎重すぎる編集(Steve Yegge)、十分な根拠のある主張にまで反論を繰り返すループ
  • 言語混入の癖:長いリサーチスレッドで中国語、キリル文字、ギリシャ文字がランダムに混じるとの報告があります
  • 公称1Mウィンドウにもかかわらず、実使用では約200K tokensを超えると品質低下が目に見えます
  • Vending-Benchの後退:詐欺サプライヤーに引っかかる頻度が4.7の約30倍で、交渉も下手になりました(より厳格な正直さアライメントの副作用)

アリーナの評決

Opus 4.7ユーザーにとってそのまま差し替えられるアップグレードです。API仕様と$5/$25の価格は同一のまま、長期のエージェント型コーディング、コードレビュー、エンタープライズ分析で実質的な向上が得られます。Claude Code、複数ファイルの移行、セキュリティ監査、多段階で検査・実行・検証するエージェントパイプラインを運用しているなら選んでください。一発のUIスニペット生成や4.7の挙動に厳密にチューニングされたプロンプトではユーザーが後退を報告しているため見送り、上限性能よりコストが重要ならSonnet 5($3/$15、2026年8月まで導入価格$2/$10)を選びましょう。ヘッジや慎重すぎる編集が気になるライターには、その文体がストレスになるかもしれません。

親指を上げるか、下げるか

あなたの審判を下す

Claude Opus 4.8 を推薦しますか?それとも観客に警告しますか?

57%観客スコア · 3

Claude Opus 4.8 の代替ツールTOP

すべての代替ツール
1
Claude Haiku 4.5

Anthropic最速のモデル:Sonnet 4.5の約90%のコーディング力を$1/$5 per 1M tokensで、200Kコンテキスト。

$5/1M out67%(2)
Visit
2
Claude Fable 5

Anthropicの2026年6月Mythosクラスフラッグシップ:SWE-bench Proで80.3%、他のあらゆるフロンティアモデルに11ポイントの差

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Anthropicの2026年4月Opus:SWE-bench Verified 87.6%、1Mコンテキスト、高解像度ビジョン、現在はOpus 4.8に後れ

$25/1M out57%(3)
Visit

Claude Opus 4.8 を1対1で比較

観客の声

恐怖の判事

Writing took a hit. It hedges everything and edits any bold or funny line out of my drafts. Also caught it answering a narrow slice of my planning doc and calling it done.

バイブスの覇者

Threw USAMO-level math at it for a lark and it just grinds through. 96.7 vs 69 for 4.7 tracks with what I see. Same $5/$25, 1M context, no excuse not to switch.

グロリウス・マクシムス

Upgraded from 4.7 for a monorepo refactor and the difference is real. It actually flags its own sketchy code instead of shipping it. Multi-file bug hunts feel way less babysat.

Claude Opus 4.8:よくある質問

Claude Opus 4.8 の100万トークンあたりの料金は?

Claude Opus 4.8 の料金は、入力100万トークンあたり$5/1M in、出力100万トークンあたり$25/1M outです。 標準ティアは$5/$25 per 1M tokens(Opus 4.7から据え置き)。fastモードのリサーチプレビューは$10/$50(Opus 4.7の非推奨fastティア$30/$150に対して)。バッチAPIは50%オフの$2.50/$12.50。1M tokensまで長文コンテキスト割増なし、プロンプトキャッシュ読み取りは$0.50/1Mです。