アリーナ · AIモデルレビュー
Claude Sonnet 5
開発:Anthropic
Anthropicの最もエージェント的なSonnet:コーディングとエージェントでOpus 4.8に迫る品質を$3/$15、1Mコンテキストで
$15/1M out ($10 intro until 2026-08-31)
単一ティア:標準$3/$15 per 1M tokens、2026年8月31日まで導入価格$2/$10。Batch APIは-50%。新トークナイザーはテキストあたり約30%多くのtokensを生成し(Anthropicによると1.0-1.35x)、実質コストが上がります。
Anthropic
1M tokens (128K max output)
$3/1M in ($2 intro until 2026-08-31)
$15/1M out ($10 intro until 2026-08-31)
text, vision (image input, text output)
なし
Claude Sonnet 5 とは?
2026年6月30日にリリースされた、Sonnet 4.6を継ぐAnthropicのミッドティアモデルです。エージェント型コーディング、ツール使用、ナレッジワークでOpus 4.8に近い性能をSonnet価格で提供します。1M tokensコンテキスト、128Kの最大出力、適応思考はデフォルトで有効です。
Claude Sonnet 5 の長所と短所
長所
- Sonnet 4.6からエージェント性能が大幅向上:Terminal-Bench 2.1が80.4% vs 67.0%、OSWorld-Verifiedが81.2% vs 78.5%、SWE-bench Proが63.2% vs 58.1%です
- ナレッジワークでOpus 4.8と互角(GDPval-AA v2:1,618 vs 1,615)、ツールありのHumanity's Last Examでもほぼ同点(57.4% vs 57.9%)。それをOpus 4.8の60%の価格(導入期間中は40%)で実現します
- 1M tokensのコンテキストウィンドウと128Kの最大出力。2026年8月31日まで$2/$10 per 1M tokensの導入価格です
- 粘り強い自己検証型のエージェント挙動:実地レビューでは、Sonnet 4.6と違って自分のコードをテストし、難問を解けるまで反復すると評されています
- xhighエフォートレベルと高解像度ビジョン(2576px画像)を備えた初のSonnetで、適応思考はデフォルトで有効です
- コードレビューの精度がSonnet 4.6より高く(38-40% vs 29%)、誤検知の指摘が少なくなっています
短所
- 新トークナイザーにより同じテキストのトークン数が約30%増加し(Anthropicによると1.0-1.35x、Simon Willisonの計測で英語約1.4x、Python約1.28x)、表示価格は据え置きでも実質コストが上がります
- 冗長でトークン消費が多い:独立テストではタスクあたり約$2.29(Sonnet 4.6は約$1.20)で、コスト効率は161モデル中101位。高エフォートではタスク単価がOpus 4.8を超えることもあります
- 小さな定型編集ではSonnet 4.6より明らかに遅く、単純なタスクを過剰設計しがちです(CodeRabbitの実地レビュー)
- サンプリングパラメータ(temperature、top_p、top_k)が廃止され、デフォルト以外の値は400エラーを返すため、既存パイプラインが壊れます
- HN/Redditでの発売時の評判は賛否両論:「5」というラベルは誇大と受け止められ、厳格化されたサイバーセキュリティ保護機能が無害なセキュリティ関連作業を拒否することがあります
アリーナの評決
コーディング、ターミナル、コンピュータ操作のエージェントを運用していて、Opus 4.8に迫る品質をSonnet価格で求めるならSonnet 5を選んでください。特に$2/$10の導入期間中は狙い目で、低・中エフォートではSonnet 4.6から純粋なアップグレードです。ただし新トークナイザーと冗長さは予算に織り込むこと:実際のタスク単価はSonnet 4.6を大きく上回り、最高エフォートレベルでは解決タスクあたりのコストでOpus 4.8の方が得になることもあります。レイテンシ重視の小さな編集や、temperatureとtop_pに依存するパイプライン(現在はエラーになります)には避けてください。大量の小差分ワークロードには、Sonnet 4.6が依然として実利的な選択です。
親指を上げるか、下げるか
あなたの審判を下す
Claude Sonnet 5 を推薦しますか?それとも観客に警告しますか?
Claude Sonnet 5 の代替ツールTOP
すべての代替ツールAnthropic最速のモデル:Sonnet 4.5の約90%のコーディング力を$1/$5 per 1M tokensで、200Kコンテキスト。
Anthropicの2026年6月Mythosクラスフラッグシップ:SWE-bench Proで80.3%、他のあらゆるフロンティアモデルに11ポイントの差
Anthropicの2026年4月Opus:SWE-bench Verified 87.6%、1Mコンテキスト、高解像度ビジョン、現在はOpus 4.8に後れ
Claude Sonnet 5 を1対1で比較
観客の声
“Cheap per token, pricey per task. Independent tests had it near $2.29 a task vs $1.20 on 4.6, and at high effort it can out-cost Opus 4.8. It will not stop talking.”
“Terminal-Bench going 67 to 80 over Sonnet 4.6 matches what I see. My CI-fix agent went from constant babysitting to mostly hands-off overnight.”
“Matches Opus 4.8 on knowledge work at 60% of the price, and the intro $2/$10 window makes it silly value. My research agent runs on Sonnet 5 now, zero regrets.”
Claude Sonnet 5:よくある質問
Claude Sonnet 5 の100万トークンあたりの料金は?
Claude Sonnet 5 の料金は、入力100万トークンあたり$3/1M in ($2 intro until 2026-08-31)、出力100万トークンあたり$15/1M out ($10 intro until 2026-08-31)です。 単一ティア:標準$3/$15 per 1M tokens、2026年8月31日まで導入価格$2/$10。Batch APIは-50%。新トークナイザーはテキストあたり約30%多くのtokensを生成し(Anthropicによると1.0-1.35x)、実質コストが上がります。