アンソロピック新AI「Sonnet 5」登場
Anthropic Claude Sonnet 5 vs Sonnet 4.6 vs Opus 4.8: Agentic Coding Benchmarks, API Pricing, and Cost-Performance Tradeoffs Compared

アンソロピックが新AI「Sonnet 5」を発表。上位モデルに性能が近づき、より安価で賢く、複雑な作業を自律的にこなせる中堅モデルとして注目されます。
アンソロピックはClaude Sonnet 5を出荷しました。彼らはこれをこれまでで最もagenticなSonnetモデルと呼んでいます。これは計画を立て、ブラウザやターミナルを操作し、長時間のタスクを自律的に実行します。Sonnet 5は、現在FreeおよびProプランのデフォルトモデルです。Max、Team、Enterpriseユーザーはこれを選択できます。Claude CodeおよびClaude Platformでも利用可能です。TL;DR Sonnet 5はアンソロピックの最もagenticな中堅モデルであり、Opus 4.8とのギャップを大幅に縮めています。公開されているすべてのベンチマークでSonnet 4.6を上回ります。SWE-bench Proで63.2%、OSWorld-Verifiedで81.2%、HLEで57.4%です。安価に実行できます。8月31日までの導入価格は100万トークンあたり入力$2/出力$10で、その後は$3/$15です。Opus 4.8は$5/$25です。低/中程度の労力では最高の価値を提供しますが、xhigh(非常に高い)労力では、同等の品質でOpus 4.8よりもコストがかかる場合があります。4.6よりも安全で、意図的にサイバー能力は低く抑えられています。精度が重要な作業にはOpusが引き続き推奨されます。Claude Sonnet 5は、アンソロピックのラインナップの中間に位置します。安価なHaiku 4.5より上位で、フラッグシップのOpus 4.8より下位です。Sonnet 5は、2026年2月にリリースされたSonnet 4.6のアップグレード版です。アンソロピックはこのリリースを、単一の主要ベンチマークではなく、agenticな信頼性を中心に据えています。実際にこれは、コンテキストを失うことなくより長いタスクチェーンを実行できることを意味します。ツール呼び出しが失敗した場合の自己修正が向上したことを意味します。Claude CodeやCowork内での長時間のセッションにおいて、より安定した動作を意味します。このモデルは、low、medium、high、xhigh(extra high)の労力レベルを公開しています。労力レベルが高いほど、推論により多くのトークンを費やします。これにより品質とコストの両方が上昇します。Sonnet 5が、Opus 4.7で導入されたものと同じ、更新されたtokenizerを使用していることに注意することが重要です。同じテキストが、およそ1.0〜1.35倍多くのトークンにマッピングされる可能性があります。
この記事について質問
記事の内容に答えます。記事外のことは都度ウェブで調べます。