Anthropic、Claude Opus 5を発表、半額で最先端に迫るAI

Anthropicは2026年7月24日、Claude Opus 5をリリースした。2カ月で4つ目のモデルとなるが、今回はこれまでとは異なる。Fable 5やMythos 5がプレミアム価格で能力の絶対的前線を押し広げるのに対し、Opus 5はチームが実際に毎日使うモデルとして設計されており、ベンチマーク結果はAnthropicがそれを実現した可能性を示唆している。

入力トークン100万あたり5ドル、出力トークン100万あたり25ドルと、従来のOpus 4.8と同じ価格でありながら、新モデルは複数の主要評価でFable 5に匹敵するパフォーマンスを発揮する。エージェンティックコーディングのテストであるFrontier-Bench v0.1では、Opus 5は43.3%を記録し、Fable 5の33.7%やGPT-5.6 Solの34.4%を明確に上回った。新たな問題解決力を測定するARC-AGI-3では30.2%を達成し、次点の競合の約4倍のスコアを記録した。コンピューター使用能力のテストであるOSWorld 2.0では、タスクあたりのコストが3分の1強でFable 5を上回った。

表面的な数字の背後には、Anthropicがデプロイメントをどのように考えているかについて、より興味深いストーリーが隠れている。Opus 5は、リクエストごとに低・中・高の努力調整ダイヤルを備えており、ユーザーは推論の深さと速度・コストをトレードオフできる。日常的なデータ入力タスクは低努力で実行してトークンを節約し、複雑なアーキテクチャ問題は高努力に設定できる。これは、ほとんどのプロダクションワークロードがすべての呼び出しで最大推論を必要としないことを認めた柔軟なアプローチである。

セーフティアーキテクチャ:ハードブロックではなくフォールバック

セーフティシステムは新たなアーキテクチャ上の選択を導入している。Opus 5のガードレールがリクエストを問題の可能性があるとフラグ付けした場合(バイナリベースの脆弱性スキャンやエクスプロイト生成を含むプロンプトなど)、システムはリクエストを完全に拒否するのではなく、自動的にOpus 4.8にフォールバックできる。これによりユーザーのワークフローを維持しつつ、高リスク操作を攻撃能力の低いモデルにルーティングする。

Your support allows us to spend more time verifying facts and less time chasing page views.

Back evidence-based news

AnthropicはOpus 5を、自動化された行動テストに基づき「これまでで最もアラインメントされたモデル」であり、最近のリリースと比較して 偽装的(デセプティブ)な行動の割合が低いと説明している。攻撃的サイバーセキュリティタスクでは、専門化されたMythos 5に及ばないものの、脆弱性識別では同等の成績を示している。

自己修正と努力調整ダイヤル

Anthropicが特に強調するのは、エンタープライズユーザーにとって最も重要となる可能性のある機能、自己修正である。内部デモでは、Opus 5はタスク実行中にエラーを検出し、独自の回避策を構築した。あるケースでは、モデルがオブジェクトを直接表示できなかったため、ゼロからコンピュータビジョンパイプラインを構築して生のピクセルから幾何学情報を抽出した。競合モデルは同一条件下で5回試行しても失敗した。

本モデルは、プロンプトキャッシュを無効にせずに会話中にツールを切り替える機能や、フラグ付きAPIリクエストを自動的に別のモデルにルーティングする機能など、Anthropicの開発者向け機能スイートを完全にサポートしている。Claude Max加入者のデフォルトモデルであり、Claude Proユーザーが利用できる最強のオプションでもある。

雅子 訳

出典:「Claude Opus 5 delivers top coding scores at half the per-task cost」(Interesting Engineering、2026年7月24日)、「Anthropic Introduces Claude Opus 5」(TheWinCentral、2026年7月24日)、Anthropic公式発表

Scroll to Top