結論から言います。
Claude Opus 5は、最上位モデルFable 5に迫る性能を、前世代Opus 4.8と同じ価格で使えるようにしたモデルです。API料金はFable 5のちょうど半額。日常の壁打ち用途で使う分にはオーバースペックですが、「何かを作る」用途——業務の自動化、エージェント構築、データ集計の仕組みづくり——では、課金額を上げてでも使う価値があります。
そして意外と見落とされているのが、プロンプトの書き方が逆方向に変わったという点です。指示は「足す」のではなく「減らす」ほど良くなります。
以下、順番に整理していきます。
Claude Opus 5とは?
2026年7月24日にAnthropicが発表した新モデルです。Claudeの有料プラン(Pro / Max)とAPIで、すでに利用できます。
位置づけとしては「毎日使うためのモデル」。最上位のFable 5・Mythos 5が研究や極めて高難度のタスク向けだとすれば、Opus 5は実務の主力です。コンテキストウィンドウは100万トークン、思考(Thinking)はデフォルトでオンになっています。
Web版・アプリ版どちらも、チャットの途中でモデルを切り替えられるようになりました。「この作業はOpus 5、この確認はSonnetで」という使い分けが、会話を切らずにできます。
Opus 4.8・Fable 5と何が違うのか?
一番わかりやすいのは価格性能比です。
Claude Opus 4.8 | Claude Opus 5 | Claude Fable 5 | |
|---|---|---|---|
入力(100万トークン) | $5 | $5 | $10 |
出力(100万トークン) | $25 | $25 | $50 |
Frontier-Bench v0.1 | — | 43.3% | 33.7% |
CursorBench 3.2(最大設定) | — | 70.0% | 70.5% |
※価格・スコアはAnthropicの公式発表および各報道より。最新の数値は必ず公式をご確認ください。
- 価格はOpus 4.8から据え置き。 つまり、乗り換えのコスト増がありません。
- Fable 5の半額。 それでいてコーディング系ベンチマークでは上回っている項目があります。
- CursorBench 3.2では0.5ポイント差。 ほぼ互角の性能を、タスクあたり半分のコストで出しています。
APIを使っていない方にとっては、この「効率の良さ」は使用量の上限に到達する速度として体感できます。Fable 5を使っていると、使用量メーターが驚くような速度で減っていきます。Opus 5はそこが穏やかです。
ベンチマークで、具体的に何が伸びたのか?
公式が挙げている中で、実務に直結しそうなものを拾います。
初見の問題を解く力(ARC-AGI-3)が約30%に。 学習済みの知識では解けない、完全に新しいパターンの問題を解かせるテストです。前世代のOpus 4.8が1.5%程度だったことを考えると、桁が違います。
これ、実務では何を意味するか。私はコンサルティングで、まったく知らない業界の案件が来ることがあります。歯科医院、医療関係、過去には蓄電池を売ったこともあります。当然、最初は何もわかりません。そういう「前例のない問題を、その場で構造化して解く」局面での性能が上がった、ということです。
業務自動化ツール(Zapier系ベンチマーク)で最高スコア。 しかも、最も低いeffort設定でさえ他モデルを上回っています。Zapierを業務に組み込んでいる方は、ここは注目すべきポイントです。
コンピュータ操作の性能が大幅に向上。 スプレッドシートやExcelを実際に操作させる用途で効いてきます。私が広告データや決済システムのデータを集計するスプレッドシートを作ったときも、この機能を使いました。
アライメント(逸脱した振る舞いをしないか)がOpusシリーズで最高。 無謀な行動や欺瞞的な振る舞いの発生率が最も低い、と公式は説明しています。地味ですが、業務に組み込むなら重要な指標です。
一方で、エージェント型コーディングの一部指標ではOpenAI側が上という結果も出ています。またサイバーセキュリティのような、針の穴を通すような正確性が求められる領域は、依然として最上位モデルの守備範囲です。
ここは正直に書いておきます。「Claudeが全部勝ちました」という話ではありません。ただ、私たちがやっている仕事——売上を上げる、業務を回す——は、100点満点を取らないと成立しない世界ではないんですよ。その前提で見ると、Opus 5のコスパは相当に良い、というのが私の評価です。
【最新AIアップデート】claude opus 5登場 - 西埜巧祐〜AI時代の思考力〜 | stand.fm
Podcastで聴くOpus 5でプロンプトの書き方はどう変わるのか?
ここが今回、一番実務に効く話です。Anthropicの公式ガイダンスには、こう書かれています。「指示を減らすほど良くなる」。
普通、プロンプトがうまくいかないと、私たちは指示を足していきますよね。「必ず検証して」「丁寧に報告して」「抜け漏れがないか確認して」。ところがOpus 5は、賢くなった結果、言わなくても自分で検証し、丁寧に報告し、手厚く書くようになりました。
そこに従来の指示を重ねると、二重にかかります。結果、無駄に長くなり、無駄にコストが上がり、無駄に使用量を消費します。
具体的に減らすべき指示
よくある指示 | Opus 5では |
|---|---|
「必ず検証してください」 | 削除。過剰な検証ループの原因になります |
「重大な問題だけ報告して」 | 逆効果。報告量が減りすぎることがあります |
「保守的に書いて」 | 出力が痩せます。外したほうが良い場合が多いです |
「サブエージェントを使って」 | 乱立するとコストと時間だけが増えます |
「前の発言に誤りがあれば訂正して」 | 自己修正が過剰に走ります |
サブエージェントの委任は、本当に独立して並列実行できる大きな作業だけに限定してください。簡単な仕事は、そのまま回したほうが速くて安いです。
逆に、追加したほうがいい指示
回答が長すぎる問題は、effortを下げても解決しません。簡潔さは、明示的に指示して初めて効きます。
ユーザーと何往復もするような使い方をしているなら、こう入れてください。
回答は要点を絞って短くしてください。免責や注意書きは短くとどめ、本題に大部分を使ってください。説明を求められた場合は、詳しい解説を明示的に求められない限り、要点をまとめた形で答えてください。
システムプロンプトが長い場合は、この指示を文章の末尾に近い位置に置くと効きが良くなります。
最初のツール実行の前に、これから何をするかを1文で伝えてください。作業中は、重要な発見があったときと方針を変えるときだけ簡潔に報告してください。終わったら結論から述べてください。
書き出すファイルが長くなる件も、実感としてその通りです。広告文を作らせたら、30〜40ページ分の文章が返ってきたことがあります。初見で「これは後で読もう」と逃げました。必要な量ではあるのですが、想定はしておいたほうがいいです。
effort設定は、どれを選べばいいのか?
Opus 5では、思考量を low / medium / high / xhigh / max から選べます。デフォルトはhighです。結論、基本はhighのままで問題ありません。
低い設定にすれば使用量は減りますが、体感としては思考量もはっきり減ります。節約のために下げて、結果的にやり直しが増えるなら本末転倒です。
なお、Thinkingはデフォルトでオン。オフにできるのはeffortがhigh以下のときだけで、オフにすると稀におかしな出力が混ざることがあります。どうしてもオフで運用したい場合は、明示的に許可を出す必要があります。
Opus 5は、結局なにに使うべきなのか?
ここが私の一番言いたいところです。
壁打ちだけで使うなら、正直、課金額を上げる意味は薄いです。
私も料理のレシピを聞いたりはします。「この食材があるから美味しい料理を提案して」みたいな使い方です。それは全然いい。ただ、それだけならOpus 5である必要はありません。
Opus 5が本領を発揮するのは、何かを「作る」ときです。
私が実際に作ったものを挙げます。
- 広告データと複数の決済システムのデータを集計するスプレッドシート(コンピュータ操作機能を使用)
- 自分が作ったコンテンツをSNSに投稿・拡散してくれるAIエージェント
- マーケティングのプロモーション設計、メルマガの制作フロー
SNS投稿エージェントに関して言えば、私が手を動かした時間は体感で1〜2時間に満たないと思います。残りは全部Claudeがやっています。人間側の仕事は設計で、設計さえできれば作業は流れていきます。
「プログラミングができないと無理では」と思うかもしれません。私もできません。それでも作れています。むしろ、自分で書けないからこそ、こういうモデルの性能向上が効くわけです。
- フリーランスの方 → 自分の作業を時短するエージェントは、もう不可欠だと思っています
- 経営者の方 → 情報の集約と、コンテンツ制作・拡散の自動化
そして、意外とやっている人が少ない領域です。今のうちに着手しておくと、いろいろとメリットがあります。
よくある質問(FAQ)
Q. Opus 5はどのプランで使えますか? A. Claudeの有料プラン(Pro / Max)とAPIで利用できます。Maxではデフォルトモデルになっています。プランごとの詳細はClaude公式のサポートページをご確認ください。
Q. Opus 4.8から乗り換えるべきですか? A. API利用であれば、価格が同額なので乗り換えないほうが損です。性能は明確に上がっています。
Q. Fable 5とOpus 5、どちらを使えばいいですか? A. 日常の実務ならOpus 5で十分です。Fable 5は価格が倍かかるため、本当に最上位の性能が必要な局面に絞るのが現実的です。
Q. モデルは会話の途中で変えられますか? A. 変えられます。作業中にタスクの性質に応じて切り替えられるのは、実務ではかなり便利です。
Q. effortは下げたほうが節約になりますか? A. 使用量は減りますが、思考量も体感ではっきり減ります。基本はhighのままを推奨します。
Q. プロンプトはこれまでのものを使い回せますか? A. 一度、棚卸しすることをおすすめします。特に「検証してください」「丁寧に報告してください」系の指示は、Opus 5では過剰になります。逆に、簡潔さの指示は明示的に追加してください。
まとめ
- Claude Opus 5は、Fable 5に迫る性能をOpus 4.8と同価格で提供するモデル(Fable 5の半額)
- コーディング、初見の問題解決、業務自動化、コンピュータ操作の各領域で大きく伸びた
- 一方で、エージェント型コーディングの一部やサイバーセキュリティは他モデル・上位モデルの領分
- プロンプトは「足す」から「減らす」へ。ただし簡潔さだけは明示的に指示する
- effortは基本high。壁打ちではなく「作る」ことに使ってこそ、課金の価値が出る
モデルの進化そのものより、それを使って自分の会社の何を自動化するかのほうが、はるかに大事です。設計は人間の仕事です。そこだけは、AIに丸投げできません。
