Claude Opus 5は何が変わったのか——最上位モデルの知能が「半額」になった日

Claude Opus 5は何が変わったのか——最上位モデルの知能が「半額」になった日

#ai#開発組織#経営

こんにちは、大平です。

2026年7月24日、AnthropicがClaudeの新モデル「Claude Opus 5」をリリースしました(公式発表)。 一言でいえば、6月に出た最上位モデルFable 5にほぼ並ぶ知能を、その半額で提供するモデルです。

この2か月弱で、AnthropicはMythos 5・Fable 5・Sonnet 5・Opus 5と4つのモデルを出しました。 正直、追いかけるのが大変な速度です。 そこでこの記事では、スペックの羅列ではなく**「従来モデルから何が変わったのか」だけ**に絞って整理します。

結論:3行でまとめると

  • 値段は据え置きのまま、性能がFable 5級に上がった($5/$25、Opus 4.8と同額)
  • モデル選びより「effort(努力度)選び」が主役になった。同じモデルで5段階のコスト調整ができる
  • Fable 5の導入障壁だった「30日データ保持の義務」がない。ZDR契約の企業も最上位クラスを使える

以下、変更点を項目ごとに見ていきます。

変更点1:ラインナップ内の位置づけ

まず全体像です。 7月24日時点で、Claudeのモデル構成は次のようになりました。

モデル価格(入力/出力・100万トークン)位置づけの変化
Claude Fable 5$10 / $50最上位は維持。ただし「最難関専用」に後退
Claude Opus 5$5 / $25新設。実務の主力。Maxのデフォルト、Proの最上位
Claude Opus 4.8$5 / $25Opus 5へ置き換わる。フォールバック先として残存
Claude Sonnet 5$3 / $15(8月末まで$2/$10)大量処理・コスト重視の受け皿
Claude Haiku 4.5$1 / $5単純処理

6月時点の使い分けは「難タスクはFable 5、日常はSonnet 5かOpus 4.8」という3層構成でした。 Opus 5の登場でこれが崩れます。 Fable 5の知能が実質的にOpus価格帯に降りてきたので、多くの現場で「まずOpus 5」が正解になります。

Anthropic自身も、極めて高度なプロジェクトには引き続きFable 5を推奨していますが、日常的な業務ニーズはOpus 5でカバーできるという位置づけです。

変更点2:性能——Opus 4.8の「2倍以上」

数字で見ると変化の幅が分かります。 特に象徴的なのが、エージェント型のターミナル操作を評価するFrontier-Bench v0.1です。

モデルFrontier-Bench v0.1
Opus 543.3%
Fable 533.7%
Opus 4.818.7%

Opus 4.8の2倍以上であると同時に、価格が2倍のFable 5をも上回っています(unite.ai)。

他のベンチマークも傾向は同じで、「Fable 5に並ぶか超える性能を、半分〜1/3のコストで」という構図です。

  • CursorBench 3.2: max effort設定で、Fable 5のピークスコアの0.5%以内。コストは半分
  • OSWorld 2.0(PC操作タスク): Fable 5の最良結果を1/3強のコストで上回る
  • ARC-AGI-3(未知の問題を解く能力): 次点モデルの3倍のスコア
  • Zapier AutomationBench: 同一コストで次点の約1.5倍のパスレート
  • 科学領域: 有機化学でOpus 4.8比**+10.2ポイント**、タンパク質予測で**+7.7ポイント**

体感に効く変化として、Anthropicは「Opus 4.8より少ないステップ数・少ないツール呼び出しで仕事を終える」と説明しています。 同じ仕事を、より短い手数で片づける。 トークン単価が同じでも実効コストが下がるのはこの部分です。

導入企業のコメントも、性能そのものよりコスト効率に触れたものが目立ちます。

  • Cursor共同創業者 Sualeh Asif氏:「Fable 5の知能を、Opusの速度とコストで」
  • Devin(Cognition)CEO Scott Wu氏:FrontierCode 1.1でFable相当、コストは半分
  • Replit共同創業者 Madhav Jha氏:「Opusファミリーで4.5以来、最大の飛躍」
  • Lovable共同創業者 Fabian Hedin氏:Opus 4.7比で22%向上、実行の一貫性も改善

変更点3:「effort」がコスト管理の主役になった

今回いちばん実務にインパクトがあるのは、ベンチマークではなくこちらだと思います。

Opus 5は思考の深さをlow / medium / high / xhigh / maxの5段階で調整できます。 機能自体はOpus 4.6以降にもありましたが、Opus 5ではこれがモデル選択そのものを代替する水準になりました。

Anthropicによれば、Opus 5は最低のeffort設定でも、他のどのモデルより多くのタスクを通過します。 つまり「安く済ませたいから下位モデルに落とす」という判断が要らなくなり、同じモデルのまま予算に合わせて絞る運用ができます。

Fortuneやフォーチュン系メディアがこの機能を目玉として報じたのは、企業のAI利用料への懸念に対する直接的な回答だからです。 経営目線では、AIコストが「モデル選定」というシステム設計マターから、「設定値」という運用マターに降りてきた、という理解でよいと思います。

加えて、逆方向に振るfast modeも追加されました。 価格2倍($10/$50)で約2.5倍の速度が出ます。 対話的な用途で待ち時間を削りたいときの選択肢ですが、Claude API(およびClaude Code)限定で、Amazon BedrockやGoogle Cloud、Microsoft Foundryでは使えません。

変更点4:安全機構——Fable 5の「使いにくさ」がほぼ解消された

ここはFable 5を検討して見送った企業にこそ届けたい変更点です。

Fable 5は性能と引き換えに、運用上の制約が重いモデルでした。 とくに問題だったのが次の2点です。

  1. サイバーセキュリティ・生物系の安全分類器が過敏で、無害な開発・調査依頼まで拒否される
  2. 30日間のデータ保持が必須で、ゼロデータリテンション(ZDR)契約の組織は利用できない

Opus 5では、どちらも大きく緩みました。

  • サイバー分類器の介入頻度がFable 5比で約85%減少。ソースコードの脆弱性調査は許可される方向に変わりました(バイナリスキャン、ペネトレーションテスト、エクスプロイト生成は引き続きブロック)
  • 一般提供にあたってのデータ保持要件はなし。Fable 5でMicrosoftが社内利用を制限する理由にもなった条件が、Opus 5には付いていません

安全性そのものも下がってはいません。 Anthropicの自動行動監査では、Opus 5は逸脱行動スコア2.3で、Opus 4.8・Sonnet 5・Fable 5のいずれよりも低い(=良い)値でした。 同社は「これまでで最もアラインしたモデル」と表現しています。

なお、分類器がリクエストをフラグした場合、Claude.ai・Claude Code・Claude Coworkでは自動的にOpus 4.8にフォールバックして応答が返ります。 より制限の少ないアクセスが必要なセキュリティ組織向けには、Cyber Verification Program(CVP)という審査枠が用意されています。

変更点5:API利用者が対応すべき破壊的変更

Opus 4.8からの移行はほぼドロップインですが、見落とすと事故る変更が2つあります。

1. thinking(拡張思考)がデフォルトでオンになった

Opus 4.8ではthinkingパラメータを省略すると思考なしで動きました。 Opus 5では省略時に思考ありで動きます

これは静かなコスト増・切り詰めリスクです。 max_tokensは思考と本文の合計に対する上限なので、Opus 4.8で本文の想定量ぴったりに設定していたワークロードは、Opus 5では応答が途中で切れる可能性があります。 移行前にmax_tokensを見直してください。

2. 思考オフには effort の上限がある

thinking: {type: "disabled"}が使えるのはeffortがhigh以下のときだけです。 xhighmaxと組み合わせると400エラーになります。 リクエスト単位で検証されるので、途中でeffortを上げる実装は要注意です。

このほか、地味に効く改善もあります。

  • プロンプトキャッシュの最小長が1,024→512トークンに引き下げ。短いプロンプトもキャッシュに乗るようになりました
  • 会話途中でのツール変更(ベータ)。従来はツール定義を変えるとプロンプトキャッシュが全損しましたが、キャッシュを維持したまま追加・削除できます
  • 自動フォールバック(ベータ)。拒否時の代替モデルをAnthropic推奨に自動ルーティングするfallbacks: "default"が追加されました
  • レート制限はOpus 4.x系とは別枠です。移行してもOpus 4.x側の枠が空くわけではないので、トラフィックを移す前に確認してください

弱点も正直に

万能ではありません。 Anthropic自身と実使用レビューが指摘している弱点を挙げておきます。

事実の幻覚がOpus 4.8よりわずかに増えた。 全体の正答率は上がっているにもかかわらず、事実主張のハルシネーションは微増したとAnthropicが認めています。 出典を伴う調査業務では、裏取り工程を省かないほうが安全です。

出力が冗長。 実務レビューでは「brilliant(素晴らしい)が annoying(うっとうしい)」と評され、過剰な詳細さが作業の邪魔になるという指摘が出ています(Lenny's Newsletter)。 マージコンフリクトの解決を渋る、といった「神経質さ」の報告もあります。 これはプロンプト側で簡潔さを明示すれば軽減できますが、effortを下げても文章量はあまり変わらない点は覚えておくとよいです。

専門特化領域では上位モデルに劣る。 生物学研究と攻撃的サイバーセキュリティでは、Mythos 5に及びません。 この2領域が本業なら、モデル選定の結論は変わります。

実務でどう使い分けるか

7月時点での現実解を整理します。

用途推奨
日常の開発・エージェント運用・オフィス業務Opus 5(effortで調整)
数日規模の自律実行、極めて高難度の一発実装Fable 5
大量処理・バッチ・コスト最優先Sonnet 5 / Haiku 4.5
生物学研究・攻撃的セキュリティMythos 5(Project Glasswing経由)

ポイントは、「どのモデルを使うか」の判断が減り、「どのeffortで回すか」の判断に置き換わったことです。 モデルを跨ぐとプロンプトキャッシュが失効し、挙動の検証もやり直しになりますが、effortの変更ならその負担がありません。 運用の複雑さという意味では、これはかなり大きな簡略化です。

まとめ——「知能の値段」が半分になった

経営視点で押さえるべきことは3つです。

1. 同じ予算で、これまでの倍の仕事を任せられる 6月時点でFable 5にしかできなかった水準の作業が、半額のOpus 5でほぼ同じように動きます。 「AIに任せると高いから見送る」と判断した案件があるなら、その判断の前提は1か月で変わっています。

2. コスト管理の主戦場が、設計から運用に移った effortという1つの設定値でコストと品質のバランスを取れるようになりました。 「重い処理は上位モデル、軽い処理は下位モデル」というルーティング設計に工数をかけていた組織は、その複雑さを減らせます。

3. 2か月で4モデル。特定モデル前提の作り込みは負債になる Mythos 5、Fable 5、Sonnet 5、Opus 5——このペースは当面続くと見るべきです。 モデルIDを直書きし、そのモデルの癖に合わせてプロンプトを作り込んだシステムは、数か月で作り直しになります。 モデルを差し替え可能な層として切り出しておく設計が、そのまま資産防衛になります。

そして最後に、Fable 5の記事でも書いたことをもう一度。 モデルが賢くなるほど差がつくのは、コードベースの整備状況・仕様の言語化・検証基盤の有無です。 Opus 5に数時間の仕事を任せられる組織と、数分のタスクしか任せられない組織の差は、モデルの性能が上がるほど開いていきます。 性能が半額になった今こそ、任せる側の「足腰」を点検するタイミングだと思います。

参考リンク

公式情報

報道・第三者評価

関連して読める記事

同じ2か月弱で立て続けに出た最上位モデルの全体像と、Claude Codeの実際の課金額は、あわせて読むとコスト判断の解像度が上がります。

Claude Fable 5とは何か——リリース3日で米政府に規制された"Mythos級"モデルの、停止から復活までの全記録

2026年6月9日にリリースされたAnthropicの最上位モデル「Claude Fable 5」は、わずか3日後に米政府の輸出管理指令で提供停止となり、19日後の7月1日に復活しました。停止から復活までの経緯、価格とAPIの変更点、安全設計をめぐる論争、Opus 4.8やSonnet 5との使い分けまで、公式情報と報道を突き合わせて総まとめします。サブスクリプションでの無償利用は日本時間7月13日15時59分までです。

2026年7月8日

Claude Codeの料金はいくら?プラン別価格と「月200ドルでAPI換算20万円分」の実測データで解説

Claude Codeの料金はいくらか。Pro(月20ドル)からMax(月100〜200ドル)、Team、API従量課金まで2026年7月時点の価格を整理し、月200ドルのMax 20xプランでAPI換算1,400〜1,500ドル分を使っている自社の実測データを公開します。プラン選びの落とし穴と、料金表に載らない「運用設計」のコストまで、導入を検討する経営層・開発責任者向けに解説します。

2026年7月21日
この記事をシェア