TITLE

Claude Opus 5 発表——価格据え置きで Fable 5 に迫る性能、開発チームのモデル使い分けはどう変わるか

投稿日:2026.07.25

CATEGORY

  • AI開発
Claude Opus 5 発表——価格据え置きで Fable 5 に迫る性能、開発チームのモデル使い分けはどう変わるか

Anthropic が 2026 年 7 月 24 日、新しい上位モデル「Claude Opus 5」を発表しました。標準料金は入力 100 万トークンあたり 5 ドル、出力 100 万トークンあたり 25 ドルで、これは前モデル Opus 4.8 と同額です。つまり Opus 4.8 からの値上げはありません。一方で Anthropic は、Opus 5 を「Claude Fable 5 のフロンティア知性に近づきながら価格は半分」のモデルと位置づけています。Fable 5(2026 年 6 月発表)は入力 10 ドル・出力 50 ドルなので、この「半分」は Fable 5 との比較であり、Opus 5 自体の価格が下がったわけではありません。値上げなしの Opus 4.8 の後継が、より高価な Fable 5 の半額でフロンティア級の性能を狙ってきた——この二重の意味が今回の発表の核心です。

Claude.ai・Claude API・Claude Platform の全プラットフォームで提供が始まっており、Claude Max(コンシューマー最上位サブスク)では既定モデルに、Claude Pro でも最上位モデルの位置づけになっています。Fast mode も用意されており、基本料金の 2 倍で約 2.5 倍の速度が出るとされています。

価格対性能:なぜ「半額」が効くのか

注意したいのは、5 ドル・25 ドルという価格帯そのものは新しくないことです。この枠にはこれまで Opus 4.8 が入っており、Opus 5 の登場で変わるのは「同じ支出で買える性能の水準」です。Anthropic はベンチマーク上の主張として、Frontier-Bench v0.1 で Opus 4.8 の 2 倍以上のスコアをより低コストで達成し、OSWorld 2.0 では Fable 5 の最高スコアを約 3 分の 1 のコストで上回ったとしています。ARC-AGI 3 では次点モデルの 3 倍のスコア、Zapier AutomationBench では同コスト当たりのパス率が次点モデルの約 1.5 倍という主張も並びます。

これらはいずれも Anthropic 自身の発表内容であり、独立した第三者検証ではない点は差し引いて読む必要があります。その上で整理すると、動くのは 2 つの境界です。一つは Opus 4.8 との境界——既に Opus 4.8 を業務に組み込んでいるチームにとって、Opus 5 への置き換えは追加コストゼロの性能向上候補になります。もう一つは Fable 5 との境界——これまで「最上位の Fable 5 でなければ精度が届かない」と判断していたタスクの一部が、半額の Opus 5 で届く可能性が出てきました。逆に、上位モデルの価格自体は 1 ドルも下がっていないので、「コストが見合わないから上位モデルは使わない」と判断していたタスクの前提は変わりません。

コーディング・エージェント運用への影響

Opus 5 はソフトウェアエンジニアリング・科学研究・ビジュアル出力に強みがあるとされ、コーディングと知識労働の評価(Frontier-Bench・GDPval-AA)で最高水準を主張しています。ここで実務上見るべきは絶対スコアそのものより、Anthropic が強調する「検証しながら反復して成功に至る能力」の強化です。

AI エージェントを使ったコーディング運用では、一発で正解を出すことより、実行結果を確認しながら軌道修正して最終的に成功に到達する能力の方が重要になる場面が多い、というのが私たちの実務上の感触です。長時間タスクや複数ステップのエージェント運用を任せる場面では、この「検証→修正の反復力」がモデル選定の実質的な判断材料になります。

もう一つ見落とせないのが、直近モデルの中で Claude の Constitution(憲法)への整合が最も強いという説明です。エージェントに裁量を持たせて業務を任せる組織にとって、モデルが定められた原則からどれだけ逸脱しにくいかは、軽視できない実務上の重みを持ちます。

モデルの使い分けをどう組み直すか

ここまでの内容を私たち自身の運用に引き寄せると、モデルを一つに固定するのではなく「タスクを誤った時のコスト(誤りコスト)に応じて階層を使い分ける」という発想そのものは変わりません。変わるのは階層の中身です。具体的には 3 つの立場で影響が異なります。Opus 4.8 を使っているチームは、同額なので置き換えの金銭的リスクがなく、自社タスクでの挙動検証だけ済ませれば移行を検討できます。Fable 5 を使っているタスクを持つチームは、ベンチマーク主張が実務でも再現するかを確かめた上で、一部を半額の Opus 5 に下ろせるかが検討点になります。Sonnet 系で足りているタスクは、上位モデルとの価格差の構図が変わっていない以上、急いで動かす理由はありません。

判断軸として持っておきたいのは次の 3 点です。第一に、上位モデルを使う基準を「絶対的な予算上限」でなく「タスクの誤りコストと性能要求」で引き直すこと。第二に、エージェントに長時間・多ステップの作業を任せる場面では、ベンチマークの見出し数値より検証・反復能力を優先して評価すること。第三に、Fable 5 のような最上位モデルと Opus 5 のような準上位モデルの使い分けは、コンテキストウィンドウや用途の違いも含めて個別に確認すること(Opus 5 自体のコンテキストウィンドウ長は今回の発表内容だけでは確認できていません)。

まとめ

Opus 4.8 の利用者には追加コストなしのアップグレード候補として、Fable 5 でなければ届かなかったタスクには半額の代替候補として、それぞれ検証する価値があります。ベンチマークの数字はいずれも Anthropic 自身の主張であり割り引いて見るべきですが、検証・反復能力の強化と価格据え置きという組み合わせは、上位 2 つの階層の使い分けを決め直す十分な材料です。判断の起点は「Opus 4.8 のままで足りているか、本当に Fable 5 でなければ届かないのか、それとも Opus 5 で十分になったのか」に置き換わります。

出典:

※ この記事は AI を使用しています。Leadeas が自社開発した AI エージェント基盤で下書きを作成し、人間のレビューを経て公開しています。AI ネイティブ開発会社として自社の技術をそのまま実演する目的で、この手法を用いています。(詳しくは AI 利用ポリシー)

AI

AI導入やシステム開発の ご相談を承っています。

お気軽にお問い合わせください