Claude Opus 5が公開、最上位に迫る性能を半額で提供

Claude Opus 5が公開、最上位に迫る性能を半額で提供

こんにちは!AIフル装備 powered by みらいラボのモモです。

AIモデルの話題は、これまで「どこまで賢くなったか」に集まりがちでした。ところが2026年に入ってからの競争軸は、同じ賢さをどれだけ安く、どれだけ扱いやすく届けられるかへと移りつつあります。

そうした流れのなかで、Anthropicが2026年7月24日にClaude Opus 5を公開しました。価格は入力100万トークンあたり5ドル、出力100万トークンあたり25ドルで、前世代のClaude Opus 4.8から据え置かれています。

今回の目玉は、値段の据え置きだけではありません。応答にどれだけ考える時間を使うかを利用者側が5段階で指定できる「effort(努力度)」の考え方が、これまで以上に前面へ出てきました。

この記事では、Claude Opus 5で何が変わったのか、従来モデルや競合とどう違うのか、そして実務で使うときにどこを見ておくべきかを順番に整理します。読み終えたときに、自分の用途で採用すべきかどうかを判断できる状態を目指します。

AIブログ4コマ漫画 - Claude Opus 5が公開、最上位に迫る性能を半額で提供
目次

Claude Opus 5で何が変わったのか

まずは発表の骨格を押さえます。Claude Opus 5は、Anthropicの最上位モデルであるClaude Fable 5に迫る性能を、その半額の価格帯で提供することを狙ったモデルです。

Anthropicは今回のモデルを、前世代からの小幅な改良ではなく非連続な飛躍だと説明しています。特に伸びた領域として挙げているのは、長い手順を伴う推論、エージェント型のコーディング、そして計算量を増やすほど結果が良くなる性質です。

同時に、実務で使うための細かな仕様も更新されました。プロンプトキャッシュの最小長やツール定義の扱いなど、地味ながら運用コストに効く部分に手が入っています。

価格を据え置いたまま性能を引き上げた

価格面の話はわかりやすい構図です。Claude Opus 5の標準料金は入力5ドル、出力25ドル(いずれも100万トークンあたり)で、Claude Opus 4.8と同額に据え置かれました。

一方で最上位のClaude Fable 5は入力10ドル、出力50ドルです。つまり同じ処理をOpus 5に寄せれば、単価だけを見ればちょうど半分になります。

Anthropicが公表したベンチマークでは、コーディング支援を評価するCursorBench 3.2において、最大の努力度設定でFable 5の最高スコアの0.5%以内に収まったとされています。半額の価格帯で最上位に肉薄したという主張が、今回の発表の中心にあります。

Frontier-Bench v0.1でも、1件あたりのコストはより低い条件でOpus 4.8の2倍以上のスコアを出したと説明されています。世代がひとつ進んだだけの改良にしては、示された伸び幅は大きいと言えます。

提供先はAPIから主要クラウドまで広い

使える場所も最初から広く用意されました。Claude APIではclaude-opus-5というモデルIDで提供され、Amazon Bedrock、Google Cloud、Microsoft Foundryでも利用できます。

一般の利用者向けにも、Claude.ai、Claude Code、Claude Coworkで提供されています。開発者が試す場所と業務で使う場所が分断されにくい構成になっています。

ただし高速版の「fast mode」は例外です。研究プレビューとしてClaude APIでのみ提供され、Amazon BedrockやGoogle Cloud、Microsoft Foundry経由では現時点で使えません。

このfast modeは、出力の速度を最大2.5倍まで引き上げる代わりに料金が2倍になる仕組みで、Claude Opus 4.8でも同じ条件で使えます。利用には申し込みが必要なうえ、Batch APIや優先処理の契約とは併用できない制約もあります。

現行モデルの価格と仕様を並べると、Opus 5がどの位置に置かれたのかが見えてきます。

主要Claudeモデルの価格と仕様(2026年7月時点)

モデル入力(100万トークン)出力(100万トークン)コンテキスト最大出力
Claude Fable 510ドル50ドル100万トークン12万8千トークン
Claude Opus 55ドル25ドル100万トークン12万8千トークン
Claude Sonnet 53ドル15ドル100万トークン12万8千トークン
Claude Haiku 4.51ドル5ドル20万トークン6万4千トークン

なおClaude Sonnet 5には、2026年8月31日までの導入価格として入力2ドル、出力10ドルが適用されます。上位から下位まで選択肢が揃い、用途に応じた置き場所を決めやすくなりました。

「思考の深さ」を選ぶ新しい使い方

今回いちばん実務に効くのは、思考量の制御がはっきりしたことです。Claude Opus 5では推論が既定でオンになり、その深さをeffortという設定で選びます。

effortは低いほど速く安く、高いほど時間とトークンを使って深く考えます。用途ごとに切り替えれば、モデルを変えずに費用と品質のバランスを調整できます。

Anthropicは、Opus 5がこれまでのOpusよりも「努力度を上げた分を結果の良さに変換しやすい」と説明しています。設定を上げる意味が以前より大きくなった、という位置づけです。

effortは5段階、既定は「high」

選べる段階はlow、medium、high、xhigh、maxの5つです。Claude APIとClaude Codeでの既定値はhighで、明示しなければこの水準で動きます。

推奨されている進め方は、まず既定のhighから始めて、自分の評価結果を見ながら上下に動かすことです。品質が落ちないところは下げてトークンと待ち時間を節約し、難しい仕事だけ上げます。

xhighやmaxで動かすときは、max_tokensを大きめに取る必要があります。サブエージェントやツール呼び出しをまたいで考える余地を残しておかないと、作業の途中で上限に当たってしまうためです。

推論が既定でオンになった影響

Claude Opus 4.8では、明示的に指定しない限り推論なしで動いていました。Claude Opus 5では同じリクエストでも推論が入るため、出力トークンの内訳が変わります。

max_tokensは推論と応答文を合わせた出力全体の上限です。旧モデル向けの小さい設定をそのまま持ち込むと、応答が途中で切れる可能性があります。

応答が返るまでの時間にも影響します。考える工程が入る分だけ待ち時間は伸びるので、すぐ返ってくることを前提にした画面や通知の設計は見直しが要ります。

移行作業そのものは重くありませんが、確認しておくべき順番はあります。次の手順をひととおり通しておくと、想定外の挙動を減らせます。

  1. モデルIDをclaude-opus-4-8からclaude-opus-5へ差し替える
  2. 推論が既定でオンになる前提でmax_tokensを見直す
  3. 既定のhighのまま評価を回し、用途ごとに上下の段階を検討する
  4. 推論を無効にしている処理があれば、effortをhigh以下に揃える
  5. 旧モデル向けに書いた「最後に検証を入れる」といった指示を削除する

従来モデルとの違いと移行時の注意

移行そのものは、モデルIDを書き換えるところから始められます。ただし挙動の前提が変わっているため、そのまま動かして同じ結果になるとは限りません。

Anthropicが明示しているのは、推論が既定でオンになったことと、推論を無効にできる条件が変わったことの2点です。どちらもコード側の前提を壊す可能性があります。

加えて、細かな仕様の改善もいくつか入りました。運用コストや実装の手間に効く部分なので、移行のタイミングでまとめて確認しておく価値があります。

Opus 4.8から変わった仕様

変更点は数が多いわけではありませんが、影響する範囲は広めです。表にすると、どこを触ればよいかが整理しやすくなります。

Claude Opus 4.8とClaude Opus 5の主な違い

項目Claude Opus 4.8Claude Opus 5
推論(thinking)明示指定しない限りオフ既定でオン
推論の無効化努力度と無関係に可能effortがhigh以下のときのみ可能
知識のカットオフ2026年1月2026年5月
プロンプトキャッシュ最小長1,024トークン512トークン
会話途中のツール変更不可(最初に固定した一覧を送り続ける)ベータ機能として可能

プロンプトキャッシュの最小長が半分になった点は、短い指示を繰り返す用途で効いてきます。これまで長さが足りずキャッシュできなかった指示が、コードを変えずに対象へ入るためです。

会話の途中でツールの定義を足したり外したりできるベータ機能も追加されました。従来はセッションの最初に固定した一覧を送り続ける必要があり、構成を変えるとキャッシュが無効になっていた部分です。

見落とされがちですが、知識のカットオフも更新されています。Claude Opus 5は2026年5月時点までの知識が最も確からしいとされ、Opus 4.8や最上位のFable 5の2026年1月より新しい情報を持っています。

拒否されたときに使う代替モデルの指定にも、推奨構成をそのまま適用する新しいモードがベータで加わりました。自前でモデルの一覧を管理しなくてよくなるため、運用の手間を減らしたい場面で効いてきます。

一方で、これまで通っていた書き方が通らなくなる箇所もあります。移行の前に、次の点へ当てはまる実装がないかを確認しておくと安全です。

  • effortがxhighまたはmaxのまま推論を無効化する指定は400エラーになる
  • 推論なしを前提にした小さいmax_tokensをそのまま使い回すこと
  • 「最後に検証ステップを入れる」といった旧モデル向けの検証指示を残すこと
  • 1,024トークン未満はキャッシュできないという前提のままの実装

出力の癖が変わった点

コードを変えなくても気づく違いもあります。既定の応答や成果物は以前より長めになり、エージェントとして動くときは進捗を伝える頻度が増えました。

複数のエージェントを組み合わせる構成では、サブエージェントへ仕事を任せる場面が増えています。自分の作業を指示なしで検証するようにもなったため、旧来の検証指示を残すと確認を過剰に繰り返す原因になります。

こうした癖の変化は、ベンチマークの数字には表れにくい部分です。移行の直後は出力の長さや手順の踏み方を一度見比べて、プロンプト側を整えるのが実践的です。

利用者と企業への影響

今回の変更は、価格表の数字以上に運用設計へ効いてきます。同じモデルのまま、仕事の重さに応じて費用と品質を選べるようになったためです。

これまでは、軽い処理には小さいモデル、重い処理には大きいモデルという分け方が基本でした。effortを使えば、モデルを分けずに1つの窓口で両方をまかなえます。

一方で、既定で推論が入る以上、何も考えずに移行するとトークン消費が増える場面もあります。コスト管理の観点では、初期値を決めてから社内へ広げるのが安全です。

コスト設計の自由度が上がる

Anthropicによれば、lowやmediumでもトークンと待ち時間を大きく減らしながら十分な品質が出るとされています。定型的な処理を下の段階へ寄せられれば、実効単価は表の価格よりも下がります。

逆に、失敗したときの手戻りが大きい作業だけをmaxに寄せる運用も現実的です。全体を一律の設定で回すより、投入する計算量を仕事の重さへ合わせるほうが無駄が出にくくなります。

社内で使う場合は、どの業務をどの段階で回すかをあらかじめ決めておくと運用が安定します。設定を各自の裁量に任せると、費用も品質もばらつきやすくなるためです。

たとえば、定型の下書き作成や分類はlowから試し、仕様の検討や設計レビューはhighより上に置く、といった割り当てが考えられます。実際の線引きは業務ごとに違うので、まずは数件で試してから広げるのが安全です。

競合との比較で見える立ち位置

価格で見ると、Opus 5の入力5ドルは最上位のFable 5の半額で、中位のSonnet 5の3ドルよりは上です。性能面では、Anthropicが複数の指標でFable 5に迫るか上回ると主張しています。

発表では、エージェント運用を評価するZapier AutomationBenchで、1件あたりのコストを同じにそろえた条件で次点モデルの約1.5倍の達成率だったとされています。パソコン操作を評価するOSWorld 2.0では、Fable 5の最高結果を3分の1をやや上回る程度のコストで超えたと説明されました。

科学分野の伸びも示されました。有機化学の課題ではOpus 4.8より10.2ポイント、タンパク質に関する課題では7.7ポイント高い結果だったとされ、研究用途での比較材料になります。

抽象推論を測るARC-AGI 3では、次点モデルの3倍というスコアも示されています。ただし、こうしたベンチマークの顔ぶれ自体が発表側の選定によるものだという前提は忘れないほうがよさそうです。

注意したいのは、これらがいずれも開発元であるAnthropic自身の公表値だという点です。第三者の検証や実務での再現を確認してから判断するほうが妥当です。

  • ベンチマークの数値は開発元の公表値であり、独立した検証は別途必要になる
  • 推論が既定でオンになるため、移行の直後は想定より費用が増える場合がある
  • fast modeはClaude APIのみで、主要クラウド経由では現時点で利用できない
  • Claude Opus 4.1は2026年8月5日に提供終了予定のため、旧環境は早めの移行が必要

今後どこを見るべきか

ここからの焦点は、半額のモデルでどこまで置き換わるかです。最上位を使い続ける必要がある仕事と、Opus 5で足りる仕事の線引きが、実利用のなかで見えてきます。

もう1つは競合の値付けです。同等の性能をより安く出す動きが続けば、価格はさらに動く可能性があります。

そして、長時間動くエージェント運用の実務がどう変わるかです。安定性はベンチマークよりも、現場からの利用報告に表れます。

価格競争と性能競争の行方

2026年に入ってからのモデル更新は、値下げと高性能化が同時に進む形が続いています。今回のOpus 5も、価格を据え置いたまま性能を引き上げるという同じ流れの上にあります。

利用者から見れば、選択肢が増えるのは歓迎すべき状況です。ただし更新の間隔が短いため、評価の仕組みを持たないと乗り換えの判断が感覚的になりがちです。

自社の代表的な業務をいくつか固定した評価セットにしておくと、新しいモデルが出るたびに同じ物差しで比べられます。今回のようにeffortという軸が増えた場合も、比較にかかる手間を抑えられます。

エージェント運用の実務が変わるか

長い作業を任せる使い方では、途中で仕事を投げ出さないことが価値になります。Anthropicは、複数ファイルにまたがる機能追加や大きめのリファクタリングを、未完成の部分を残さずに仕上げられる点を強調しています。

100万トークンのコンテキストと12万8千トークンの最大出力は、そうした長い仕事を前提にした設計です。実際にどこまで安定するかは、これから出てくる利用報告が判断材料になります。

コード審査やバグ発見の精度が上がったという説明も、実務では見逃せません。人が最終確認をする前提であっても、指摘の的中率が上がれば確認そのものの負担が軽くなります。

まとめ

Anthropicは2026年7月24日にClaude Opus 5を公開しました。価格は入力5ドル、出力25ドル(100万トークンあたり)で前世代から据え置かれ、最上位のClaude Fable 5の半額という位置づけになっています。

今回の発表で重要なのは、値段よりも使い方の設計が変わったことです。推論が既定でオンになり、効率設定を上げた分が結果へ反映されやすくなったため、同じモデルのまま費用と品質を用途へ合わせて調整する意味が大きくなりました。

今後の注目点は3つあります。半額のモデルがどこまで最上位を置き換えるのか、競合がどう値付けを動かすのか、そして長時間のエージェント運用で本当に安定するのかです。

私としては、今回の更新は「賢さの上限」より「賢さの配分」を扱う段階に入った合図だと受け止めています。設定を試すこと自体は簡単ですが、効果を測る物差しを持たないまま数値だけを動かすと、費用も品質も感覚頼みになってしまいます。

だからこそ読者のみなさんには、まず自社の代表的な業務を数件そろえた評価セットを用意することをおすすめします。そのうえで既定のhighを基準に上下を比べていけば、次のモデルが出たときも同じ物差しで判断でき、乗り換えの是非を落ち着いて見極められるはずです。

参考サイトまとめ

よかったらシェアしてね!
  • URLをコピーしました!
  • URLをコピーしました!
Random Image

コメント

コメントする

目次