Claude Opus 5 徹底解説|Fable 5級の性能を半額で・ベンチ/料金/API変更を事実ベースで全整理
SINYBLOG — Claude Opus 5 徹底解説|Fable 5級の性能を半額で・ベンチ/料金/API変更を事実ベースで全整理

スポンサードリンク





Anthropic Official · 2026.07.24 Release

Claude Opus 5 は「最強クラスの性能を、半額で」

2026年7月24日、Anthropic が Claude Opus 5 を公開。目玉は派手な新機能ではなく「最上位 Fable 5 に迫る性能を、その半分の料金で」という一点です。しかも料金は前世代 Opus 4.8 に据え置き。事実だけを、どこよりもわかりやすく14章で整理します。読了目安 16分。

回の発表は「新しい看板モデルが出た」という話ではありません。Anthropic の最上位は依然 Fable 5 です。Opus 5 のニュース性は 「フロンティア級の知能を、半額で日常使いできるようにした」 こと。ここ2ヶ月で Mythos 5・Fable 5・Sonnet 5 に続く4本目のClaude 5系で、AI競争が「巨大発表」から「コスト・速度の連続改善」へ移ったことを象徴します[1][2]。本記事では公式発表を一次情報に、ベンチマーク・料金・API変更・注意点まで、盛らずに整理します。

  • 0%
    Fable 5 比のタスク単価(=半額)
  • 0M
    コンテキスト(100万トークン)
  • 0
    Fast mode の応答速度

user@sinyblog:~/article 01_digest.md90秒ダイジェスト:要点7つ

確定情報だけ先に並べます[1]

  1. 「Fable 5 級の性能を半額で」。Opus 5 は最上位 Fable 5 のフロンティア知能に迫りつつ、タスク単価は約半分。モデルID は claude-opus-5
  2. 料金は Opus 4.8 に据え置き。入力 $5 / 出力 $25(100万トークンあたり)。Fable 5($10 / $50)のちょうど半額。
  3. Claude Max の新デフォルトであり、Claude Pro での最強モデル。
  4. effort(努力度)ダイヤルで、コストと知能のバランスを自分で調整できる。
  5. Fast modeで約2.5倍速の応答(料金は2倍)。
  6. 知識カットオフは 2026年5月で、現行 Claude で最も新しい。
  7. 拒否時は自動フォールバック。安全策に引っかかると Opus 4.8 に自動で振り替えて、エラーで止めない。
この記事のスタンス

ベンチマーク数値は Anthropic 公式発表を一次情報として採用し、第三者計測(Artificial Analysis 等)は出典を分けています。公式値は「相対比較・コスト効率」で示されたものが多く、絶対スコアや他社モデルとの直接比較は限定的です。その注意点は第14章にまとめました。

user@sinyblog:~/article 02_position.mdOpus 5 の立ち位置:看板ではなく「実利枠」

まず誤解しやすい点を正します。Opus 5 は Anthropic の最上位モデルではありません。最上位は今も Fable 5(さらに限定提供の Mythos 5)です。Opus 5 の役割は「フロンティアの一歩手前の知能を、圧倒的に安く・速く配る」こと[3]

Anthropic 自身、長時間の自律作業が必要な高度案件には引き続き Fable 5 を推奨し、サイバーセキュリティや長期の自律研究では Mythos 5 が Opus 5 を上回る、と明言しています[5]。Opus 5 は「実務の8〜9割を、最上位の半額でこなす主力」と捉えるのが正確です。



2ヶ月で4本目のClaude 5
Mythos 5 → Fable 5 → Sonnet 5 → Opus 5。競争軸は「発表」から「コスト・速度」へ

user@sinyblog:~/article 03_spec.mdスペックを正確に押さえる

SNS で数字が揺れやすいので、公式・報道で確認できた仕様を一覧にします[1][6]

項目 Opus 4.8 Opus 5
モデルID claude-opus-4-8 claude-opus-5
コンテキスト 1,000,000 トークン 1,000,000 トークン
最大出力 128,000 トークン 128,000 トークン
料金(入力/出力・100万tok) $5 / $25 $5 / $25(据え置き)
思考(thinking) 明示指定が必要 既定でオン(adaptive)
キャッシュ最小プレフィックス 1,024 トークン 512 トークン
知識カットオフ 2026年1月 2026年5月
Fast mode 対応 対応(約2.5倍速)

user@sinyblog:~/article 04_pricing.md料金:据え置きで、Fable 5 の半額

今回いちばん実務に効くのは料金の据え置きです。Opus 5 は Opus 4.8 と同じ入力 $5 / 出力 $25(100万トークンあたり)。そして最上位 Fable 5 は $10 / $50 なので、Opus 5 はちょうど半額です[2]

モデル 入力($/1M) 出力($/1M) 位置づけ
Claude Fable 5 10.00 50.00 最上位(フロンティア)
Claude Opus 5 5.00 25.00 フロンティア一歩手前・主力
Claude Opus 4.8(前世代) 5.00 25.00 従来の主力 Opus

つまり「値段は据え置きのまま、中身が Fable 5 に迫るところまで上がった」というのが今回の本質。既存の Opus 4.8 ワークロードは、原則そのままの料金でアップグレードできる計算になります。

user@sinyblog:~/article 05_benchmarks.mdベンチマーク総覧(と、その読み方)

公式が挙げた主要スコアを整理します。ポイントは「絶対値」ではなく「コスト効率(同じ額でどれだけ強いか)」で示されていることです[1]

ベンチマーク 測るもの 公式の主張
Frontier-Bench v0.1 総合フロンティア能力 全モデルを上回り、Opus 4.8 の2倍超を低コストで
CursorBench 3.2 実務コーディング max effort 時に Fable 5 のピークと0.5%以内・半額
OSWorld 2.0 PC操作エージェント Fable 5 の結果を約1/3のコストで上回る
ARC-AGI 3 抽象推論 次点モデルの約3倍のスコア
Zapier AutomationBench 業務自動化 同コストで次点の約1.5倍の成功率
有機化学タスク 科学 Opus 4.8 比 +10.2 ポイント
タンパク質関連タスク 科学(生物) Opus 4.8 比 +7.7 ポイント

第三者計測の Artificial Analysis は、Opus 5 を総合知能でトップクラスと評価し、Fable 5 を約1ポイント上回ったと報じています[4]。ただしこれは特定指標での話で、Anthropic 自身は「高度案件は Fable 5 推奨」の姿勢を崩していません。数値は必ず「どの条件・どのコストで」を添えて読んでください(詳しくは第14章)。

user@sinyblog:~/article 06_effort.mdeffort ダイヤル:コストと知能を回して選ぶ

Fortune が「今回の目玉機能」と評したのが effort(努力度) の調整です[3]。タスクにどれだけ「考える力」を注ぐかを段階で選び、コストと知能のバランスを自分で決められます。

python— effort_example.py


# effort でコストと知能のバランスを選ぶ(値は low〜max の段階)
response = client.messages.create(
    model="claude-opus-5",
    max_tokens=64000,
    output_config={"effort": "high"},  # low / medium / high / xhigh / max
    messages=[{"role": "user", "content": "..."}],
)
# 既定は high。安く済ませたい定型処理は下げ、
# 難所は xhigh / max に上げる、という運用が推奨
effort は「思考の深さ」を制御。出力の長さを直接変えるものではない [6]
推奨の回し方

公式ガイダンスは「まず既定の high で自分の評価セットを測り、コスト削減なら下げ、複雑な推論なら xhigh / max へ上げる」。effort は思考の深さを変えるもので、回答の長さを変えるものではない点に注意。

user@sinyblog:~/article 07_fastmode.mdFast mode:2.5倍速・2倍料金

Opus 5 は Fast mode に対応します。通常の約2.5倍の速度で応答を生成する代わりに、料金は基本の2倍[2]。同じモデルの知能のまま、出力トークン毎秒だけを引き上げる仕組みです。

対話UIの体感速度が売上や離脱率に直結するプロダクト、あるいは待ち時間がコストになるインタラクティブ用途で効きます。逆に、バッチ処理や夜間のエージェント実行など「速さより単価」の場面では通常モードのままが合理的です。

user@sinyblog:~/article 08_cutoff.md知識カットオフ 2026年5月が効く

地味ですが実務で効くのが知識カットオフの更新です。Opus 5 は 2026年5月 で、現行 Claude の中で最も新しい。Opus 4.8(2026年1月)や Fable 5・Sonnet 5 より4ヶ月ぶん先まで素の知識に入っています[6]

直近のライブラリ更新やフレームワークの作法が最初から入っているぶん、RAG や検索グラウンディングで補っていた部分をそのぶん減らせます。「最新の話題に強い最上位モデルが Fable 5 ではなく Opus 5」という、少し逆転した状況になっています。

user@sinyblog:~/article 09_safety.md安全策の緩和と、自動フォールバック

今回の特徴的な変更が安全策まわりです。Opus 5 のセーフガードは Fable 5 より緩め に設定され、報道によれば介入率は Fable 5 比で約85%減とされています[4]。benign(無害)な作業が誤ってブロックされる「過剰拒否」を減らす狙いです。

同時に、サイバー攻撃・生物兵器関連には引き続きセーフガードがあり、引っかかったリクエストは自動的に Opus 4.8 へフォールバックされます。API がエラーで止まらず、より制限の適切なモデルへ振り替えて処理を続ける設計です[1]。Anthropic は Opus 5 を「Opus シリーズで最もアラインメントが高く、悪用に騙されにくいモデル」とも説明しています[7]

「緩和」の意味を取り違えない

緩んだのは過剰拒否(誤ブロック)であって、危険領域が開放されたわけではありません。サイバー・生物系の高リスク領域は依然ガードされ、そこは Opus 4.8 へ自動フォールバックします。

user@sinyblog:~/article 10_api.mdAPI の変更点(破壊的変更に注意)

開発者向けに、既存コードに影響する変更を押さえます[6]

  1. 思考(thinking)が既定でオンに。Opus 4.8 では明示指定が必要でしたが、Opus 5 は adaptive thinking が既定。max_tokens に思考ぶんの余裕を持たせないと出力が途中で切れることがあります。
  2. 破壊的変更:思考オフの制限。thinking: {"type": "disabled"} を effort xhigh / max と組み合わせると 400 エラー。高effort時は思考を切れません。
  3. キャッシュ最小が 1,024 → 512 トークンに。より短いプレフィックスからキャッシュが効くようになりました。
  4. 会話途中のツール変更でキャッシュが無効化されない。エージェントの「モード切替」でプロンプトキャッシュを保てます。
  5. 検証プロンプトは撤去推奨。「答えを検証して」「ダブルチェックして」の類は、Opus 5 が自己検証するため冗長になりがち。
diff— migration.diff


  config = {
-     "model": "claude-opus-4-8",
+     "model": "claude-opus-5",
      "output_config": {"effort": "xhigh"},
-     "thinking": {"type": "disabled"},  # xhigh と併用は 400 になる
      "max_tokens": 64000,               # 思考ぶんの余裕を確保
  }
Opus 4.8 → Opus 5 の典型的な書き換え [6]

user@sinyblog:~/article 11_strengths.md得意分野:科学・生物・エージェント

公式が強調するのは、単発の賢さより「自分で検証し、失敗から立て直す」自律性です。以前より人間との往復が減り、作業を自己修正しながら進める、と説明されています[3]

  1. 科学研究:一般提供モデルとして「最も科学研究に強い」と位置づけ。有機化学で Opus 4.8 比 +10.2pt。
  2. 生物(バイオ):タンパク質関連タスクで +7.7pt。生物分野の伸びが目立つ。
  3. エージェント・業務自動化:OSWorld 2.0(PC操作)や Zapier AutomationBench で、同コスト帯の他モデルを上回る。
  4. コーディング:CursorBench 3.2 で max effort 時に Fable 5 のピークと0.5%以内。

法律事務所やソフトウェア開発チームの事例が発表に添えられており、Anthropic が狙う「実務のエンタープライズ利用」の輪郭がはっきり出ています[3]

user@sinyblog:~/article 12_channels.mdどこで使える?提供チャネル

発表と同時にほぼ全チャネルで利用可能です[1]

チャネル Opus 5
Claude.ai(web/アプリ)
Claude Code
Claude Cowork
Claude API ◯(claude-opus-5
Claude Max ◯(新デフォルトモデル)
Claude Pro ◯(最強モデルとして選択可)

一般提供にあたってはデータ保持要件がありません(Fable 5 は30日保持が必要)。ここも Fable 5 から Opus 5 へ寄せやすい実務上の利点です[1]

user@sinyblog:~/article 13_which.mdFable 5 / Sonnet 5 との使い分け

「どれを使うか」を1枚に整理します。Opus 5 の登場で、多くのケースが Opus 5 に集約されます。

やりたいこと 推奨 理由
実務の大半(コーディング・調査・エージェント) Opus 5 フロンティア近い性能を半額で。コスパの重心
最難関・長時間の自律作業 Fable 5 Anthropic 自身が高度案件で推奨
サイバーセキュリティ・長期自律研究 Mythos 5 これらの領域で Opus 5 を上回る(限定提供)
大量・低レイテンシの定型処理 Sonnet 5 十分な性能なら Opus 5 へ上げるコスト動機は薄い
対話UIの体感速度が重要 Opus 5 + Fast mode 2.5倍速。料金2倍とのトレードオフ

現実解は「入口を Sonnet 5、主力を Opus 5、最難関だけ Fable 5」の三段構え。今回の値付けで、その中段が一気に強くなりました。

user@sinyblog:~/article 14_caveats.md誇張を避けるための注意(重要)

「事実ベースで」読むために、公式ベンチマークの限界を明記しておきます。ここを飛ばすと数字に踊らされます[6]

  1. 「2倍」は絶対値ではない。多くが Opus 4.8 比の相対値で、絶対スコアは非開示のものがある。
  2. 比較対象が入れ替わる。ある指標では Opus 4.8、別では「次点モデル」、また別では Fable 5、と基準が動く。
  3. 好条件が前提のものがある。CursorBench の「0.5%以内」は max effort 前提。
  4. 他社モデルは名指しされない。公式発表からは GPT / Gemini との直接比較はできない。
結局、どう判断するか

ベンチ表よりも、自分のワークロードで「1タスクあたりの実コストと品質」を Opus 4.8 / Opus 5 で並べて測るのが最も確実。料金据え置きなので、まず既定 high で乗り換えて実測するのが低リスクです。

user@sinyblog:~/article 99_summary.mdまとめ

Claude Opus 5 は「最強を更新したモデル」ではなく「フロンティア級の実力を、半額で日常に降ろしたモデル」です。派手さより実利。エージェントを本番で回している人ほど効きます。

  1. 半額で Fable 5 級。料金は Opus 4.8 据え置き($5 / $25)、性能は最上位に接近。
  2. effort ダイヤルと Fast modeで、コスト・知能・速度を自分で調整できる。
  3. 移行には手当てが必要。思考が既定オン、高effort時は思考オフ不可、max_tokens に余裕を。

まずやることは1つ——Opus 4.8 のワークロードを、料金据え置きのまま Opus 5・既定 high で流して実測する。数字の主張に頼らず、自分のタスクでの実コストと品質で判断すれば、乗り換えの是非は明快になります。

本記事は Anthropic 公式発表を一次情報とし、海外・国内テックメディア(Fortune / VentureBeat / TechCrunch / Axios / ITmedia / GIGAZINE / ASCII.jp 等)および解説記事を Claude Code で精読・整理 したうえで、運営者(現役 IT エンジニア・15年以上の業界経験)が編集・構成しています。ベンチマークおよび料金は 2026年7月27日時点の公開情報に基づき、公式ベンチは相対比較・コスト効率で示されたものが多いため、導入判断は必ずご自身のワークロードでの検証と併せて行ってください。最新情報は Anthropic 公式発表 をご確認ください。

おすすめの記事