Claude Opus 5の要点整理: 料金据え置きで上位半額、effortは5段階、移行時は400エラーに注意

#claude#anthropic#llm#api#ai

2026年7月24日、Anthropic が Claude Opus 5 を公開しました。料金は前世代の Opus 4.8 と同額のまま、最上位モデル Fable 5 のちょうど半額という位置づけです。

同じ日に effort という5段階の設定と移行ガイドも公開されており、単なる新モデルの追加ではなく「同じ予算で使えるものが入れ替わった」発表になっています。

この記事では、料金と仕様、effort の使い方、移行でつまずく非互換3点、4モデルの使い分けまでを、動画を見ていない方にも分かる形で整理します。

https://youtu.be/rkhlyG78j6A

7月24日に出たのは3点セット

公開されたのはモデル本体だけではありません。1つ目がモデル本体、2つ目が effort パラメータの公式ドキュメント、3つ目が移行ガイドで、この3つが同じ日に揃いました。移行ガイドには後述する非互換が3点まとまっています。3点が同じ日に出たのは、移行までの道筋を一度に示したかったからだと考えられます。

期限も1つ設定されています。2世代前の Opus 4.1 が2026年8月5日に提供終了予定です。前世代の 4.8 は継続するため、急いで対応が必要なのは 4.1 を本番で使っているケースだけです。

値段そのままで中身が入れ替わった

料金は公式の料金表で確認できます。入力が100万トークンあたり5ドル、出力が25ドル。Opus 4.8 と同額で、最上位の Fable 5(入力10ドル / 出力50ドル)のちょうど半額です。コンテキストは100万トークン、最大出力は12万8千トークンです。

位置づけの変化が今回の中心です。公式ドキュメントは「複雑なコーディングと企業の業務はまず Opus 5 から」と案内しており、最上位ではなく半額のモデルが事実上の推奨既定になりました。

性能については、社内ベンチマークで 4.8 の2倍以上、コーディングのテストでは max 設定時に最上位との差が0.5%以内とされています。ただし、これらの数値はすべて Anthropic 自身の測定値だと公式に明記されています。中立の第三者による測定ではない点は押さえておく必要があります。

見落とされやすいのが知識の新しさです。公式の比較表では、Opus 5 の知識カットオフは2026年5月。上位の Fable 5 は2026年1月で、逆転しています。新しめのライブラリを扱う仕事なら、安いほうが当たる場面があります。

なお、SWE-bench Verified で96〜97%という数値や、パラメータ数のオープンウェイト公開という話も出回っていますが、公式発表にもドキュメントにも記載が見つかりませんでした。この記事でも事実としては扱いません。

effort — 賢さと料金を5段階で決める

effort は、1回の返答にトークンをどれだけ使うかを指定する設定です。公式ドキュメントでは low / medium / high / xhigh / max の5段階で、Opus 5 はすべてに対応します。既定は high で、high と明示するのと省略するのは同じ挙動です。

効き方には癖があります。効くのは思考部分だけではなく、応答の文章もツール呼び出しの回数も含めた全トークンです。つまり effort を下げると、単に考える量が減るだけでなく、作業の進め方自体が変わります。

公式の推奨は、コーディングとエージェント用途は xhigh から、それ以外の知的作業は high から。low と medium は前世代の Opus より強くなったため、料金と時間の調整に積極的に使ってよいとされています。

注意点も同じページにあります。

Claude Code からも使えます。手元のバージョン 2.1.219 では、起動時に claude --effort xhigh のように指定でき、設定ファイルの effortLevel で既定化もできました。なお、メニューにある ultracode は6つ目の段階ではなく、xhigh に複数エージェントの常時許可を足したものだと公式ドキュメントに記載があります。

移行の非互換3つと400エラー

モデル名の書き換えだけでは移行できません。移行ガイドに非互換が3点並んでいます。

1つ目、思考(thinking)が既定で有効になりました。ここで効いてくるのが max_tokens の意味の変化で、思考と応答文の合計に対する上限になっています。思考なしの前提で切り詰めていると、エラーは出ないのに答えが途中で切れます。

2つ目、thinking を無効化できる条件が付きました。effort が high 以下なら従来どおり切れますが、xhigh か max と組み合わせると 400 エラーで拒否されます。

3つ目、budget_tokens が非対応になりました。思考量をトークン数で直接指定する書き方は使えず、effort に一本化されています。残っていると 400 エラーです。

プロンプト側の変更も2つ案内されています。Opus 5 は 4.8 より説明が長くなる傾向があるため、簡潔さが必要なら明示的に指示すること。そして「検証してから答えて」という指示は削除が推奨されています。自分で検証するようになったためです。

安全側の挙動も変わりました。危険な要求を断る際は stop_reason に refusal が返り、cyber や bio といった分類が付きます。fallbacks を default にしておくと、拒否された要求を別モデルで自動再実行できます(ベータ機能)。

このほか Priority Tier とプリフィルが非対応、トークナイザは 4.8 と同じ、といった細かい差分もあります。8月5日の Opus 4.1 終了を控えているなら、今週が設定の棚卸しのタイミングです。

4モデル比較: どれをどう使うか

Opus 5 Fable 5 Opus 4.8 Mythos 5
料金(入/出 100万トークン) $5 / $25 $10 / $50 $5 / $25 Fable 5 と同額
位置づけ エージェントの既定 最上位 前世代(同額) 防御セキュリティ専用
入手方法 通常の API 通常の API Opus 5 へ移行推奨 招待制・窓口なし

Mythos 5 だけ性格が違い、防御セキュリティ向けの招待制で、申し込む窓口はないと公式ドキュメントにあります。セキュリティ面では、脆弱性を見つける力は同等でも攻撃コードを組み立てる力は大きく劣ると、公式発表自身が書いています。

段階指定の仕組みは Anthropic だけのものではありません。OpenAI には reasoning effort が none から max まで7段階あり、Google の Gemini 3系にも thinking_level があります。ただし段階の数も既定値も揃っていないため、他社へ移植するときは名前ではなく評価セットでの挙動で合わせる必要があります。

半額のモデルを既定に据えた理由は、エージェントを長時間回す前提だからだと考えられます。長く回すほどトークンは積み上がるので、単価が半分なら同じ予算で倍の時間を回せます(ここは動画での解釈です)。

よくある誤解5つと、この先の読み

この先の読みも1つ。3社とも段階指定を持っている以上、次の競争は「段階をユーザーが選ぶ」から「タスクの難しさを見てモデル側が自動で決める」へ移ると見ています。2026年末までにどの主要ベンダーも自動選択を出さなければ、この読みは外れです。

全体を貫く見方は1つです。今日はモデルを選び直す日ではなく、effort を決めて移行する日です。

出典


移行チェックリストや effort の決め方は、動画では図解つきで順に確認できます。

https://youtu.be/rkhlyG78j6A

このチャンネルでは平日と土曜に各テーマの週次まとめを、大きな発表があった日はこうした特集を出しています。よければ動画のほうもどうぞ。