Claude Sonnet 5.5は単価据え置きで最大3割安い理由と、Opus 5.5のeffort設定

· 水曜 Anthropic 週次 #claude#anthropic#llm#ai#sonnet

この記事の要点

Claude Sonnet 5.5 の「最大3割安い」は単価ではなくトークン量の話。Opus 5.5 の effort 設定、両モデルの比較、今週の Anthropic 12本を整理します。

今週(9/28〜10/4)の Anthropic 関連は12本ありました。中心は、9月28日に公開された Claude Sonnet 5.5 と、Opus 5.5 の使いこなしを説明した公式ドキュメントです。 Sonnet 5.5 の「1件あたり最大3割安い」は、単価の値下げではありません。使うトークンが減った分だけ安くなる、という話です。Opus 5.5 は effort の既定値が変わっていて、Opus 5 の頃の設定を持ち込むと返事が長く高くなります。

https://youtu.be/CZQbZ6WJFdU

今週の地図: 12本のうち、手元に効くもの

詳しく見るのは、Sonnet 5.5 と Opus 5.5 の使いこなしの2本です。使いこなしの記事(claude.dev)の公開は9月22日ですが、今週 Hacker News の上位に入ったので扱っています。

先に確認しておきたいのは、9月29日の障害です。公式の障害ページによると、14:00〜14:59 UTC(日本時間では23時台)に、claude.ai、Claude Code、Claude Cowork、Claude API でエラーが増えました。その間に送ったメッセージは、保存されていない場合があります。夜間に自動処理を回している人は、その時間帯の結果が残っているかを見ておくと安心です。

Sonnet 5.5: 単価は同じ、減るのは使う量

リリースノートでは、Sonnet 5.5 は Opus 5.5 より速くて安い相棒、という位置づけです。単価は Sonnet 5 と同じで、100万トークンあたり入力 $2、出力 $10。キャッシュ読み出しの $0.20 も同額です。

それでも1件あたりが安くなるのは、同じ仕事を少ないトークンで終えるからです。公式ページの書き方は「自社のテストで最大3割」なので、すべての仕事で3割安くなるわけではありません。出力の速さは Sonnet 5 より3割以上速い、とも書かれています。

性能面で伸びが大きいのはターミナル操作の試験です。Terminal-Bench 4.0 は 10.3% から 70.6% になりました。ただし、これは公式ページの自己申告で、前のモデルと試験条件が同じかどうかは今回確認できていません。OSWorld 2.1(部分点)は 57.0% から 80.1%、CursorBench 4.0 は 34.1% から 55.5% と、ほかの試験でも伸びています。

切り替えの前に、公式ページにある注意が2つあります。

試す手順は次の3つです。

  1. いま Sonnet 5 で回している処理を1本選ぶ
  2. 同じ入力のまま、モデル指定を claude-sonnet-5-5 に替える
  3. 1件あたりのトークン数と結果を並べる

結果が崩れたら、指定を Sonnet 5 に戻します。まず1本から段階的に移すのが安全です。

Opus 5.5: 遅くて高い3つの原因

公式ドキュメント(Prompting Claude Opus 5.5)と claude.dev の記事は、Opus 5.5 に替えたのに遅くて高い場合の原因を、次の3つに整理しています。

原因1: effort の既定が変わった

effort は、どれだけ考えるかを決めるつまみです。Opus 5.5 の既定は medium、Opus 5 の既定は high でした。Anthropic の試験では、5.5 の medium が Opus 5 の high に並ぶか上回ります。そのため、Opus 5 の頃の high をそのまま使うと、考えすぎて長く高くなります。

手順は、medium を明示したうえで、low と high を自分の評価で比べることです。注意点が2つあります。会話の途中で effort を変えるとキャッシュが効かなくなります。1通だけ変えたいときは、メッセージ単位の指定(ベータ)を使います。xhigh や max は、品質が上がると測れた仕事だけに使うのが無難です。

原因2: 「よく考えて」の指示

Opus 5.5 は常に考えてから答えます。そのため、「よく考えて」「順を追って考えて」という指示は消してください。消すと返事が早く始まった、と公式の試験結果にあります。

API で thinking を無効にしていた人は要注意です。Opus 5.5 では無効にできません。公式は、effort の low から測ることを勧めています。

原因3: 長い作業が途中で止まる

Opus 5.5 は、作業の途中で進み具合を報告します。その報告を完了と見なす仕組みだと、そこで止まります。対策は、やることリストをファイルに持たせ、残りがあれば続きを促すことです。

ただし、自動の催促は2〜3回までにします。それで動かなければ、人が見るべき詰まりです。書き込みは作業フォルダに限り、実行ログも残しておくと、後から追えます。

fast モードにも注意が必要です。品質は同じで速くなりますが、API では Opus 5.5 の単価が入力 $8、出力 $40 と通常の2倍になります(公式価格表)。Claude Code の /fast は追加の利用枠の有効化が必要で、トークン費用が上がります(claude.dev)。

Sonnet 5 / Sonnet 5.5 / Opus 5.5 を同じ表で比べる

2026年10月時点の公式価格表と、公式ページの自己申告スコアを並べます。

GDPval-AA では Sonnet 5.5 と Opus 5.5 は2点差ですが、FrontierCode では 8.2 ポイント離れます。しかも Sonnet 側の 46.2% は effort を最大にしたときの数字です。「半額で2点差」という見出しは、幅広い実務の話に限られます。

価格差も、いつも2倍とは限りません。次は自前の概算です。

キャッシュ読み出しが同額なので、キャッシュをよく使う処理ほど差は縮みます。公式も、Opus は慎重な判断が要る複雑な仕事、Sonnet は範囲の決まった日常の仕事という書き方をしています。ここからは動画の話者の読みですが、日常の主力は Sonnet 5.5、詰まった難所だけ Opus 5.5 に回す形が合理的に見えます。

残りのニュースと、見出しまでしか確認できなかったもの

本文を確認できなかったものや、設定の変更が要らない研究の読み物などは外しています。

出典

詳細は動画で

数字の出どころの区別や、スライドでの比較表は動画にまとめています。毎週の更新を追いたい方は、動画ページからフォローしてください。

https://youtu.be/CZQbZ6WJFdU