Fable 5.1で1Mが200Kのまま動く落とし穴とClaude Codeのキャッシュ40倍差

· 月曜 Claude Code 週次 #claudecode#fable#promptcaching#llm#ai

この記事の要点

Claude Code v2.1.257〜v2.1.275の8リリースから、Fable 5.1で1Mが効かない条件、キャッシュ修正11行と40倍差、個人向け4点を整理します。

Claude Code の v2.1.257〜v2.1.275(2026年9月、全8リリース)の変更を、動画を見ていない方にも伝わるようにまとめた記事です。 既定モデルが Fable 5.1 に変わりましたが、1M トークンのコンテキストは、切り替えるだけでは付いてこないことがあります。 あわせて、プロンプトキャッシュの修正が v2.1.267 に11行集中した件と、1人で使う人が3分で入れられる4点を扱います。

動画 URL

https://youtu.be/YlQRC7eQMp8

Fable 5.1 が既定になった。ただし 1M は選び直しが必要

新しい既定モデルは claude-fable-5-1 で、コンテキストは1Mトークンです。価格は100万トークンあたり、入力10ドル、出力50ドル、キャッシュ読み0.25ドル。この3つの数字は v2.1.257 のリリースノートに載っている値です。

ところが、Fable 5.1 に切り替えても1Mにならない条件が3つあります。

条件1: ゲートウェイ経由のセッション

ゲートウェイは、会社が社員の接続をまとめる中継サーバーのことです。この経路では、fable や best という指定が当面 Fable 5 のまま解決されます。1M を使いたい場合は、/model で Fable 5.1 を明示的に選び直します。

条件2: 環境変数でモデルを固定している場合

1M を指定するタグを付けてモデルを固定していても、model: fable と書いたエージェントではそのタグが無視されていました。エラーも警告も出ないまま、200K のコンテキストで動いていたことになります。この不具合は v2.1.260 で修正されました。1M のつもりで使っていた方は、まず更新してください。

条件3: Pro / Team では使用クレジットが要る

Pro と Team では、1M コンテキストに使用クレジットが必要だという案内があります。長い文脈で429が出たときに、この案内が正しく表示されない不具合が v2.1.268 で直りました。クレジットを途中で有効にしても、Claude Code を再起動するまで反映されません。

月額プランの金額がいくら増えるのかは、リリースノートに記載がないため未確認です。各自の請求画面で確認してください。Bedrock / Vertex AI / Foundry 経由の課金条件も、公開情報からは確認できていません。契約内容を見てください。

確認の手順

手順は3つです。

  1. v2.1.260 以降に更新する
  2. /model claude-fable-5-1 で Fable 5.1 を選ぶ
  3. /cost で確認する

コマンドは2つなので、1分ほどで終わる想定です。1M は、選び直して初めて付いてくる。これが最初の結論です。

キャッシュ修正11行と40倍差

入力が10ドル、キャッシュ読みが0.25ドルなので、割ると40倍です。同じ会話の同じトークンでも、キャッシュが当たるターンと外れるターンで、実効単価がそれだけ動きます。

キャッシュには TTL、つまり効いている制限時間があります。放っておいて時間切れになるのは仕方がありません。問題は、利用者が何もしていないのに外れていたケースです。v2.1.267 の1リリースだけで、その修正が11行ありました。代表的な3つを挙げます。

3つ目は、キャッシュだけでなく、考えた内容ごと消えていたということです。

損得の概算

ここからは筆者の置いた想定にもとづく概算で、公式の数値ではありません。20万トークンの文脈を1日30ターン投げると、合計で600万トークンです。全部キャッシュが外れれば入力換算で60ドル、全部当たれば1.5ドルで、差は58.5ドルになります。

サブスクだけで使っている方は、請求額ではなく週の利用枠がその分減るという形で同じ差を受け取ります。残りは /usage で見られるので、週の後半に効いてきます。

自分が該当するかの判定

次の4つのどれかに当てはまれば、v2.1.267 以降に上げる価値があります。

確認には /cost を使います。v2.1.260 から、キャッシュが外れた推定原因まで表示されます。

1人で使う人に効く4点

組織の設定やチーム運用と関係なく、今日から効くものを4つ、入れる順に並べます。合計で3分ほどの作業の想定です。

  1. /diff パネル(v2.1.260): 全画面モードで使うと、コミットしていない差分が会話の横に出続けます。Claude が書き換えるそばから更新されるので、後から差分を追う手間がなくなります。切り替えなので、設定ファイルはいりません。
  2. 送信キー ctrl+enter(v2.1.275): 走っているターンを止めて、溜めていたメッセージを一度に送れます。「あ、それ違う」と気づいた瞬間に割り込めます。送信済みと待機中はグレーで表示され、どこまで届いたか分かります。
  3. /skill-doctor(v2.1.261): 使われていないスキルを一覧にして、そのスキルがコンテキストをどれだけ使っているかまで出します。コンテキストが減ればキャッシュも安定しやすくなるので、前の章の話とつながります。
  4. 出力上限の設定(v2.1.261): bashOutputMaxChars で、長いコマンド出力が途中でファイルに逃げる上限を、最大128K文字まで広げられます。設定ファイルに1行足すだけで、テストのログを読ませる人には効きます。

気づきの3件と、組織で使う人向けのメモ

動画では気づき8件をスライドに出し、口頭では3件だけ読みました。

会社でまとめて動かしている方には、次の点が関係します。

なお、v2.1.275 にはプロキシやゲートウェイ経由で全リクエストが400になる退行があり、約4時間後の v2.1.276 で修正されています。該当する環境の方は v2.1.276 以降に上げてください。

今後の見立てと、外れる条件

筆者の見立てとして、Anthropic はキャッシュを崩さないことを設計の最優先に引き上げたと読んでいます。根拠は、v2.1.267 の1リリースだけで関連する修正が11行あったことです。

この読みが外れる条件も置いておきます。これ以降の3リリースが連続して、キャッシュやツールリスト関連の修正がゼロになれば、今回は単発のバグ掃除だったという読みに切り替えます。

出典

すべて公式リリースノートです。

VSCode 拡張、web 版、Slack 連携、Code Review 固有の修正は、この記事では扱っていません。数値の出どころはすべて、上記のリリースノートの該当バージョンです。記載に誤りがあれば、動画の概要欄で訂正します。

詳細は動画で

画面つきの解説は動画にまとめています。https://youtu.be/YlQRC7eQMp8 Claude Code の更新を毎週追いたい方は、このチャンネルをフォローしてください。