Codex の既定が GPT-6.1 Sol に変わった週: 単価・再接続・無人運用の確認点

· 火曜 Codex 週次 #codex#openai#gpt61sol#ai#claudecode

この記事の要点

Codex 0.159.1 で既定モデルが GPT-6.1 Sol に。単価は Astra の5分の1、Plus との分かれ目は入力月670万トークン。再接続と無人運用の確認手順もまとめた。

2026年9月27日から10月3日の1週間に、OpenAI の Codex CLI で何が変わったかをまとめた記事です。 今週いちばん広く効くのは、既定のモデルが GPT-6.1 Sol に切り替わったことです。API キーで使っていて model を固定していない人は、更新するだけで使うモデルが変わります。 あわせて、再接続の修正と、無人ジョブの承認の審査も確認します。

https://youtu.be/v8mf4zDcrZU

この1週間に出た46本の仕分け

GitHub Releases で公開日時 (UTC) を基準に数えると、この期間のリリースは46本でした。内訳は安定版が6本 (rust-v0.158.0 から 0.160.0 まで)、残り40本が先行版です。先行版はリリースノートが無いため扱いません (数え方は当方の集計)。

手を動かす価値があるのは、端末入力の審査が入った 0.158.0、既定が Sol になった 0.159.1、再接続の送り直しが改善された 0.160.0 の3本です。

既定が GPT-6.1 Sol に: 単価と、まだ分からないこと

0.159.1 では、同梱のモデル一覧と、Amazon Bedrock の2種類の一覧 (Mantle と Runtime) で、既定が GPT-6.1 Sol になりました (PR #49323、#49342)。従来のモデルも一覧に残り、手で選べます。

OpenAI のモデルページに載っている単価は、100万トークンあたり次のとおりです (2026年10月4日に確認)。

GPT-6.1 Sol GPT-6 Astra
入力 2ドル 10ドル
キャッシュ読み出し 0.1ドル 1ドル
出力 10ドル 50ドル

入力と出力は Astra の5分の1、キャッシュ読み出しは10分の1です。

ただし、安いから全部 Sol でよいとは言い切れません。「性能は Astra に近い」というのは OpenAI 自身の評価で、公表ベンチも第三者のベンチも見当たりませんでした。当方も実測できていません。10月4日の時点で、ChatGPT アカウントの Codex から Sol を呼べず、有料の API は方針で使わないためです。測り方は後半に載せます。

Bedrock 経由は、AWS 上での実際の推論が確認されていません (PR #49342)。本番の前に検証環境で1回呼んでください。

Sol の API 従量と ChatGPT Plus の損益

ChatGPT Plus は月20ドルです。Sol を API 従量で使った月額を、出力が入力の10分の1だと仮定して概算しました。当方の計算です。

入力 (月) API 従量の月額 Plus 月20ドルと比べて
500万トークン 15ドル API が5ドル安い
670万トークン 20ドル 分かれ目
2000万トークン 60ドル Plus が40ドル安い

分かれ目は、670万トークン × 2ドル + 67万トークン × 10ドル で約20ドルです。Claude Sonnet 5.5 も同じ単価なので、同じ金額になります。

未確認なのは、Plus の Codex で Sol が使えるのか、Plus の回数の上限はどうなっているのか、の2点です (10月4日時点、公式ヘルプ)。/model に Sol が出るかと、/usage の減り方を1日記録すれば確かめられます。

固定するか、測ってから任せるか

測る手順は3つです。

  1. codex --version で 0.159.1 以上かを確認する
  2. /model で今のモデルと Sol の有無を確認する
  3. 同じリポジトリで「関数1つに単体テストを足して通す」を、前のモデルと Sol で1回ずつ流し、かかった分数・/usage の減り方・直した行数を記録する

0.160.0: 再接続後の送り直しと、混ざるという報告

並列タスクの途中で回線が切れると、どの指示が送れたのか分からなくなります。0.160.0 では、再接続のあとに送れたか不明な指示を先に確かめ、未送信の分だけを送ります。二重送信を防ぐ作りです (PR #49105)。

注意点が2つあります。1つ目は、model_catalog_url でモデル一覧の取得先を指定している場合、その一覧に無い同梱モデルが混ざらなくなったことです (PR #49135)。選べるモデルが減って見えたら、まずこれを疑ってください。

2つ目は利用者の報告です。再接続のあとに別のセッションの承認待ちや出力が混ざったという報告が、GitHub Issue #50233 に上がっています。原因は公式には確認されていません。再接続のあとは、どの会話の承認かを見てから押し、無人のジョブで再接続が起きた回は結果を人が見直してください。

無人運用の承認: 止まるかをログで確かめる

0.158.0 で、強い権限で動くコマンドへの端末入力に審査が入りました (PR #47799、#48073)。対象はサンドボックスを外す操作、権限の追加、ポリシーの変更で、安定版で既定オンです。codex exec は既定で、人に承認を聞かない設定で動きます。

ここから先は未検証の、当方の読みです。聞く相手がいない審査は、通らず止まりうると考えています。

codex --version   # 検証環境だけ 0.158.0 以上にする
codex exec "<いつもの夜間ジョブ>" > job.log 2>&1; echo "exit=$?"
grep -n -i "approval" job.log

ログの文言は版で変わるので、終了コードと合わせて判断してください。CI や夜間ジョブでは、model も固定しておくと出力の傾向が揃います。

止まったときは、~/.codex/config.toml の [features] に write_stdin_approval = false と書くと、端末入力の審査を止められます。守りを外す操作なので、原因が分かるまでの間だけにして、分かったら true に戻してください。

気づきツアー

今日手を動かすのは、該当する人だけの3件です。

残りの instant_interrupt (開発中で既定オフ、PR #48141)、.aws の自動保護 (PR #48176)、Windows の画面点滅の修正 (PR #49385) などは、今日変えなくて構いません。

Claude Code と並べると

同じ週に、Claude Code も v2.1.284 で API の既定の Sonnet を 5.5 にしました。単価は Sol と同じ掲載値なので、比べる軸は出力の質と使用量です。無人実行では、claude -p は --allowedTools で許す範囲を先に書きます。codex exec は既定で聞かずに進み、止まる場所を後から測る形です (当方の整理)。

今週の読み (確度: 中)

OpenAI は Codex の承認を、人の判断から自動のレビューへ移している、と読んでいます。根拠は3つです。

  1. 強い権限の端末入力の審査が、安定版で既定オンになった (0.158.0)
  2. codex exec は、設定で自動レビューを選べる作りになっている
  3. 自動レビュー役の Guardian に、会話履歴を読む設定が増えた (PR #49036、既定オフ)

3つ目がまだ既定オフなので、確度は中としました。次の3本の安定版で guardian_conversation_history_tools が既定オフのままなら、この読みは外れで、外れたら次の動画で言います。

明日の朝の3手

  1. codex --version で 0.160.0 まで上げ、/model で今のモデルを確かめる
  2. 固定する人は config.toml に model を1行。任せる人は、テスト追加1件で測ってから決める
  3. 無人で回す人は、検証環境で1回流し、ログと終了コードを見る

出典

詳細は動画で

画面つきの解説は動画にまとめています。次の更新も追いたい方は、フォローしてください。

https://youtu.be/v8mf4zDcrZU