GPT-5.6が最大14倍速に、GLM-5.3はウェイト公開延期 週刊AIニュース(8/10-15)

· 土曜 AI業界 週間まとめ #openai#cerebras#glm#codex#llm

この記事の要点

OpenAIとCerebrasのUltrafastによるGPT-5.6高速化、Z.aiのGLM-5.3ウェイト公開延期、CodexのLinux版プレビューなど週間の動きをまとめました。

2026年8月10日から15日にかけてAI業界で動きがあった9件のうち、3件を詳しく取り上げる週刊まとめです。OpenAIとCerebrasが速さを商品にしたUltrafast、Z.aiのGLM-5.3が招いたウェイト公開の先送り、CodexデスクトップアプリのLinux版プレビューという3つの動きを中心に、動画を見ていない方にも要点が伝わるように書き直しました。

https://youtu.be/b6VDjHWd5vI

今週の動きを時系列で

8月11日、OpenAIがサイバー研究向けの提供枠Daybreakを拡張しました。同じ日、macOS仮想マシン上での推論を高速化する取り組みも公開されています。8月13日にはCodexデスクトップアプリのLinux版がプレビューとして登場し、8月14日にはOpenAIとCerebrasによるUltrafast、Z.aiのGLM-5.3、企業のChatGPT利用調査が立て続けに発表されました。4件が同じ日に集中したのが今週の特徴です。

Codexデスクトップアプリ、Linux版がプレビュー開始

8月13日、OpenAIがChatGPTデスクトップアプリのLinux版プレビューを公開しました。ChatGPTとWork、Codexが1つのアプリにまとまり、これまでブラウザで行っていた作業をアプリの中で完結できます。対応はUbuntu 24.04・26.04、Debian 13、Fedora 43・44で、x64とARM64の両方に向けてdebとrpmで配布されています。

一方で、画面そのものを操作させるComputer Useはまだ対応していません。新しい画面表示の仕組みであるWaylandへのネイティブ対応も実験段階にとどまっており、macOS版と同等に使えるという情報は投稿者個人の見解で、公式の記載ではありません。

Ultrafast、GPT-5.6 Solを最大14倍で動かす新API

8月14日、OpenAIとCerebrasが共同でUltrafastを発表しました。GPT-5.6 Solを通常のStandardと比べて最大14倍、出力は毎秒最大750トークンで動かすAPIです。小型モデルへの置き換えではなく、Solの能力を保ったまま応答時間だけを縮める設計だと公表されています。想定用途は障害対応や音声サポート、金融の調査、ライブでの実験など、待たされた時点で価値が下がる場面です。

ただし現時点では一部の顧客だけの限定プレビューで、価格も一般提供の時期も公表されていません。Standardの約10倍の料金になるという話も出回っていますが、これは未確認の予想にとどまります。

GLM-5.3、ウェイト公開が2週間先送りに

同じ8月14日、Z.aiがGLM-5.3を公表しました。土台のモデルはGLM-5.2のままで、その先の追加学習だけで複雑なコーディングと長期タスクの性能を伸ばしたとしています。サイバー分野の評価CyberGymでは84.5%を報告していますが、これはZ.ai自身が出した数値で、第三者が測定したものではありません。

同社はこの発表とあわせて、ウェイトの公開を安全評価と強化が終わるまで2週間先送りすると明らかにしました。公式の脆弱性台帳には269のオープンソースプロジェクトで2436件の発見が載っていますが、普通の開発環境でも同じ数字が再現できるかは、同社も確認済みとはしていません。ウェイトが出ていない以上、手元向けの量子化版も現時点では存在しません。

名前だけの3件と、仕組みまで見る3件

残り6件のうち3件は名前だけの紹介にとどめました。LLMが得意な数学の議論(数学者Timothy Gowers氏のブログ)、技術者の中間層をめぐる個人ブログ(Hacker Newsで987ポイント)、生成AIのポスターをめぐる話題は、いずれも面白い一方で裏取りが済んでいないためです。

残る3件は仕組みまで紹介します。OpenAIはDaybreakをBlueとRedの二層に拡張し、承認制のRedでGPT-5.6-Cyberを提供します。社内評価の完了率はGPT-5.6-Cyberが95.0%、前世代のGPT-5.5-Cyberが57.3%、通常のGPT-5.6 Solが1.5%でした。実務ではChromeのJavaScriptエンジンV8の調査にも使われ、公的な脆弱性番号CVEも出ています。ただし報告書を書かせる用途では通常のSolが勝つ場合もあり、Redの利用には本人確認や利用範囲の制限、監視が条件で、個人がどこまで使えるかは確認できていません。企業のChatGPT利用調査では、Enterprise導入企業の出力トークンが9か月で約7倍になったと報告されていますが、生産性そのものを測った調査ではありません。

オープンソースのCuaは、macOS仮想マシン上のGPUが能力を低く申告していたためllama.cppが遅い処理を選んでいた問題に手を入れ、申告値を書き換えることでM1 Ultra環境での推論を高速化したと報告しています。実測ではプロンプト処理が11.08倍、生成が16.36倍でした。物理GPUを直接割り当てた話ではなく、非公開でバージョン依存の挙動を使った実験的な手法で、検証も1台に限られます。

4組を同じ物差しで並べると

今週動いたOpenAI、Cerebras、Z.ai、Cuaを同じ軸で比べると、性能を伸ばした場所がそれぞれ違います。OpenAIは配布面(Linux版アプリと高速API)、Cerebrasは専用ハードによる応答速度、Z.aiは追加学習だけでの性能向上、Cuaはドライバ層の申告値の書き換えです。土台のモデルを作り直した組はありません。GoogleとAnthropicは、今週この表に入る発表がありませんでした。

しばらくは土台を作り直す競争より、この外側で伸ばす競争が続くと見ています。9月末までに主要な提供元のどこかが新しい土台のモデル発表に戻れば、この読みは外れです。

今日そのまま動けるのは、Linux版アプリの導入と企業のChatGPT利用調査を読むことの2つです。Ultrafastの価格発表とmacOS高速化の環境要件、GLM-5.3のウェイト公開まで、条件付き・様子見の項目は来週以降に判断材料が増えます。

出典

対応OSの一覧や実際のインストール手順、Ultrafastを見据えたタイムアウト設定の見直し方などは動画で詳しく解説しています。続きはこちらからご覧ください。

https://youtu.be/b6VDjHWd5vI