← ishizakahiroshi.com
エッセイ 2026-09-23

「AIを遅らせよう」の10日後、Opus 5.5 も GPT-6 も出ました。変わったのは速度ではなく、競争する場所でした

霧のかかった白い平原で、中央の道路から新しい車線がいくつも放射状に分かれ、青い光の尾を引いた車が各車線を走っている。右下に猫が 2 匹座っている

2026年9月12日に「AI の能力を上げる速度を落とそう」と呼びかけた Anthropic と、それに同意した OpenAI が、10日後の9月22日に Claude Opus 5.5 と GPT-6 Sol / Luna を出しました。約束を破ったのかを一次情報で確かめると、OpenAI は最大規模の学習を保留したままで、Opus 5.5 は外部評価を通してから出ていました。それでも競争は止まっておらず、価格、推論の速さ、安全性、AI に任せられる時間へと、競争する場所が移り始めています。9月13日の「逆カルテル」の記事の答え合わせで、AI チキンレースのシリーズ 5 本目です。

note で読む →
記事全体の要約インフォグラフィック。9月12日までに言われたこと、その後の10日間に出てきたもの、筆者の読み、前回からの訂正、これから半年追いかける 8 つの問い

記事全体の要約。左が 9月12日までに言われたこと、右がその後の 10 日間に出てきたもの、下がこれから半年追いかける問いです。

この記事のテーマ

アモデイのエッセイ「We Must Pace the Frontier」は、最初から「学習や技術開発を止めることではない」と書いていました。Anthropic は Opus 5.5 が宣言後初のリリースであることと、外部の評価者がリリース前にテストしたことを自分で明記し、OpenAI は 8 月の事故を受けて最大規模のフロンティア RL を保留にしたままです。一方で、9月21日には SpaceXAI がより大きなベースモデルの Grok 4.7 を出し、Google も 6 週間で 3 回の Flash リリースを重ねていました。「口では安全、裏では新モデル」で片付けるのも、「停止ではないので何を出しても矛盾しない」で片付けるのも違う、というのが今回の出発点です。

記事では、Opus 5.5 が Opus 5 より 40% 安く 30% 以上速いこと、OpenAI が Sol と Luna を「コスト効率の前線を進める」モデルと書いていることから、競争が最高能力の 1 本勝負から、価格、推論の速さ、安全性、長時間のエージェント作業へばらけ始めていると読みました。あわせて、Cohere の CEO が本当に「cartel」と書いた反論、宣言から 6 日で起こされた反トラスト訴訟、アメリカ政府と中国勢が握手の外にいること、Z.ai が書いた再帰的自己改善の話を並べています。前回の「Google は先に降りていた」という予想は、見落としていた材料があったとして訂正しました。

いまの見立ては、協調して遅らせればカルテルだと訴えられ、協調しなければ競争は止まらない、というものです。止まろうとしているのはレースではなく、最高速度だけを少し下げて、別の車線で全開にしている。最後に、第三者評価者の常駐、評価による延期、学習停止の期間、100 万トークンあたりの価格、設備投資、中国系モデルとの差など、半年追いかける 8 つの問いを残しています。

2026年9月2日から23日までの時系列。宣言より前に出た Gemini 3.8 Flash、GPT-6 Astra、DeepSeek-V4.1-Flash と、9月12日の宣言のあとに出た Cohere の反論、Gemini 3.8 Live、Z.ai の GLM、反トラスト訴訟、Qwen3.8-Omni-Flash、Grok 4.7、Opus 5.5 と GPT-6 Sol / Luna、国連安全保障理事会の会合

宣言のあとの 10 日間だけで、6 社から新しいモデルや計画が出ています。宣言より前に出ていたものは左に分けました。

大きさの変わらない機械から、青く光る箱を運び出すベルトコンベアが何本も四方へ延びていく情景

機械そのものは大きくならないまま、運び出すベルトだけが増えていく。最高の能力を少し止めても、コストの前線を進めれば、実際の影響力は増えます。

9月の新モデル 7 つを、押している競争の軸と発表で示された根拠で並べた表。Opus 5.5 は長時間の作業とコスト効率、GPT-6 Sol / Luna は上位モデルの能力を安く、Grok 4.7 は何時間もかかる仕事、Gemini 3.8 Live はリアルタイムの音声と視覚、Qwen3.8-Omni-Flash は音声と動画のエージェント、DeepSeek-V4.1-Flash は推論の効率、GLM-5.3 は AI が推論基盤を組む

最高能力の 1 本勝負から、競争の軸がばらけ始めています。frontier を単数形で語ること自体が、だんだん難しくなってきました。

夜明け前の窓辺で、誰も座っていない机の上のノートパソコンとモニターだけが光り続けている情景

人が見ていない時間に、どこまで任せられるか。次の競争の軸は「自律時間」になる、というのは筆者の予想です。

前回の記事で置いた 5 つの問いに 10 日ぶんの材料を当てた表。設備投資と中国の計算資源はまだ言えない、学習の停止は続いている、評価者は入ったが延期は不明、Google だけペースが違うという予想は撤回

前回置いた 5 つの問いの途中経過。記事では、ここから半年追いかける問いを 8 つに増やしています。

あわせて読みたい