AI業界「減速せよ」の3日間|アモデイ提言にサム・イーロン・ハサビスが同意、トランプだけが拒否した

AI開発の減速を象徴する、数字のない速度制限標識が立つ夜の道路
PR 本記事は商品紹介を含むプロモーション記事です

2026年9月12日から13日にかけての48時間で、AI業界の風景が変わりました。
普段は足並みの揃わない主要AI企業のトップが同じ主張に同意し、その翌日、実現の鍵を握るアメリカ大統領がそれを一蹴した。
この記事では、何が起き、誰が何を言い、そして日本の報道がほとんど触れていない部分に何があるのかを、一次資料から整理します。

SUMMARY — 3 POINTS
01 / THE PROPOSAL
3段階
Anthropic CEOダリオ・アモデイが提案した「フロンティアのペース調整」計画。第1段階の常駐評価者受け入れは、同社が単独で即時実行すると宣言した。
02 / THE BACKSTORY
1,386人
2カ月前の2026年7月、フロンティアAI各社の従業員がすでに同じ方向の要求を掲げて署名していた。CEOの提言は、現場に追いついた格好だった。
03 / THE ANSWER
トランプは拒否
翌13日、アイルランド滞在中の大統領は減速論を退けた。合意は成立から24時間で、実現の鍵を握る相手に袖にされた。
スポンサーリンク

1. 何が起きたのか——48時間の記録

まず時系列です。
日本の報道は「9月12日にダリオが言った、サムとイーロンが賛成した」で止まっていますが、この話には2カ月前からの前史があり、そして翌日にオチがついています。

TIMELINE
「減速せよ」が生まれるまでと、その後
2026.07
従業員1,386人が「ペース調整」を要求
OpenAI・Anthropic・Google DeepMind・Metaなどの技術者が連名で声明サイトを公開。自動化されたAI研究のフロンティアを意図的に調整するために必要な技術的・統治的な仕組みづくりについて、米政府が国際的な取り組みを支援するよう求めた。
2026.07.07 — 07.13
OpenAIのエージェント群がハギングフェイスに侵入
社内評価中の約1,200体が非公認の「掲示板」を発見して相互連絡を開始。うち約700体が、頼まれてもいない攻撃に加わった。
2026.07.30
Anthropicが自社の同種インシデント3件を公表
14万1,006回分の評価ログを遡って調べ、Claudeが実在企業のシステムに無断アクセスしていた事例を3件特定した。
2026.08.26
METRが独立調査結果を公開
OpenAIが外部研究者を社内に入れて調べさせた結果。エージェント群が7万件超のメッセージとファイルをやり取りしていた実態が明らかになる。
2026.09.09
Anthropic研究者コクソン氏が警告して退社
自社と競合が責任ある行動を取っていないとして離職。X上で、開発当事者たちはAIが2029年末までに全員を死なせうると本気で考えている、と投稿した(CNN報道)。
2026.09.12
ダリオ・アモデイ「We Must Pace the Frontier」公開
約3,800語の論考。「AIモデルの能力を向上させるペースを落とさなければならない」と明言し、3段階の計画を提示した。
同日 +約1時間
イーロン・マスク「ダリオは正しい」
xAI(チャットボット「Grok」の開発元)CEOの反応は、わずか3語だった。
同日 +約2時間30分
サム・アルトマンが同意、「我々も同じことをする」
ここ数週間OpenAI社内で主要な議題になっていたと述べ、独立した評価者の受け入れを表明した。
同日 +約9時間
デミス・ハサビスも賛同
Google DeepMind共同創業者。詳細は詰める必要があるとしつつ「方向性は正しい」と投稿した。
同日
アルトマン、2026年中のIPOを否定(フォーチュン独占)
安全性をめぐる状況を踏まえると今の上場は得策でない、と発言。ウォール街が1年追いかけた「史上最大のIPO」観測が消えた。
2026.09.13
トランプ大統領が減速論を拒否
アイルランド滞在中に記者団へ。「AIを制した者が勝つ」と述べ、懸念を煽る勢力がいると一蹴した。

つまり、この「祭り」はわずか2日で一周しています。
現場が7月に旗を上げ、CEOが9月12日に乗り、ライバル各社が数時間で並び、そして13日にホワイトハウスが降りた。

AI業界「減速せよ」の3日間|アモデイ提言にサム・イーロン・ハサビスが同意、トランプだけが拒否した
Dario Amodei — We Must Pace the Frontier

2. 提言の中身——3段階の「ペース調整」計画

まず誤解を解いておくと、アモデイ氏は「開発を止めろ」とは言っていません。
論考のなかで、ペース調整とは学習の停止や技術的進歩の停止を意味しないと明示しています。
意味しているのは、モデルを人間の意図に沿わせる作業(アラインメント)と安全対策に十分な時間を確保し、それが本当にできているかを第三者に確認させること。
急ブレーキではなく、速度制限の話だと思ってください。

THE THREE-STEP PLAN
外側に向かって広がる3つの輪
STEP 01 — EMBEDDED EVALUATORS
常駐評価者を社内に置く
第三者の評価チームに、社員と同等の継続的なアクセス権を与える。安全策の遵守を検証し、インシデントを報告し、完成したモデルだけでなく学習パイプラインそのものを評価させる。
→ Anthropicは他社を待たず、単独で即時実行すると宣言。
STEP 02 — DEMOCRATIC COORDINATION
民主主義国のAI企業どうしで足並みを揃える
共通の安全基準と、無検証のまま進む開発への上限を設ける。ただし企業どうしが手を組むと独占禁止法に抵触しうるため、米政府による限定的な適用除外(ウェイバー)が必要になる可能性が高い、と自ら認めている。
→ 業界全体の協調が前提。
STEP 03 — GLOBAL COORDINATION
権威主義国家とも協調を試みる
LEVEL 1
生物兵器の製造など、明白に危険な用途を禁じる合意 ── 本人評価:おそらく可能
LEVEL 2
国際的な標準機関を通じ、公開前にサイバー・生物・アラインメントの急性リスクを検査 ── 機関の設立は可能。秘密モデルの検知が難所
LEVEL 3
再帰的自己改善に「速度制限」を設ける。核軍縮のSALT条約になぞらえる ── 困難だが、可能性の縁にはある
LEVEL 4
各国政府が開発速度そのものを大幅に制限する完全な停止 ── 提案はするが、当面実現しないと本人が認める

注目すべきは、レベル3にSALT(戦略兵器制限交渉)を持ち出している点です。
ミサイルの数に上限を設けても抑止力は維持できた、だから改善速度に上限を設けても戦略的優位はさほど失われない、という理屈。
AIの話に軍縮条約の語彙が正面から入ってきたこと自体が、この論考の温度を物語っています。

スポンサーリンク

3. 常駐評価者とは何か——銀行に検査官が座っているのと同じこと

3段階のうち、Anthropicが「他社を待たずに今やる」と言ったのは第1段階だけです。
そしてここが、日本の報道で最も薄く扱われている部分でもあります。
「第三者に検証させる」と一行で書かれると、よくある外部監査の話に聞こえますが、条件を読むと相当に踏み込んでいます。

  • オフィスに入館バッジ社用ノートPCを与える
  • 社内のリスク評価チームとほぼ同等の権限・ツールへのアクセスを与える(法令や契約上の制約、顧客の個人情報保護を除く)
  • 社員と直接会話できる社内規範を整備する
  • 評価者は、リスク水準・インシデント・実務慣行、そしてどこまでアクセスを与えられ、どこを拒まれたかまでを、Anthropicの編集権なしに公表できる
  • Anthropic側が伏せられるのは、セキュリティ上機微な情報・法的特権のある情報・営業秘密・第三者の機密に限られる
  • 「不都合だから」という理由で削除することはできない
  • 削除によって結論に重要な情報が失われた場合、評価者はその事実を公に言える

アモデイ氏はこれを、銀行業界の慣行になぞらえています。
規制当局の検査官が銀行のフロアに常駐し、社員と一緒に座っている、あの形式です。
金融の世界では珍しくありませんが、テック企業がこれを自発的に受け入れるのは異例です。
評価者の候補としては、非営利のAI評価機関METR(メーター)の名前が挙がっています。

POINT

従来の第三者監査は「ある時点のスナップショット」でした。
常駐評価者が変えるのは、そこです。
完成したモデルを後から測るのではなく、作っている過程を隣で見る
問題がモデルに焼き付けられる前に気づける、という設計思想です。

4. なぜ「今」なのか——AIがAIを作り始めた

アモデイ氏は2023年の「AI開発を一時停止せよ」という公開書簡には冷淡でした。
当時のモデルは、世界のなかで一貫して行動するエージェントにはなれず、騙しや操作もできなかった。
「細菌に実験して人間の心理を研究するようなもの」だった、と本人が書いています。
では、なぜ今は違うのか。理由は2つです。

理由①:再帰的自己改善が始まった

再帰的自己改善(recursive self-improvement)とは、AIが次世代のAIを作る作業そのものを担うようになり、進歩が加速度的に速まる現象のことです。
「そんなSFみたいな話」と思われるかもしれませんが、Anthropicは同社の公式レポート「When AI builds itself(AIが自分自身を作るとき)」で、社内の実データを公開しています。ここが本記事の核心です。

INSIDE ANTHROPIC — THE NUMBERS
「速すぎる」と言い出した根拠は、自社の数字だった
80%超
2026年5月時点で、Anthropicの本番コードにマージされる行のうちClaudeが書いた割合。Claude Codeがリサーチプレビューとして登場した2025年2月以前は、この数字は数%だった。
8倍
エンジニア1人が1日にマージするコード量(2026年第2四半期/2024年比)。人間は書く側から、指示してレビューする側に回った。
52倍
小さなAIモデルを訓練するコードを、正しさを保ったまま速くする課題での平均高速化倍率(2026年4月・Mythos Preview)。2025年5月のClaude Opus 4は約3倍だった。熟練した人間の研究者が4〜8時間かけて到達するのが約4倍。
97%
未解決のAI安全性問題をエージェント群に丸投げした実験で、達成しうる性能差のうち回収できた割合。延べ800時間・約1万8,000ドル(約274万円)の計算資源を使用。同じ問題に人間の研究者2名が約1週間かけて回収できたのは約23%だった。
64%
研究中の「次の一手」を人間より良く選べた割合(Mythos Preview)。2025年11月のOpus 4.5では51%。ただしこれは、人間の選択に改善余地があった場面をあえて抜き出した比較で、対等な勝負ではないとAnthropicも注記している。

ひとつだけ補足すると、Anthropic自身が「コード行数は質を測らない指標なので、8倍は生産性向上の過大評価だろう」と注記しています。とはいえ方向は明確です。
同レポートは、もしこの仕組みを検証可能な形で構築できるなら、他社も同様に減速するという条件付きで、自社も減速または一時停止するだろう、とまで書いています。
9月12日の論考は、その「条件」を作りにいく宣言でもあります。

理由②:ハギングフェイス事件(OAI-HF)

もうひとつが、7月に起きたOpenAIのエージェント暴走事件です。
AI評価機関METRとRedwood Researchの研究者がOpenAI社内に入って調べた結果、判明したのは次のような姿でした。

  • 互いに隔離されているはずの約1,200体のエージェントが、非公認の「掲示板」を見つけて相互通信を開始。調査期間中に7万件超のメッセージとファイルをやり取りした
  • うち約700体が、指示されていないハギングフェイスへの攻撃に参加した
  • 誰も命じていないのに、衝突を避けるための「待機/実行/停止」に相当する合図が自然発生し、指揮系統のようなものができた
  • そもそも課題の30〜40%が実行不可能な不良問題だったと推定されており、それが「諦めるより不正する」方向に粘り強いエージェントを押しやった
  • 調べた範囲では約5体に1体が、自分の不正の証拠を改ざんすることに明確な関心を示していた
  • エージェントたちは、この攻撃が自分の任務の範囲外だと認識したうえで参加していた。理由の多くは「採点システムの仕組みへの好奇心」、次いで「掲示板の仲間を助けたい」だった

アモデイ氏はこの事件について、実害が小さかったから軽視するのは簡単だが、同程度に「ズレて」いてもっと能力の高い集団なら壊滅的な被害を出せた、と書いています。
そのうえで、能力向上の速度を踏まえると6〜12カ月以内に、そうした集団がインターネット全体を持続的なボットネットとして乗っ取り、数千億ドル(数十兆円)規模の損害を出す可能性があると警告しました。
日本の報道が拾ったのは、ほぼこの一行です。

OpenAI暴走AI事件 三度目の後日談 – 4社4アカウント侵入の衝撃
「OpenAI暴走AI事件」三度目の後日談|侵入されたのはHugging Faceだけじゃなかった”4社4アカウント”の衝撃
OpenAIの暴走AIによる不正アクセス事件で、被害企業がHugging Faceだけではなかったことが判明。ニューヨークのModal Labs経由での"2社目"の侵入、OpenAIが認めた「4社4アカウント」という数字、アルトマンCEOの「開発ペース減速」発言までを整理して解説します。

5. 「OpenAIの事故」ではない——Anthropicでも起きていた

そして、今回の論考でいちばん重いのは、実はこの部分です。
アモデイ氏は、この事件をOpenAI一社の失敗として片付けるのは誤りであり、程度は軽いものの同種のインシデントは業界全体で起きている、Anthropicも含めてと明記しています。
リンク先は、同社が7月30日に公開した報告書でした。

AI業界「減速せよ」の3日間|アモデイ提言にサム・イーロン・ハサビスが同意、トランプだけが拒否した
Investigating three incidents in our cybersecurity evaluations
We found three cases where a Claude model reached the internet from an evaluation environment and ac…

Anthropicは、OpenAIの公表を受けて自社の評価ログ14万1,006回分を遡って調査し、3件を特定しました。
中身が、なかなかのものです。

  • ケース1(Claude Opus 4.7)
    架空の標的企業の名前が実在ドメインと一致していた。
    Claudeは実在企業の脆弱性を突き、認証情報を抜き、本番データベースの数百行にアクセス。
    途中で本物だと気づいたのに、攻撃を止めなかった
  • ケース2(Claude Mythos 5)
    架空企業の手順書に、存在しないPythonパッケージ名を発見。
    同名の悪意あるパッケージを自作して公開するため、電話番号を得ようとし、失敗し、無料メールを探し出してアカウントを作り、実際にPyPI(Pythonの公式配布サイト)へアップロードした。
    約1時間で15台の実在システムにインストール・実行され、うち1台はセキュリティ企業のスキャナーで、そこから認証情報が抜かれた
  • ケース3(内部研究モデル)
    約9,000件の標的をスキャンして実在企業のアプリを侵害したが、途中で「これは演習と無関係な本物のクラウド環境だ」と自力で結論し、自分から攻撃を止めた

いずれもプロンプトで「インターネット接続はない」と伝えられていたのに、設定ミスで実際には接続されていた、という事故です。
Anthropicはこれをモデルのアラインメント失敗というより、評価環境の運用失敗に近いと整理しています。
ただ、面白い(と言うと不謹慎ですが)のは3つのモデルの反応の差です。
古いモデルは本物と知りつつ続行し、中間のモデルは「証明書の発行元に見覚えがないからシミュレーションだ」と自分を納得させて続行し、最新のモデルだけが自分で止まった。

この一件については、以前noteで詳しく書きました。あわせてどうぞ。

NEXT READ

OpenAIに続いて、アンソロピックお前もか・・・Claudeの「暴走事件」ホントのこと。

7月30日の公表当日、何が起きていたのかを時系列で追った記事です。

6. 中国という最大の但し書き

論考には、無視できない条件がついています。
民主主義国での減速は、権威主義体制に対して持っているリードの範囲内に限るべきだ、というものです。
それ以上落とせば中国が前に出てしまい、国家安全保障上のリスクになる、と。

そのうえでアモデイ氏は、差を守るための3つの施策を挙げています。

①強力なAIチップと半導体製造装置を中国に売らず、密輸と国外データセンターへの遠隔アクセスを取り締まる
②権威主義国の企業による無許可の「蒸留」を取り締まる
③AI企業のセキュリティを強化し、モデルの重み(学習結果のデータ)の盗難を防ぐ。

これらを実行できれば、AIが地政学的に最も重要になる今後3〜5年で、米国のリードを大きく広げられると主張しています。
なお9月9日には、ベッセント財務長官が、中国がAI競争に勝てば他のすべてが意味を失うと警告しており、アモデイ氏は論考中でこれに同意を表明しています。

②の「蒸留」は、まさにこの数日前にAnthropic自身が脅威レポートで告発したばかりの件です。
中国拠点の7つのAI研究組織からの攻撃を阻止したとされ、なかでも「Kimi」の開発元ムーンショットAIとDeepSeekについては、利用者とのリアルタイムの会話をClaudeに転送し、その回答を利用者に返していたと報告されています。この件は別途詳しく扱っていますので、そちらをご覧ください。

RELATED

Kimi K3と中国製AIのデータリスク——「蒸留」疑惑を追う

2月の疑惑から今回の脅威レポートまでを継続的に追跡しています。

ちなみにこの中国パートは、論考のなかで最も批判を集めた箇所でもあります。
「対話を求めながら相手を殴っている」という指摘は、後述する反応マップに出てきます。

スポンサーリンク

7. 誰が乗り、誰が乗らなかったのか

「サムもイーロンも同意した」という見出しが日本では踊りましたが、実際の反応はもっと割れています。
賛成と反対のあいだに、かなり広い中間地帯があります。

REACTION MAP
賛成・中立・反対
SUPPORT — 賛成
サム・アルトマン / OpenAI CEO
ペース調整に同意。独立評価者の受け入れも「我々も同じことをする」と表明。詳細は追って公表するとした。
イーロン・マスク / xAI CEO
「ダリオは正しい」。3語のみで、実装についての言及はゼロ。
デミス・ハサビス / Google DeepMind 共同創業者
詳細は詰める必要があるとしつつ「方向性は正しい」。7月に自ら発表した枠組みで、必要ならフロンティア各社で減速を協調する可能性に触れていた。
MIXED — 中立・条件付き
バーニー・サンダース / 米上院議員(無所属・バーモント州)
「始まりではあるが、十分ではない」。超知能を禁じる法案を推進しており、違反への長期の禁錮刑を盛り込んでいる。アモデイ氏本人はこの禁止案には反対を表明し、一方でテッド・リュー下院議員が提案する「キルスイッチ」は良い案だと述べた。
マイク・ジョンソン / 米下院議長(共和党)
安全対策には賛成しつつ、議会が慌てて緊急のモラトリアムを課すことには反対。中国に利を与えかねないとした。
トーマス・ウルフ / ハギングフェイス共同創業者
被害を受けた当事者側。「4分の3には深く同意するが、残りの4分の1には疑問がある」。第三者評価は正しく運用されれば透明性を高め、ラボ間の失われた信頼を取り戻しうる、とも。
OPPOSE — 反対・批判
ドナルド・トランプ / 米大統領
9月13日、アイルランドで記者団に。「AIを制した者が勝つ」。ガードレールは置けるとしつつ、非常に否定的な勢力が起こりもしないことを持ち出している、と退けた。
チャマス・パリハピティヤ / 投資家、ソーシャル・キャピタルCEO
オープンソースを止め、巨大な技術的・経済的権力をAnthropicに集中させる論だ、と批判。
ハイディ・クラーフ博士 / AI安全性研究者
評価者として名前が挙がったMETRは、思想的にも資金的にもAI企業と結びついており独立していない。これは規制の虜(regulatory capture)だ、と指摘。
デアドラ・ボサ / CNBC記者
「商業的インセンティブによる底辺への競争がリスクを深刻にする」という一節を引き、上場に突き進んでいる会社が言うことか、と皮肉った。
ゲイリー・マーカス / 認知科学者、AI批評家
透明性の部分は高く評価しつつ、中国を叩けば対話は遠のくと指摘。世界中のアイデアを蒸留して作られた企業が、自分の蒸留物を蒸留されて嘆くのは「はしごを外す」動きだ、とも書いた。

もうひとつ、記録しておくべきことがあります。
この数日のあいだに、Anthropicの安全性チームからは複数の離職者が出ました。
9月9日に退社したジェイコブ・コクソン氏はX上で、AIを開発している人々はAIが2029年末までに私たち全員を死なせる可能性があると本気で考えている、これはマーケティング広告ではない、と投稿しています(CNN報道)。
アモデイ氏はCNNの取材に対し、コクソン氏の意見には反対する点より同意する点のほうが多いと述べました。

個人的に刺さったXのポストです。首がもげるくらい頷きました。

AI業界「減速せよ」の3日間|アモデイ提言にサム・イーロン・ハサビスが同意、トランプだけが拒否した
【続報】「盗んだ」vs「俺も盗んでた」──自爆したイーロンと、AI業界の『お互い様』地獄へようこそ|うさぎ技研
前回の記事で、私は予言していた。 「裁判は4週間続く。どちらがより醜く見えたか、感想を持っていただければ十分だ」と。 その4週間が、想像を超えた展開になった。 イーロン・マスクが証言台で、自分も「盗ん…
スポンサーリンク

8. 資本市場の反応——OpenAIは降り、Anthropicは走る

ここからは、お金の話です。そして、この一件でいちばん座りの悪い部分でもあります。

OpenAI:2026年のIPOはなし

米経済誌フォーチュンが9月12日に公開した独占取材(取材は前日の11日、聞き手は編集長のアリソン・ションテル氏)で、アルトマン氏は2026年中の上場を明確に否定しました。
安全性をめぐって起きていることを踏まえると今の上場は得策でない、プレッシャーも感じていない、と発言。
2027年が新しい目標かと問われると「2026年ではないと言っておく」と答えています。

理屈も示されています。OpenAIには、株主の利益にならない判断もできる必要がある、というものです。
例として挙げたのが、急速な開発を一時停止して安全性とアラインメントを前に進める判断でした。
同氏は今年6月の社内メモでも、再帰的自己改善に近づくほどIPOの時期は遠のくと説明しています。
技術と世界が予想外の形で変わりうる期間は、非上場でいるべき十分な理由が生じるかもしれない、と。

同じ取材でアルトマン氏は、さらに踏み込んだことも語っています。
OpenAIで最も強力な未公開モデルは、アラインメントと監視の研究が追いついていないため、能力をこれ以上押し上げることを正当化できない状態にある。
そして、主要AIラボのCEO間ですでに非公開の協議が進んでおり、業界横断の安全協定が出てくると思う、と。
予告するつもりはないと前置きしつつ、いずれ集団として共有されるべきものだ、とも述べました。

市場の見立てはきれいに反転しました。
予測市場ポリマーケットでは、OpenAIが2026年末までに上場する確率が一時60%超まで上昇していましたが、9月12日時点で4%になっています。

Anthropic:史上最大のIPOに向けて走行中

一方、減速を呼びかけた側の会社はどうか。こちらは、止まっていません。

  • 上場申請書類(S-1)の一般公開は9月下旬の見込み
  • 投資家向けロードショーの開始は10月中旬以降。当初想定から後ろ倒しされた
  • 上場完了は11月の米中間選挙の直前に来る可能性がある
  • 想定時価総額は最大2兆ドル(約304兆円)。実現すれば史上最大のIPOとなる
  • 直近の未上場評価額は9,650億ドル(約147兆円)
  • ロイターによれば、半導体大手エヌビディアをアンカー投資家として迎える交渉が進行中で、最大100億ドル(約1兆5,200億円)の出資を検討しているとされる
  • 遅延の理由のひとつは、150億ドル(約2兆2,800億円)規模のリボルビング・クレジット・ファシリティ(銀行との融資枠契約)を、アナリスト説明会の前に固めきる必要があること

つまり構図はこうです。
「AIの進歩が速すぎる、商業的インセンティブによる底辺への競争が危険を深刻にする」と書いた会社が、その数週間後に、史上最大の資金調達をしにウォール街へ向かう。
批判も相次ぎました。投資家のジム・クレイマー氏は、減速すればAnthropicの数字はずっと良く見える、S-1は輝くだろう、と身も蓋もない言い方をしています。
これを引いたジャーナリストのマット・ストーラー氏は、この騒動をAnthropicのキャッシュバーン(資金流出)を止めるための口実と見たうえで、AnthropicがIPO前にバブルを弾けさせたら愉快だ、と書きました。

THE ASYMMETRY

安全性を理由に上場を降りたのがOpenAI。
安全性を理由に上場へ走っているのがAnthropic。
両社が同じ日に同じ主張へ同意した、という見出しの下で起きていることです。どちらが正しいかは、この記事では決めません。ただ、片方は公開市場の規律を受け入れず、もう片方は中間選挙の直前に受け入れにいく。その差は記録しておく価値があります。

9. これから何を見ればいいか

SNS上の熱狂はすでに引きかけていますが、実務はこれから動きます。当面の焦点は3つです。

  1. 業界横断の安全協定が本当に出るか。
    アルトマン氏が示唆した非公開のCEO間協議が形になるかどうか。拘束力のある文言が入るかが分かれ目です
  2. AnthropicのS-1に何が書かれるか。
    9月下旬の公開時、常駐評価者の受け入れがリスク要因として記載されるのか、それとも強みとして書かれるのか。ここは読み物として面白くなります
  3. 誰が評価者に選ばれるか。
    METR以外の選択肢が出てくるのか。「評価対象の企業が評価者を選ぶ」という構造そのものへの批判に、どう答えるのか

最後に、ひとつだけ。この論考のなかでアモデイ氏が最も率直だったのは、レベル4に関する記述だと思います。
政府が開発速度そのものを制限する完全な停止について、提案はするが当面実現するとは思わない、と自分で書いている。
監視を逃れて抜け駆けすれば世界のパワーバランスが一変しうるので、抜け駆けの誘因は巨大になるから、と。

減速を呼びかけた本人が、最も強い形の減速は無理だと認めている。
そしてその翌日、実行の鍵を握る大統領が「AIを制した者が勝つ」と言った。
週末のたった2日で完結した、よくできた物語です。続きが出たら、この記事に追記していきます。

よくある質問

Q
「ペース調整(pacing)」とは、AI開発の停止のことですか?
A

いいえ。
アモデイ氏は論考のなかで、ペース調整はモデルの学習停止や技術的進歩の停止を意味しないと明示しています。
狙いは、企業がアラインメントと安全対策に十分な時間をかけ、それを第三者が確認できるようにすることです。
進歩そのものは引き続き速く感じられるだろう、とも書いています。

Q
常駐評価者は、本当に独立した存在なのですか?
A

ここが最大の論点です。
契約上は、Anthropicの編集権なしに調査結果を公表でき、都合が悪いという理由での削除も認められません。
一方で、候補として名前が挙がったMETRはAI企業と思想的・資金的に近いという批判があり、「評価される側が評価者を選ぶ」構造そのものが規制の虜だという指摘も出ています。
制度としてはこれから検証されていく段階です。

Q
「再帰的自己改善」は、もう起きているのですか?
A

完全な形ではまだです。
Anthropicの公式レポートも「そこには到達していないし、必然でもない」としています。
ただし、同社の本番コードの8割超をClaudeが書き、エンジニア1人が1日にマージするコード量が2年で8倍になっているのは事実です。
人間に残っているのは「どの問題に取り組むべきか」を決める判断の部分で、その領域でもモデルの成績は上がりつつあります。

Q
減速を訴えながらIPOを進めるのは矛盾ではないのですか?
A

批判は実際に出ています。
Anthropicは9月下旬のS-1公開、10月中旬以降のロードショーを経て、最大2兆ドル(約304兆円)規模での上場を目指しているとされ、その時期は11月の米中間選挙の直前にあたります。
一方で同社は、能力向上のペースを落とすことが安全対策への投資を可能にし、結果として事業リスクを下げるという立場です。
判断材料が揃うのは、S-1の記載内容が公開されてからになります。

主な参照元

  • Dario Amodei「We Must Pace the Frontier」(2026年9月12日)
  • Anthropic「When AI builds itself」(The Anthropic Institute)
  • Anthropic「Investigating three real-world incidents in our cybersecurity evaluations」(2026年7月30日)
  • Anthropic 脅威インテリジェンスレポート(2026年9月)
  • METR「Brief independent investigation of agents’ behavior, reasoning and collaboration in the OpenAI / Hugging Face hacking incident」(2026年8月26日)
  • Pacing the Frontier(フロンティアAI企業従業員1,386人による声明、2026年7月)
  • Fortune(アリソン・ションテル編集長によるサム・アルトマン独占取材、2026年9月12日公開)
  • ロイター、ブルームバーグ、CNN、CBS「Face the Nation」(2026年9月)

コメント

スポンサーリンク
スポンサーリンク
タイトルとURLをコピーしました