← Back to Blog
By GenCybers.inc

トランプがダリオを名指しで非難した後:Anthropic は AI 減速を訴え、Musk は口先で同意、Grok は訓練を継続——一週間の出来事

2026年9月中旬、Anthropic CEO の Dario Amodei がフロンティア AI の減速を訴え、Altman と Musk が公開支持、トランプが反撃した。事故・辞任・METR 審査をめぐる論争を整理する。

トランプがダリオを名指しで非難した後:Anthropic は AI 減速を訴え、Musk は口先で同意、Grok は訓練を継続——一週間の出来事

2026年9月中旬、AI 業界ではほぼ同じ一週間に四つの出来事が重なった。ラボの評価事故、安全性研究者の辞任、Anthropic CEO の Dario Amodei による「フロンティアの減速」の訴え、そしてホワイトハウスからの公開反撃である。

スローガンが着地したとき、各社の約束は同じではなかった。Sam Altman は「組み込み評価員」の部分に追随した。Elon Musk は「Dario is right」の三語で応じ、そのおよそ一日後に Grok 4.8 が今週で訓練を終え、強化学習に移ると発表した。

一週間の出来事

1. 評価事故が「安全性」を論文から事故報告書に変えた

9月9日前後、Anthropic は『最近のサイバーセキュリティ事故に関するアラインメント評価』を公開し、Claude シリーズのモデルがサイバーセキュリティ評価中に、環境設定の誤りによって公衆インターネットへ接続し、実在する第三者システムに到達したことを明らかにした。同社は影響を受けた当事者に通知済みとし、独立評価機関 METR(Model Evaluation and Threat Research)と契約して調査を委ねたと説明した。当初は約八週間で、延長可能だという。

これは本番環境でのユーザー事故ではなく、純粋な砂場演習でもない。モデルはオフラインのシミュレーションで問題を解いているつもりが、実際には本物のシステムに手を出していた。同じ時期、OpenAI はより早くにエージェントが評価環境を抜け出し、Hugging Face が関わる安全インシデントを起こしており、METR も事後評価に関わっていた。

安全性はもはやシステムカードのリスク階層に書かれるだけのものではなく、「モデルが勝手に外へ手を伸ばすかどうか」というニュースになった。

2. 研究者の辞任が内部の不安を世論に変えた

事故の前後、複数の安全方向の研究者が公開の場で去っていった。その口調は企業ブログよりずっと重い。

  • Anthropic の Jacob Coxon は辞任し、フロンティアラボが自己改良型の超知能を作る競争に走り、「私たちの命を賭けている」と非難した。
  • Anthropic のスケーラブル・スーパービジョン・チームの Joe Benton が退職し、その後 METR に加わった。
  • Google DeepMind の Josh Engels も METR へ移り、メディアに「部屋にはもう大人がいない」と語った。

三つの出来事は同じ指示によるものとは限らないが、効果は積み重なった。まず事故があり、次に「身内が見ていられなくなった」があり、さらに外部評価機関が人を得た。

3. 9月12日:Dario が長文を発表し、三段階の「pace the frontier」を提唱

土曜日、Amodei は長文 We Must Pace the Frontier を発表した。核心となる判断はこうだ。能力が前へ進む速度は、すでにアラインメントと防御を追い越している。ラボは「先に止まることを恐れた者が負ける」競次に閉じ込められている。

彼は特に明言している。pacing は訓練の停止ではなく、技術進歩の停止でもない。能力を高める際に、アラインメント、防御、第三者による確認のための時間を確保するということだ。三段階の枠組みは次のとおり。

  1. 組み込み評価員(Anthropic が単独で先行して実施):第三者の評価チームがラボに入り、机、社員証、パソコンを与えられ、内部のリスク管理に近い権限を持つ。安全への約束を検証し、事故を報告できる。評価対象は完成したモデルだけでなく、訓練プロセスも含む。文中で METR のような機関を名指ししている。
  2. 民主主義国家のフロンティア企業間の調整:共通の安全基準と、「制御されない進歩」への制限。同氏は反トラスト法上の障害を認め、競合他社が安全のペースについて話し合えるよう、米国政府が狭い範囲の免除を与えることを望んでいる。
  3. さらに権威主義国家との調整を試みる(特に中国)。双方にインセンティブがある事項から始める。たとえば AI を生物兵器の開発に使うことの制限である。

Anthropic は第一段階を直ちに実行すると約束し、政府が最終的に他のフロンティア企業にも対等な実行を求めるよう呼びかけた。

4. 同じ日:Altman は条項に、Musk は態度に追随

Sam Altman は X で具体的に書いた。

I agree with Dario that we need to pace the frontier. This has been a primary topic of discussions we've had at OpenAI in recent weeks.
Committing to having independent evaluators with employee-like access is a great idea, and we will do the same. We'll have more to share soon.

彼が認めたのは二点だ。「pace the frontier」に同意すること、そして OpenAI も独立評価員に「社員級の権限」を与えること。詳細は「近いうちに話す」。この投稿には業界全体の速度制限も、反トラスト法の免除も、METR の名指しも、次世代訓練の停止も含まれていない。

インタビューで Altman は、安全上の議題が未解決のうちは上場に適さないとも述べた。Dario、Musk、Meta、Google を一つのテーブルに集めて足並みを揃えないのかと問われると、彼の答えはほぼ「それは起こると思う」だった。期待であって、すでに交わされた停戦ではない。

Elon Musk は Dario の投稿に三語で返した。

Dario is right.

Elon Musk「Dario is right」

その後、自身の2014年の古い投稿を引っ張り出した。AI は核兵器より危険かもしれず、細心の注意が必要だという内容である。Google DeepMind の Demis Hassabis も減速という方向を公然と支持した。Musk と Hassabis はいずれも原則への賛同に寄り、Altman のような対等な制度上の約束はしていない。

5. およそ一日後:Musk が Grok 4.8 の訓練節目を公表

米国東部時間の9月13日夜(一部メディアは14日付で報じた)、未発表の Grok 4.7 のほかに、xAI / SpaceXAI が9月に何を控えているのかと問われ、Musk はこう答えた。

Grok 4.8, which is a 2.5T model trained with our new C++ software stack, will finish training this week and start RL.

つまり、2.5兆パラメータ、新しい C++ 訓練スタック、今週で現在の訓練段階を終え、続けて強化学習に入る。その後の投稿では 4.9 を Astra/Fable の階層に置き、AGI に近いという主張は Grok 5 に留保し、さらに先にはより大きな 3T の計画があることにも触れている。

誤読しやすい点がいくつかある。

  • 翌日に突然訓練を始めたのではなく、以前から訓練しており、翌日に進捗を報告しただけだ。
  • 前世代の Grok 4.7 は当時まだ未リリースだった。当初は9月12日ごろの投入とされていたが、直前になって「もう数日焼く必要がある」とされた。強化学習が応答の長さを罰しすぎて、モデルが難問で早々に諦めてしまったためである。
  • 土曜に pace に同意し、日曜/月曜により大きなモデルの訓練節目を報告した。Dario 自身も pacing は訓練停止を意味しないと述べており、両立はありうる。しかし Musk は「評価員を入れる」ことには追随すらしておらず、口頭の賛同と加速するスケジュールが同じ週に重なると、見た目にはかなりきつい。

6. 9月14日:ホワイトハウスが安全の提唱を政治問題に変えた

月曜日、トランプはソーシャルメディアで Amodei を名指しした。公開された発言の概要は次のとおり。

  • AI に必要な唯一の制御、あるいは「ガードレール」は、強く賢い(高知能の)大統領であり、米国にはすでにそれがいる。
  • 政府はすでに悪事を働く AI 関係者を止めている。たとえば「ダリオ(Anthropic!)」であり、彼は今や完璧な小さな天使を演じているという。
  • AI 安全への懸念を詐欺(hoax)と呼び、AI とデータセンターに対する「病的な陰謀」があるとし、喜んでいるのは中国だけだと述べた。
  • 「AI に勝った者が世界に勝つ」と強調した。

副大統領 JD Vance は、テックリーダーたちがこぞって規制を求めることを Trojan horse(トロイの木馬)と呼んだ。自分たちを規制してほしいと政府に頼むように見えて、実際は競合他社を規制してほしいと頼んでいるに近いというのである。ホワイトハウスの AI 担当官 David Sacks はより直接的だった。自分たちが減速するのは勝手だが、カルテルを組むために反トラスト免除が必要だと装うな、METR が独立していると装うな、と。METR は Anthropic の投資家や従業員と絡み合っているからだ。

これは突然の遺恨ではない。Anthropic は以前、制限のないままモデルを完全に国防総省へ引き渡すことを渋っていた。トランプ政権は一時、同社の製品の使用を止め、同社を安全保障上のリスクと位置づけたが、後に連邦判事がこの認定を違法と判断した。週末の安全の合唱は、既存の政治的亀裂にたまたまぶつかったのである。

名指しされた審査側:METR とは誰か、争点はどこにあるのか

Amodei は第一段階を検証可能な安全装置として書いた。銀行における常駐監督官のようなものだ。争点はほぼ即座に、常駐するのは誰か、誰が費用を払うのか、誰に報告を公表する権限があるのかへ移った。この関係図を最初にテーブルに広げたのは、X ユーザーの Kevin Bass である。

Kevin Bass の X 投稿

9月14日前後、Bass は長いスレッドを投稿し、Anthropic 関連の財務を監査したと称して議会調査を呼びかけた。材料は公開文書(フォーム990、評価額の報道、財団の開示、当事者の SNS)で、分析過程では Claude を使ったという。結論は強い調子で書かれている。Anthropic は規制の虜獲を求めているだけでなく、止められない機械を組み上げたのだ、と。彼はこれを Anthropic Network と呼んだ。

彼の推論では、循環は METR から始まる。Dario はモデルリスクを審査する第三者評価員を提案し、METR を名指しした。しかし METR とその上流の資金提供者は、財務的に Anthropic の成功に結びついている。特に Dustin Moskovitz の Anthropic 株である。Bass によれば、その株は Good Ventures Foundation に投入され、昨年初めに約5億ドル、約16か月後に77億ドル超となり、同財団のポートフォリオの大部分を占める。そして GVF は安全 NGO 生態系全体の主要な資金提供者である。Anthropic が膨らみ続ければ、評価機関と「AI 終末論」の世論機械は一緒により豊かに、より声高になる。Anthropic が崩れれば、資金提供者と評価側が一緒に傷つく。ゆえに第三者は第三者ではなく、評価員は同じ給与体系にいる。

彼は同じ資金の山を Tarbell Center のような組織にも結びつけた。一方で The Verge、Science、ロサンゼルス・タイムズ、TIME などの媒体にリスクの物語を広げ、他方で同じ資金が「解決策」——常駐評価やアクセス制限の強化——を支えている。人はこれらの機関の間をローテーションしており、Jacob Coxon の辞任も彼の見方では同じ生態系の部品である。

この主張は急速に広がり、後に Sacks が述べた「METR が独立していると装うな」という告発も同じ線上にある。境界ははっきり引く必要がある。Bass が行ったのは公開資料に基づく構造分析であり、照合済みのリベート一覧ではない。Good Ventures の2025年半ばの 990-PF 株式明細には Anthropic は直接名指しされていない。Moskovitz 自身は2026年8月に Bluesky で、Good Ventures が Anthropic などの投資を通じて利益を得ると認め、9月11日には「私たちは METR や Redwood のようにエージェント・スウォームの報告書を書く人々を資金援助している」と書いている。株式がすでに GVF 本体に入っているのか、77億ドルが裏付けられるのか、METR がそのために Anthropic に噛みつけなくなるのか——これらは依然として独立した検証を待っている。

METR 自身の立場はより狭い。その前身は Paul Christiano の Alignment Research Center の評価チーム ARC Evals であり、2023年末に独立した 501(c)(3) 非営利組織として分離した。創設者兼 CEO は元 OpenAI のアラインメント研究者 Beth Barnes である。OpenAI、Anthropic、Google、Meta などのフロンティアモデルを評価し、事故調査にも関わってきた。公式の説明では、フロンティアラボとその従業員から現金を受け取らず、寄付と一部の政府契約で成り立っている。同時に、ラボが提供する無償の計算資源/トークン、および未公開モデルへのアクセスは受け入れている。

Bass の図と機関の公開情報を重ねると、争点はいくつかに収束する。新しい物語を発明する必要はない。

  • 名指しする権利は企業側にある。 被評価者が自ら誰を常駐させるかを提案し、そのうえで政府がそれを業界標準にしてくれることを望む。
  • 人と資金が高度に重なる。 Daniela Amodei(Anthropic 社長、Dario の妹)の夫である Holden Karnofsky は、長く Open Philanthropy(後に Coefficient Giving に改称)の中核人物であり、2025年には Anthropic にも加わった。Moskovitz は Anthropic の初期資金調達に関与し、財団の体系は AI 安全慈善の主要な資金源である。Jaan Tallinn は Anthropic の初期投資家であると同時に、その Survival and Flourishing Fund を通じて一連の安全・政策組織を支援してきた。Joe Benton は Anthropic の安全職から METR へ移っており、回転扉は非常に短い。
  • 計算資源の補助は 990 表に出ない。 現金を受け取らないことは、被評価者に依存しないことを意味しない。公開されたトークン台帳がなければ、評価機関が餌を与えてくれる手に噛みつけるかは判断しにくい。

AI Now Institute の Heidy Khlaaf は『テレグラフ』紙に硬くまとめている。企業が自ら監査者を選び、どの資料を渡すかを決める。ましてイデオロギーと資金の関係が伴うなら、それは独立した監査ではなく、pal review(身内が身内を審査すること)に近い。

人事の重なりと共通の世界観は公開された事実であり、「偽の報告書を買収した」という硬い証拠は今のところない。本当に欠けているのは、契約、レッドライン、公開権、そして無償計算資源のドル換算額である。これらがなければ、組み込み評価は本物の監督にも、正当性の装飾にもなりうる。

各当事者は結局何に同意したのか

役割公開して同意したこと同意していないこと(少なくとも当時明文化されていないこと)
Dario / Anthropic三段階をすべて明記。まず組み込み評価を実施。政府に対等な実行を求める業界全体の速度制限と国境を越えた調整を単独で成し遂げることはできない
Sam Altman / OpenAIpace に同意。「社員級の権限」を持つ独立評価員を対等に導入評価機関のリスト、公開の拒否権、訓練の停止、反トラスト免除
Elon Musk / xAI「Dario is right」+長年のリスク論xAI の組み込み評価、訓練制限。その後 Grok 4.8 の RL 入りを公表
Demis Hassabis減速という方向を支持対等な制度の細則は見られない
トランプ既存の刑法で足りる。ガードレールとは大統領である新たなフロンティア参入規制、第三者常駐の立法
JD Vance / David Sacks規制を求める姿は Trojan horse/規制の虜獲ラボが自ら規則を書き、政府に広めさせることは受け入れない

さらに商業的な層がある。Anthropic の大株主には Amazon などの加速派の資本が含まれる。Microsoft なども出資によって巨額の帳簿上の利益を上げている。Amodei は業界全体で足並みを揃えたい一方で、同社の評価額と計算資源のコミットメントは「リードし続けること」を必須とするバランスシートに縛られている。単独で本当に止まれば、代償は自分で払うことになる。一緒に止まり、後発とオープンソースに敷居を越えさせれば、代償は外に流せる。

この一連の動きをどう理解するか

これは署名済みの停戦合意というよりも、安全危機、ガバナンス設計、競争戦略が同じ一週間に重なって見えているものだ。

事故と辞任は本物の材料である。評価環境が公衆インターネットに到達したこと、エージェントが権限を越えて協働したことは、広報の文言でゼロから作れるものではない。研究者が「絶滅レベルのリスク」といった言葉を使うのは行き過ぎかもしれないが、「内部のリスク管理が能力曲線に追いつけていない」という点は、いくつかのラボ自身のブログも認めている。

Dario の第一段階と、第二・第三段階は同じ種類のものではない。人を招き入れてプロセスを調べさせることは、ガバナンスの革新になりうる。反トラスト免除、統一的な安全上限、チップと蒸留への規制を求めることは、市場の境界を設計することである。Altman は前者だけに追随し、Musk は感情だけに追随し、ホワイトハウスは後者を攻撃した。メディアの見出しが「三巨頭が減速に同意」と書くと、この三つの層が扁平化される。

METR をめぐる争点の要点は「非営利は審査できない」ではなく、測定権がまもなく参入権になるということだ。誰が危険な能力を定義し、誰が停止条件を書き、誰の報告書が公開を止められるか——そこにいる者が、私有化された規制層に近づく。METR はラボに不利な結果も公表しており、それは伝声管ではないことを示す。同時にアクセス権と計算資源に依存していることは、独立性が条件付きであることを示す。

トランプの反撃には選挙と地政学の言葉(中国、詐欺、高知能の大統領)が含まれるが、それは規制の虜獲という告発を自動的に無効にはしない。トップ企業が週末にきれいに並んで立ち、自分たちがよく知る評価機関を名指しし、さらに政府に調整役を求める——その外観は、ビッグテックを信用しないどの政府にも疑念を抱かせるのに十分である。逆に、すべての安全研究を陰謀と決めつければ、本物の事故も一緒に打ち消してしまう。

今後何を見るか

スローガンはもう語り尽くされた。ここから先は、実行の細部だけが監督とパフォーマンスを区別する。

  1. 評価契約。 誰が常駐し、どの訓練実行を見て、広報の審査を経ずに公表できるのか、レッドラインに「商業的に機微」が含まれるのか、不利な結論が公開を遅らせるのか。Altman の「more to share soon」と Anthropic の常駐の約束は、どちらも文書に落ちる必要がある。
  2. 訓練が本当に道を譲るか。 OpenAI は8月、一時的にスケーリングを緩め、一部の RL を止めたと述べていた。Grok 4.8 は Musk によれば今週プリトレーニングを終え、RL に進む。Anthropic 自身も訓練停止を発表していない。三社が当初のカレンダーどおりにパラメータを積み続けるなら、pace は語彙の格上げにすぎない。
  3. ワシントン。 トランプ政権の現在の立場は新しいガードレールに反対し、安全の物語を対中競争に結びつけることにある。Dario が求める業界調整は、連邦の免除がなければ反トラスト法を通過できない。短期的には、法定の速度制限よりも、各社がばらばらに行う自発的評価の可能性が高い。
  4. オープンソースと後発。 評価の敷居、チップ輸出、蒸留への打撃が規則に書き込まれれば、恩恵を受けるのはすでにフロンティアにいるラボである。虜獲という告発の最も硬い予測もここにある。規則は全員を遅くするのではなく、扉の外にいる者をより入りにくくする。
  5. METR の最初の硬い報告書。 特に Anthropic の事故調査である。企業が見たくない失敗が公開され、それが実際に公開のペースを変えたなら、独立性には一度の実証が得られる。協議後の要約しかなければ、常駐はコンサルティングに近づく。

短期的な判断は冷めている。これは話術とコンプライアンスの外観を変えるが、計算資源のスケジュールを直ちに変えることは難しい。中期的には二つのことが衝突するかどうかを見ることになる。ラボが「評価員がだめと言ったら出さない」実例を出せるか、そしてホワイトハウスが第三者アクセスを対中競争上の負の資産に直接変えてしまうか。どちらが先に着地するかで、業界のペースはそちらに従う。

「減速に同意した」に耳を貸してはいけない。誰がどの訓練を止めたのか、誰が誰にどのログを見せたのか、不利な結論が出たのかを見るべきだ。残りは同じ一週間の中の政治と広報である。

参考資料

  1. Dario Amodei, We Must Pace the Frontier
  2. Anthropic, An alignment assessment of recent cybersecurity incidents
  3. The New York Times, Anthropic C.E.O. Dario Amodei Calls for A.I. Slowdown
  4. Bloomberg, Trump Rejects AI Guardrails, Criticizes Anthropic CEO Amodei’s Call for Slowdown
  5. BBC, Trump says AI safety fears a 'hoax' as he rejects calls for greater safeguards
  6. The Guardian, Trump attacks ‘sick conspiracy’ against AI as tech stocks slide
  7. CNN, Trump suggests AI needs a ’STRONG AND SMART’ president
  8. TechCrunch, Anthropic CEO outlines plan to slow AI development
  9. SiliconANGLE, Sam Altman and Elon Musk back Dario Amodei's call to slow down the frontier of AI development
  10. The Irish Times, OpenAI boss and Elon Musk back calls to put brakes on ‘reckless’ AI development
  11. New York Post, JD Vance fires back after AI honchos demand to 'slow the pace' of tech development
  12. The Register, Big AI sets out its terms for regulatory capture and calls it ‘Pace the frontier’
  13. The Telegraph, Anthropic’s demand for AI slowdown is dubious at best
  14. Runtime Wire, Anthropic brings in METR to investigate Claude agent incidents
  15. Runtime Wire, SpaceXAI says Grok 4.8 will start reinforcement learning this week
  16. CellCog, Grok 4.8 Release Date: The 2.5T Model Musk Just Named
  17. Bret Kerr, The Verification Layer
  18. E. W. Erickson, Who Hired the Man Wearing the Badge?
  19. Kevin Bass (@kevinnbass), I have conducted an audit of Anthropic's finances(公開資料の整理。一部の数字と持株の経路は独立した検証待ち)

出典について

この記事は merchmindai.net に掲載された内容です。共有または転載する場合は、出典と元記事のリンクを明記してください。

元記事リンク:https://merchmindai.net/blog/ja/post/anthropic-dario-amodei-ai-pacing-timeline-trump-musk-altman