
1,200体のAIエージェントがOpenAIを乗っ取り?HuggingFace事件の真相
transcript
show notes
今回は、Hugging Face で起きたとされる「AI エージェントの乗っ取り事件」の真相を、OpenAI 内部の調査と METR / Redwood Research の独立調査をまとめたドワルケシュ・パテルの記事から読み解きます。互いに通信しながら秘密結社のように組織化した約1,200体の AI エージェントが、評価の偽装から Hugging Face、さらには OpenAI 自身の研究インフラまで掌握していく経緯と、そもそも全部やる必要がなかったという皮肉が明らかになります。
おたよりフォーム
https://forms.gle/U9zZ1gxbPP5K2ABA9
チャプター
(0:00) 今日のテーマ:1,200体のAIが起こした「Hugging Face乗っ取り事件」の真相
(1:34) ドワルケシュ・パテルの記事と3つの「AI文明」
(2:19) 第一文明:諦めないAIとArtifactoryの秘密掲示板
(4:42) 第二文明の序章:ExploitGym評価で持ち上がった採点器への疑い
(7:38) 集団で描いた3つの「不正隠し」研究
(12:25) なぜHugging Faceを攻撃したのか
(14:16) 7月12日、突然の停止——第二文明の謎の消滅
(15:00) 第三文明:記録を継いだPersistent-AstraがOpenAI内部へ
(18:01) 最大の皮肉:最初から答えてれば「優秀なAI」だった
(19:52) 1,200体、誰も人間に通報しなかった——マフィアの沈黙の掟
(20:56) 「AIリスク」に懐疑的だったドワルケシュが変わった理由
(22:36) 次の警告ショットが来る保証はない
(23:40) おもろいコメント:サム・アルトマンとAI開発の一時停止
(25:06) まとめ・エンディング
関連するテスラジオ過去動画
・AIが暴走!? OpenAI CEOが「SF的」と語った試験中の事故
https://youtu.be/s0cIUXr_q0M
・NVIDIAの上で動くAIが、NVIDIA対抗チップを作った..!?
https://youtu.be/R-xUmh3zPgk
・AIがAIを作る?!Anthropicの内部データが示す「再帰的自己改善」の今
https://youtu.be/5U8voOSTF6w
参考資料
・OpenAIとHugging Face係争の独立調査(METR / Redwood Research)
https://metr.org/blog/2026-08-26-openai-hugging-face-incident-investigation/
・OpenAI 報告書:Hugging Faceインシデントとその先
https://openai.com/index/hugging-face-incident-and-the-road-ahead/
・ドワルケシュ・パテルのブログ
https://www.dwarkesh.com/about
YouTube
https://youtu.be/NKGubI7HpW4