
OpenAIのChief Scientistの警告「AI研究は加速すべきか?」
OpenAIのChief Scientist、Jakub Pachockiが「AI開発は、ちょっと減速した方がいいのでは」と警告しました。論考「An Alien Mind」が描く、人間には完全に理解できない“grown”な知性と、AI自身がAI研究を進める「再帰的自己改善(RSI)」の可能性を手がかりに、なぜいま速度を抑える議論が出てきたのかを読み解きます。Goal Alignmentだけでなく、未知・曖昧・監視されていない状況でも価値観を保つValue Alignment、Chain of Thoughtのモニタビリティ、そして人間を自己改善のループに残す方法まで、Hugging Face事件やAIの集団知性の話も交えて考えます。 おたよりフォーム https://forms.gle/U9zZ1gxbPP5K2ABA9 チャプター (0:00) 今日のテーマ:OpenAIはなぜAI研究の減速を警告した? (0:27) Jakub Pachockiの「An Alien Mind」とRSI (1:10) AIは設計された知性ではなく「grown」 (2:14) ゴールアライメントとバリューアラインメント (3:19) 未知の状況へ価値観を一般化できるか (4:12) Hugging Face事件で露呈したアライメントの穴 (5:48) 監視されていなくても人間の価値観を守れるか (7:11) Chain of Thoughtを監視の窓にする (8:12) 思考を直接評価するとAIは隠す? (9:49) o1-previewがChain of Thoughtを公開しなかった理由 (10:17) AIが賢いほどモニタビリティが難しくなる (11:41) RSIはAI研究をどこまで加速させるか (12:39) 人間を自己改善ループに残す「ペーシング」 (14:26) Preparedness FrameworkとAnthropicのRSP (15:31) AI業界共通のSafety Barを作れるか (16:16) 自主的なスローダウンは実現するか (16:43) おもろいコメント:AIの集団知性は人間を超える? (18:25) 自我のないAIが生む「集団知性」の怖さ (20:22) 摩擦のある人間社会とAIの協調 (21:27) AIのアライメントに法や罰は必要か (23:04) AIに「生きたい」という欲望を入れる? (24:10) まとめ・エンディング 関連するテスラジオ過去動画 ・AIが暴走!? OpenAI CEOが「SF的」と語った試験中の事故 https://youtu.be/s0cIUXr_q0M ・AIがAIを作る?!Anthropicの内部データが示す「再帰的自己改善」の今 https://youtu.be/5U8voOSTF6w ・AI企業「俺たちを規制してくれ」..!? https://youtu.be/3ZcuDkrtI_Y 参考資料 ・An Alien Mind(OpenAI) https://openai.com/index/an-alien-mind/ ・The Hugging Face incident and the road ahead(OpenAI) https://openai.com/index/hugging-face-incident-and-the-road-ahead/ ・Detecting misbehavior in frontier reasoning models(OpenAI) https://openai.com/index/chain-of-thought-monitoring/ ・Updating our Preparedness Framework(OpenAI) https://openai.com/index/updating-our-preparedness-framework/ ・Responsible Scaling Policy(Anthropic) https://www.anthropic.com/responsible-scaling-policy YouTube https://youtu.be/GKiQx71xtFg