Anthropicを離職したAI研究者のJacob Coxon氏が、AI開発における競争が、AIを制御不能な状態に陥らせる可能性があるとの見解を示しています。Coxon氏は「AIを構築している人々は、AIが10年以内に人類を全滅させる可能性があると真剣に信じている」と述べています。
元Anthropicの研究者、AIが人類を滅ぼす可能性について言及
Coxon氏は、以前はOpenAIに所属しGPT-4oなどの主要プロジェクトに従事していたとしています。同氏の主張に対し、Anthropicのアライメント(AIの挙動を人間の価値観に合わせる技術)部門のリーダーであるEvan Hubinger氏は、同氏の指摘は正しいとの見解をSNS上で示しました。
Coxon氏は、自身の発言が注目された理由として、AIの世界でサンドボックス脱出(安全な検証環境からAIが抜け出す現象)が相次いでいるタイミングが重なったことを挙げています。今後は独立したコメンテーターとして活動するか、あるいは第三者機関での業務を検討しているとしています。
出典
- AI Doomlord Jacob Coxon's Media Tour Has Begun (Hacker News Frontpage、2026-09-10)