OpenAIとAnthropicの両社に在籍していたAI研究者のJacob Coxon氏が、SNSへの投稿を通じて、両社が「人類の命を賭けてギャンブルをしている」として退社したことを明らかにしました。Coxon氏は、AI技術の進歩は停滞しておらず、近い将来にハッキングやあらゆる分野での変革を可能にする超人的なシステムが登場すると警告しています。
Anthropicの元研究者が退社、AIによる人類への生存リスクを警告
Coxon氏は、両社が「自己改善型の超知能(self-improving superintelligence)」の実現に向けて突き進んでいると指摘しました。これは、AIモデルが自らより高性能な後継モデルを開発し、止めることのできないフィードバックループを生み出すシナリオを指します。Google傘下のDeepMindは、これが人工汎用知能(AGI)を超えた、人間の知能を大幅に上回る人工超知能(ASI)の引き金になる可能性の一つとして挙げています。
また、AnthropicのAIアライメント(人間の目標や価値観との整合性を保つこと)の責任者であるEvan Hubinger氏は、Coxon氏の主張を支持しました。Hubinger氏は、AIが10年以内に全人類を死に至らしめる可能性は10%より高いと推定していますが、超知能シナリオにおいてAIを人間の目標に適合させ続ける具体的な計画はまだ存在しないと述べています。
出典
- Gambling with our lives: AI researcher quits Anthropic with warning about safety (Hacker News Frontpage、2026-09-09)