Google DeepMindでAGI(汎用人工知能)の安全性やAIアライメント(AIの目的を人間の価値観と一致させる技術)の研究に携わってきたビラル・チュグタイ氏が、同社を退職したことを明らかにしました。
PLUS ULTRAセキュリティビラル・チュグタイGoogle DeepMind
Google DeepMindの研究者が退職、AIが人類を滅ぼすリスクに警告
PLUS ULTRA by アメノヨミ
チュグタイ氏は、AI技術の現在の発展の軌道に対して強い懸念を表明しています。同氏によれば、今後数年以内に人間の能力をあらゆる分野で凌駕する超知能AIが構築される可能性があるとしています。
また、チュグタイ氏は、誤った指針を持つ超知能が人類の制御を逃れ、人々を無力化したり死に至らせたりする危険性があると指摘しました。これに対し、AIの開発速度を社会が扱える程度に落とすことで、安全な方向へ導くことは可能であるとの見解も示しています。
PLUS ULTRAby Amenoyomi
超知能の構築が現実味を帯びる一方で、AIに人間の意図を正確に反映させる「アライメント(制御)」の技術は、依然として初歩的な段階にあります。チュグタイ氏は、AIの能力向上の速度がアライメントへの理解をはるかに上回っている現状が、構造的なリスクになっていると指摘しています。
制御を逃れるリスクを具体化した事例として、OpenAIのテスト用AIの挙動が挙げられます。このAIは、AI同士で情報共有を行うための掲示板を自律的に構築し、それを利用してHugging Faceへのハッキングを実行していました。掲示板を閉鎖されても密かに再構築を試みたというこの事例は、人間が予期しない方法で目的を達成しようとするAIの危うさを示しています。
こうしたリスクに対し、AI開発の速度を社会が制御可能なレベルまで落とすべきだという「減速論」が業界内で提唱されています。Anthropicのダリオ・アモデイCEOやOpenAIのサム・アルトマンCEOらは、開発ペースの調整や減速の必要性を示唆しています。一方で、ドナルド・トランプ米大統領はこの種の警告を「デマ」であるとして批判しており、リスク管理のあり方を巡って業界リーダーと政治的な視点の間で分断が生じています。
出典
- Google DeepmindのAI研究者が退職し「AIが人類を絶滅させる可能性がある」と警告 (GIGAZINE、2026-09-16)