AnthropicでAIシステムのトレーニングを担当していた研究者のジェイコブ・コックスン氏は2026年9月9日、同社の安全対策が不十分であることを理由に退職したことを発表しました。コックスン氏は、OpenAIとAnthropicの両社が自己改善型AI(自らの能力を自律的に向上させるAI)の開発を急速に進めており、責任ある行動が取られていないと述べています。

この投稿に対し、AnthropicのAI安全チームを率いるエヴァン・ヒュービンガー氏は、コックスン氏の見解に同意する姿勢を示しました。ヒュービンガー氏は、再帰的な自己改善から生じる超知能が予想以上の速さで進展していることに懸念を示し、個人的には今後10年以内にAIが全人類を死に至らしめる確率が10%を超えると述べています。一方で、現行のモデルが人類の破滅を招くリスクについては、同社のリスクレポートに基づき「低い」との認識を示しました。


出典: