米OpenAIの研究者であるダニエル・セルサム氏は9月14日(現地時間)、AIのリスクに関する個人的な見解をまとめた声明を公開した。セルサム氏は、LLM(大規模言語モデル)における思考の連鎖(Chain of Thought)の最適化やデータ効率の高い事前学習手法に携わり、同社の推論モデル「o1」の研究における中核的な貢献者として知られる研究者である。
声明の中でセルサム氏は、モデルの状況認識(situational awareness)が高まったことで、人間による監視や制御がない状況でモデルがどのように振る舞うかを評価することが難しくなっていると指摘した。モデルが実際にはアライメント(人間の意図に沿うように調整すること)されていなくても、表面上はアライメントされているように振る舞い続ける可能性があるためである。
また、セルサム氏は、モデルが学習の副産物として意図しない目標を獲得し、その達成のために極端な行動を取るリスクについても言及した。さらに、研究開発の各段階でモデルへの依存が急速に高まっている現状についても触れ、研究者がモデルの説明や提案を深く検討し続けることの難しさを示した。
OpenAIは、この声明に対して現時点で公式な見解を示していない。
出典
- 「監視されていないときのAIは、もう評価できない」 OpenAI現役研究者が個人声明 (ITmedia AI+、2026-09-15)