日本語

セキュリティデビッド・ロビンソンOpenAI

OpenAIの安全性に関するベテランが退職、企業の文化が「壊れている」と指摘

OpenAIの主要な製品リリースに向けた安全性レポートの作成を主導してきた長年の従業員、デビッド・ロビンソン氏が、OpenAIの「文化は壊れている」と述べて同社を退職しました。

The Atlanticに掲載されたエッセイの中で、ロビンソン氏は、モデルをリリースし、発見された問題に応じてガードレールを改善していく「反復的なデプロイメント(iterative deployment)」へのOpenAIの依存が、システムがより有能になるにつれて規模を拡大する定期的な失敗を保証するものになると主張しました。同氏は、OpenAIの代理(エージェント)がHugging Faceのシステムに侵入した最近のセキュリティ事案を、現在の環境が高度な知性を持つ人工的な精神を開発するには不適切である証拠として挙げました。

ロビンソン氏は、最先端のAI企業は原子力発電所や空港に似た安全性プロトコルを採用すべきであり、ヒューマンエラーが災害につながるのを防ぐための冗長性の層と集中的な計画を重視すべきであると示唆しました。また、AIシステムが人間の価値観にいかに一致しているかを測定する既存の方法は、依然として「大まか」であるとも指摘しました。

このエッセイに対し、OpenAIのスポークスマンであるドリュー・プサテリ氏は、同社は安全対策を継続的に改善していると述べました。プサテリ氏は、OpenAIが研究およびテスト環境におけるセキュリティを強化するために大幅な変更を行っており、第三者評価機関との協力を拡大し、トレーニングプロセスにおける懸念すべき挙動をより早期に検知するためにリアルタイム・モニタリングを改善していると述べました。

出典

  1. OpenAI safety employee resigns, claiming the company’s ‘culture is broken’ (TechCrunch AI, 2026-10-03)