OpenAIが、ChatGPTの応答品質を改善するために、実際のユーザーとChatGPTとの会話を人間が読み、評価を行う内部プロジェクト「Project Lily」を推進していることが、404 Mediaなどの報道により明らかになりました。
このプロジェクトでは、数百人規模の契約スタッフが、生成された回答の品質や問題点を評価するために会話内容を確認しています。OpenAIは、レビュー前に個人情報を減らすための「OpenAI Privacy Filter」を使用しており、氏名や住所、電話番号などの特定につながる情報はラベルに置き換える仕組みを持っています。
しかし、404 Mediaは、会話に含まれる個人的な情報が完全には取り除かれず、人間まで届く可能性があると指摘しています。The Next Webも、レビュー画面ではユーザー名が匿名化されているものの、ChatGPTが保持しているメモリの要約が表示される場合があり、過去の利用内容や居住地域に関する情報が含まれるケースがあるとしています。
OpenAIのプライバシーポリシーでは、データの安全性やモデルの性能向上を目的として、信頼できるサービスプロバイダーがユーザーコンテンツにアクセスする場合があると記載されています。個人向けChatGPTでは、デフォルトで会話データがモデルの改善に利用される設定になっていますが、設定の「データコントロール」から、モデル改善への利用をオフにすることが可能です。なお、ChatGPT BusinessやEnterprise、Eduなどのビジネス向けプランでは、標準で会話データがモデルの改善には利用されない設定となっています。
出典
- ChatGPTとの会話を人間が読む「Project Lily」が進行中、個人情報がレビュー担当者に届いてしまう可能性がある (GIGAZINE、2026-09-15)
- OpenAIヘルプページ