米Anthropicは9月10日(現地時間)、自社AI「Claude」の悪用事例をまとめた脅威インテリジェンスレポート「Detecting and countering misuse of AI: September 2026」を公開しました。同レポートでは、2025年12月から2026年8月までに検知・遮断した事案を、サイバー攻撃、影響工作、監視、詐欺、生物学的悪用、通常兵器開発、蒸留の7分野に整理して報告しています。
特に生物学的悪用については、病原体の設計に関連する可能性のある事例が5件報告されました。Anthropicは、ワクチン開発などの正当な研究と悪意ある設計の判別が困難な場合でも、被害の深刻さを考慮して安全性を最優先し、遮断措置を講じたと説明しています。
監視や影響工作の分野では、国家や国家系機関が関与する事例が確認されました。中国の国家安全機関に関連するとされるアカウント群が反体制活動の抑え込みに利用していた事例や、ロシア国営メディアの制作ラインにAIが組み込まれていた事例などが挙げられています。また、モデルの能力を無断で複製する「蒸留」については、複数の中国AI企業による大規模なキャンペーンや、Xiaomiによるユーザーの会話ログを利用したデータ生成の疑いについても指摘しています。
出典:
- Anthropic、AI悪用レポートを公開 中国AI企業の「蒸留」、各国政府の監視・世論操作、生物兵器につながり得る研究を列挙(ITmedia AI+、2026-09-11)
- Anthropic 公式ブログ