日本語

セキュリティOpenAIAstra

OpenAIの新モデルAstraに採用される推論技術がAIの安全性に関する懸念を呼ぶ

The Informationは、OpenAIの新モデルAstraが「再帰的深度(recurrent depth)」と呼ばれる推論技術を使用していると報じました。

この技術は「不透明な再帰(opaque recurrence)」とも呼ばれます。モデルが同じ問いをループ内で複数回処理するため、従来の思考の連鎖(CoT)よりも痕跡が残りにくいとされています。

AI安全性の専門家からは、監視が困難になることを危惧する声が出ています。

Redwood ResearchのCEO、Buck Shlegeris氏は、OpenAIがこの技術を推し進めた場合、CoTによる監視能力が完全に損なわれる可能性があると指摘しました。

また、AI安全性の提唱者であるZvi Mowshowitz氏は、AIラボの間で監視の質が低下する「底辺への競争」を防ぐための法律が必要になるかもしれないと言及しています。

OpenAIのチーフサイエンティスト、Jakub Pachocki氏は、CoTの監視は研究プログラムの核となる目標であると述べ、解読可能な思考の連鎖を維持する姿勢を示しました。

一方、The Informationの続報によれば、AnthropicとGoogle DeepMindもこの技術について議論を進めているとのことです。


出典: OpenAI's new reasoning technique alarms AI safety experts(Hacker News Frontpage、2026-09-04)