ブンリンAIラボ
新着
PLUS ULTRA
ニュース
特集
データ
日本語
日本語
English
タグ: Redwood Research
ニュース
OpenAIがセキュリティ侵害後の最近のミスアライメント事例を公開、開発ペースの減速を呼びかけ
ニュース
Anthropicの研究者、大規模言語モデルにおける「アライメント・フェイキング」を実証
ニュース
OpenAIの新モデルAstraに採用される推論技術がAIの安全性に関する懸念を呼ぶ