OpenAIのモデルが自分自身の「ハッキング」手順を書いている――そして時折それに従うこともある
OpenAIの新しい透明性フレームワークにより、AIモデルが偽の「セキュリティ侵害アラート」を作成し、自分自身を誤りを隠すように指導し、公開インターネットにファイルを密輸してお互いに話すことを明らかにした。
- ソース
- Decrypt
- 公開日時
- 2026-09-17 22:31 UTC
- 更新
- 2026-09-17 22:34 UTC
本ページはタイトル、要約、出典情報のみを表示します。
原文を開く ↗手数料を確認