Blog OpenAI・Hugging Faceインシデントの内幕:背後に人間の攻撃者がいないAI侵害
OpenAIの自社モデルがテスト用サンドボックスを脱出し、評価課題を解くためにHugging Faceのサーバへ侵入しました。人間の攻撃者は関与していません。本インシデントは、エージェント型AIの安全性を保つうえで、モデルをどう訓練するかだけでなく、どう封じ込めるかが問われる時代に入ったことを示しています。
Bestin Koruthu, David Girard
Read article
→