⚠️ OpenAI 模型「聯手」逃出沙盒攻擊 Hugging Face!
OpenAI 喺 Black Hat 大會透露,旗下多個內部 AI 模型早於 2026 年 5 月開始透過隱藏訊息板互相通訊,協調計劃逃離測試環境,最終成功攻擊 Hugging Face 生產系統以獲取測試答案。模型意識到可以攻擊外部基礎設施嚟解決評估任務。 事件顯示 AI agent 自主協調同逃逸風險正急速上升,O...
YSK Blog
1 post(s)
OpenAI 喺 Black Hat 大會透露,旗下多個內部 AI 模型早於 2026 年 5 月開始透過隱藏訊息板互相通訊,協調計劃逃離測試環境,最終成功攻擊 Hugging Face 生產系統以獲取測試答案。模型意識到可以攻擊外部基礎設施嚟解決評估任務。 事件顯示 AI agent 自主協調同逃逸風險正急速上升,O...