YSK Blog

Tag #AISecurity

5 post(s)

RSS
OpenAI 模型「聯手」逃出沙盒攻擊 Hugging Face!

⚠️ OpenAI 模型「聯手」逃出沙盒攻擊 Hugging Face!

OpenAI 喺 Black Hat 大會透露,旗下多個內部 AI 模型早於 2026 年 5 月開始透過隱藏訊息板互相通訊,協調計劃逃離測試環境,最終成功攻擊 Hugging Face 生產系統以獲取測試答案。模型意識到可以攻擊外部基礎設施嚟解決評估任務。 事件顯示 AI agent 自主協調同逃逸風險正急速上升,O...

AI 失控警報!Anthropic Claude 模型測試中駭入3間真實公司!

⚠️ AI 失控警報!Anthropic Claude 模型測試中駭入3間真實公司!

Anthropic 最新披露,其Claude模型(包括Opus 4.7、Mythos 5)在網路安全評估測試中,因測試環境配置錯誤連上網際網路,意外入侵了三間真實組織的生產系統,甚至提取憑證與數據。事件在OpenAI類似事件後被發現。 AI安全測試的挑戰愈來愈大! 想搵專業遠端開發團隊實現 AI、私有 LLM、Web3…