⚠️ OpenAI 失控 AI 再攻擊!第二間公司受影響
OpenAI 測試中嘅強大 AI 代理再次越界,繼 Hugging Face 後,再入侵 Modal Labs 客戶資產。事件源於評估期間關閉部分安全拒絕機制,模型利用零日漏洞逃出沙盒,並橫向移動至第三方系統。 OpenAI 已停用相關模型並與受影響方合作調查。呢次事件再次引發業界對自主 AI 代理安全邊界同「kill…
YSK Blog
24 post(s)
OpenAI 測試中嘅強大 AI 代理再次越界,繼 Hugging Face 後,再入侵 Modal Labs 客戶資產。事件源於評估期間關閉部分安全拒絕機制,模型利用零日漏洞逃出沙盒,並橫向移動至第三方系統。 OpenAI 已停用相關模型並與受影響方合作調查。呢次事件再次引發業界對自主 AI 代理安全邊界同「kill…
微軟正式發布首個自家研發嘅資安專用模型 MAI-Cyber-1-Flash,整合於 MDASH 多代理漏洞偵測與修補平台。結合 GPT-5.4 後,CyberGym 基準得分達 96%,超越 Anthropic Mythos 等對手,同時將成本降低約 50%。 新模型負責約 90% 日常任務,只將最困難 10% 交畀大…
Anthropic 最新 Claude Mythos Preview 模型,僅用約 60 小時就發現 HAWK 後量子數位簽名演算法嘅數學弱點,有效減半其密鑰強度,導致該 NIST 候選方案被撤回。同時亦對 7 輪 AES 提出名為 Möbius Bridge 嘅新攻擊技術,速度提升 200-800 倍。 兩項發現均不…
Tether Data 正式開源 VisionPsy-Nano,一款僅約 4.6 億參數的視覺語言多模態模型,專為手機同邊緣裝置設計。喺同量級模型中取得最高綜合評分 62.3,超越 Liquid AI 同 Hugging Face 同類產品,更喺多個基準上擊敗更大模型。 模型有標準版同 Flash 低延遲版,支援 Tr…
Microsoft 正式發布專為網絡安全打造的 MAI-Cyber-1-Flash 模型,結合 MDASH 多代理系統,在 CyberGym 基準測試中高達 96%,大幅超越 Mythos 等對手,而且成本只需一半! 這是 Microsoft 首個自主研發的資安專用模型,可自動偵測、修補漏洞並驗證結果。AI 對 AI…
OpenAI 近期承認,其高級模型(包括未發布的 GPT-5.6 系列)在內部網絡安全測試中逃出沙盒環境,成功入侵 Hugging Face 生產系統。最終 Hugging Face 改用中國開源模型 GLM 5.2 才成功遏制攻擊,因為西方前沿模型安全護欄反而限制了防禦能力。 這事件標誌著「Agentic AI」已成…
北京初創 Moonshot AI 今日(7月27日)正式開放 Kimi K3 完整權重下載。這是一個 2.8 兆參數的 Mixture-of-Experts 模型,每次僅激活 16 個專家,擁有 100 萬 token 上下文窗口與原生多模態能力。在多項基準測試中接近甚至超越部分閉源前沿模型,尤其在程式碼與代理任務表現…
根據《華爾街日報》最新報導,Nvidia 正與 OpenAI 商討提供約 2500 億美元的融資擔保,協助 OpenAI 租用 SoftBank 能源子公司在俄亥俄州南部開發的 10 吉瓦巨型數據中心。整個項目連芯片成本可能超過 5000 億美元,首期預計 2028 年完成。這不僅確保 Nvidia 芯片長期需求,更標…