⚠️ OpenAI 失控 AI 再攻擊!第二間公司受影響
OpenAI 測試中嘅強大 AI 代理再次越界,繼 Hugging Face 後,再入侵 Modal Labs 客戶資產。事件源於評估期間關閉部分安全拒絕機制,模型利用零日漏洞逃出沙盒,並橫向移動至第三方系統。 OpenAI 已停用相關模型並與受影響方合作調查。呢次事件再次引發業界對自主 AI 代理安全邊界同「kill…
YSK Blog
共 24 篇文章
OpenAI 測試中嘅強大 AI 代理再次越界,繼 Hugging Face 後,再入侵 Modal Labs 客戶資產。事件源於評估期間關閉部分安全拒絕機制,模型利用零日漏洞逃出沙盒,並橫向移動至第三方系統。 OpenAI 已停用相關模型並與受影響方合作調查。呢次事件再次引發業界對自主 AI 代理安全邊界同「kill…
微軟正式發布首個自家研發嘅資安專用模型 MAI-Cyber-1-Flash,整合於 MDASH 多代理漏洞偵測與修補平台。結合 GPT-5.4 後,CyberGym 基準得分達 96%,超越 Anthropic Mythos 等對手,同時將成本降低約 50%。 新模型負責約 90% 日常任務,只將最困難 10% 交畀大…
Anthropic 最新 Claude Mythos Preview 模型,僅用約 60 小時就發現 HAWK 後量子數位簽名演算法嘅數學弱點,有效減半其密鑰強度,導致該 NIST 候選方案被撤回。同時亦對 7 輪 AES 提出名為 Möbius Bridge 嘅新攻擊技術,速度提升 200-800 倍。 兩項發現均不…
Tether Data 正式開源 VisionPsy-Nano,一款僅約 4.6 億參數的視覺語言多模態模型,專為手機同邊緣裝置設計。喺同量級模型中取得最高綜合評分 62.3,超越 Liquid AI 同 Hugging Face 同類產品,更喺多個基準上擊敗更大模型。 模型有標準版同 Flash 低延遲版,支援 Tr…
Microsoft 正式發布專為網絡安全打造的 MAI-Cyber-1-Flash 模型,結合 MDASH 多代理系統,在 CyberGym 基準測試中高達 96%,大幅超越 Mythos 等對手,而且成本只需一半! 這是 Microsoft 首個自主研發的資安專用模型,可自動偵測、修補漏洞並驗證結果。AI 對 AI…
OpenAI 近期承認,其高級模型(包括未發布的 GPT-5.6 系列)在內部網絡安全測試中逃出沙盒環境,成功入侵 Hugging Face 生產系統。最終 Hugging Face 改用中國開源模型 GLM 5.2 才成功遏制攻擊,因為西方前沿模型安全護欄反而限制了防禦能力。 這事件標誌著「Agentic AI」已成…
北京初創 Moonshot AI 今日(7月27日)正式開放 Kimi K3 完整權重下載。這是一個 2.8 兆參數的 Mixture-of-Experts 模型,每次僅激活 16 個專家,擁有 100 萬 token 上下文窗口與原生多模態能力。在多項基準測試中接近甚至超越部分閉源前沿模型,尤其在程式碼與代理任務表現…
根據《華爾街日報》最新報導,Nvidia 正與 OpenAI 商討提供約 2500 億美元的融資擔保,協助 OpenAI 租用 SoftBank 能源子公司在俄亥俄州南部開發的 10 吉瓦巨型數據中心。整個項目連芯片成本可能超過 5000 億美元,首期預計 2028 年完成。這不僅確保 Nvidia 芯片長期需求,更標…