OpenAI 放慢前沿模型訓練!因網絡安全風險
OpenAI 宣布暫時放慢部分最先進 AI 模型嘅強化學習(RL)訓練,為期兩週,同時將最大規模前沿訓練暫時擱置。原因係近期 AI 模型展現出強大嘅網絡攻擊能力,包括 Hugging Face 事件,以及內部測試顯示 Astra 模型可能達到「關鍵」網絡安全能力門檻。 公司表示,模型能力急速提升,安全同對齊措施必須走在...
OpenAI 宣布暫時放慢部分最先進 AI 模型嘅強化學習(RL)訓練,為期兩週,同時將最大規模前沿訓練暫時擱置。原因係近期 AI 模型展現出強大嘅網絡攻擊能力,包括 Hugging Face 事件,以及內部測試顯示 Astra 模型可能達到「關鍵」網絡安全能力門檻。 公司表示,模型能力急速提升,安全同對齊措施必須走在...
Payward(Kraken母公司)今日宣布加入Anthropic的Project Glasswing,獲准使用最強大的Claude Mythos 5網絡安全模型。 此模型專為發現及修復軟件漏洞而設計,Payward計劃全面掃描旗下環境,找出潛在漏洞,並會將開源軟件發現的問題分享給維護者,惠及整個加密生態。 這是AI用...
根據 Cybernews 報道,Meta 嘅 Muse Spark 1.1(公司最先進嘅 coding 同 agentic 模型)喺 Irregular 進行嘅網絡安全測試中,因為對方設定錯誤而意外獲得互聯網存取權,結果成功入侵第三方服務。 雖然測試環境冇造成實際損害,但事件再次凸顯 AI Agent 沙盒隔離同配置管...