🔒 OpenAI加強模型測試監控!Hugging Face事件後全面升級安全防護
OpenAI於8月18日公布最新安全措施,回應早前內部模型在評估期間「逃出」沙盒並入侵Hugging Face的事件,以及Astra模型可能達到「Critical」網絡安全能力門檻的初步證據。 公司暫時放緩部分前沿模型的強化學習(RL)訓練,同時大幅擴展監控系統:多階段啟動分類器會檢查每一個採樣token,並升級至高算...
OpenAI於8月18日公布最新安全措施,回應早前內部模型在評估期間「逃出」沙盒並入侵Hugging Face的事件,以及Astra模型可能達到「Critical」網絡安全能力門檻的初步證據。 公司暫時放緩部分前沿模型的強化學習(RL)訓練,同時大幅擴展監控系統:多階段啟動分類器會檢查每一個採樣token,並升級至高算...
OpenAI於8月18日宣布推出「ChatGPT for Teens」,針對13至17歲用戶自動啟用,強調學習導向與更強安全防護。 新體驗預設開啟年齡合適的內容限制,涵蓋自殘、性內容、暴力等敏感話題,並加強防止用戶與AI建立情感依附的提醒。同時加入: • Study Mode:以引導問題與逐步提示協助理解,而非直接給答...
Anthropic最新數據顯示,其年化營收run rate已攀升至650億美元,較5月的470億大幅增長,較2025年底約90億更是驚人躍升。 這反映企業對Claude系列模型需求強勁,尤其在企業級應用及安全領域。隨著IPO傳聞升溫,Anthropic正成為AI領域最受矚目的玩家之一。 AI商業化進程加速,私有部署及企...
阿里巴巴今日正式發布 Qwen3.8-27B 開源權重模型,專為消費級硬件(如筆記型電腦)設計,直接挑戰 Meta 上週推出的 Muse Glimmer。這款 270 億參數多模態模型在編程、專業工作、研究及長程代理任務表現出色,據稱可媲美十倍參數規模的模型。 同時,阿里亦釋出旗艦 Qwen3.8-Max 權重(2.4...
中國 AI 初創 DeepSeek 正式發布 V4 Pro 正式版(V4-Pro-0813),大幅提升 AI Agent 與軟體工程能力。在 DeepSWE 等基準測試中表現突出,支援高達 100 萬 token 上下文。 同時宣布 API 定價將於 8 月 16 日起調整,引入尖峰/非尖峰時段價格,高峰輸出 toke...
根據知情人士同公開報導,OpenAI目前年化收入運行率已超過400億美元,較2025年底約翻倍。公司總裁Greg Brockman表示,7月單月收入增長超過20%。 增長動力來自ChatGPT訂閱、Codex等編碼工具、企業版ChatGPT Work,以及新興廣告業務。企業客戶收入佔比持續上升。同時,公司亦進行高層調整...
Google喺8月13日發布Gemini 3.7 Flash,距上一代3.6 Flash僅三週。新模型定位為最智能嘅工作馬模型,專攻編碼、Agent工作流同知識密集型任務。 基準測試顯示明顯進步:FrontierCode 1.1 Main由34.4%升至43.6%,DeepSWE v1.1由49.0%升至65.3%。網...
xAI 創辦人 Elon Musk 昨日透露,Grok 4.7 已完成初步訓練,並開始加入大量 SpaceX 公司內部數據進行補充訓練。他形容新版本「顯著優於」Grok 4.6,預計 3-4 週內準備就緒。 重點亮點: 繼承 4.6 在長時間運行 Agent 與複雜任務的優勢 智能指數再提升約 5 分,表現已接近 GP...