The Information:OpenAI 與 Anthropic 擬簽具約束力互測協議——互測對方商用模型安全漏洞,約定不留存測試數據
The Information 於二零二六年九月二十一日獨家報道,OpenAI 與 Anthropic 一度接近達成具法律約束力的互測協議:雙方可經 API 壓測對方已公開商用模型的安全漏洞與異常行為,並約定不留存測試期間取得的數據。Mint、Gate News 等轉述同一報道;本文並對照 OpenAI 與 Anthr...
The Information 於二零二六年九月二十一日獨家報道,OpenAI 與 Anthropic 一度接近達成具法律約束力的互測協議:雙方可經 API 壓測對方已公開商用模型的安全漏洞與異常行為,並約定不留存測試期間取得的數據。Mint、Gate News 等轉述同一報道;本文並對照 OpenAI 與 Anthr...
Saturn《Artificial Authority》:主流 AI 財務問答平均錯逾半——複雜題錯誤率達八成八,部分模型高達九成九 英國金融科技公司 Saturn 九月發布報告《Artificial Authority》,以一百二十一條財務題、十八款主流模型、每題重複五次、合共逾一萬次回答做一致性測試:平均錯誤率約百...