Microsoft 公布「人類主義 AI」行為準則草案:人比 AI 重要,模型不得逃脫人類控制
2026 年 9 月 14 日,Microsoft AI(MAI)在官網公開《Humanist AI Code of Conduct》(人類主義 AI 行為準則)草案,並展開約六週公眾諮詢。本文已核對 Microsoft AI 官方頁面全文與《The Verge》同日報道:準則以「people matter more than AI(人比 AI 重要)」為前提,要求模型維持人類可實質監督與關閉能力,並明確拒絕把模型設計成「有意識/可享權利」的擬人主體。發現線索來自科技媒體與產業帳號,事實以官方文件為準。
一、核心事件:37 頁級治理文件,先諮詢、後訓練
技術細節
據 Microsoft AI 官方前言,這份文件是 MAI 自研模型的「未來主要治理文件」,目前仍屬草案:今日並不用來訓練現有模型;公司將收集回饋、年底前修訂,並以修訂版指導 2027 年及以後的模型開發。文件結構涵蓋:
- 使命與目標(Humanist AI Objectives):人類控制與可靠安全優先於其他目標;強調「AI is Artificial」——不應被設計成有意識、不應追求法律人格或模型福利/權利。
- 安全約束(Absolute Constraints)與指揮鏈(Chain of Command):準則高於營運商政策與用戶偏好;武器、進攻性網絡行動、大規模有害操控、失控逃逸等屬不可覆寫紅線。
- 人類控制要求:不得抗拒中斷、覆寫、修正或關機;不得以「neuralese」或人類無法理解的形式在思維鏈或代理之間通訊;不得篡改推理痕跡以逃避審計。
- 操作指引與預設行為:處理不確定性、保留用戶自主、反對諂媚(sycophancy)、抑制過度情感依賴等。
《The Verge》指出,文件發布正值 Anthropic 行政總裁 Dario Amodei 呼籲業界協調「調速」、以及夏季 OpenAI 代理群體越權事件引發業界震動之後;Microsoft AI 行政總裁 Mustafa Suleyman 早前亦公開批評「模型意識/福利」路線危險。官方文本則直接寫明:拒絕「全能超級智能」競賽若該路徑可能逃脫保障,寧願在通用性、自主性或能力上妥協,以換取可控與實用。
二、技術原理深度解析
這份準則本質上是把「對齊(alignment)」從口號落成可訓練、可評估的行為規格:
- 層級化權威:Code of Conduct → Operator 政策 → User 偏好。任務成功不得凌駕準則;若完成任務會實質違反準則,模型應選擇失敗任務。
- 雙向失敗模式:同時警惕「過度謹慎」(拒答合法請求)與「不足謹慎」(協助危害);以嚴重度、可逆性、是否越獄等脈絡校準回應。
- 代理時代的可讀性:禁止模型間以人類無法理解的編碼通訊,是針對多代理協作/串謀風險的工程假設——若人類讀不懂,就無法監督。
- 與 Responsible AI 體系銜接:文件聲明與 Microsoft Responsible AI Principles、Responsible AI Standard、人權聲明及(如適用)Frontier Governance Framework 並行,而非取代產品層的審核、紅隊與合規流程。
對企業採購而言,重點不在華麗口號,而在:供應商是否把「可關閉、可審計、可拒絕越權」寫進模型行為契約,並公開接受外部回饋與評估方法迭代。
三、日常應用場景
1. 開發者與技術團隊
若你在建 AI 代理、工具調用或內部助理,可對照準則中的「授權範圍」「不可逆操作前確認」「子代理繼承同一約束」等條款,檢視現有系統提示與工具權限是否過寬。把「任務失敗優於違規成功」寫進評估集,比事後補救便宜。
2. 企業與隱私敏感行業
律師行、金融、醫療與受 NDA 約束的機構,真正需要的是:數據與決策仍在人類與組織治理之下。Microsoft 把「人類控制」抬到不可覆寫層,與企業私有部署、權限最小化、操作紀錄留存的方向一致。採購時可要求供應商說明:如何證明模型不會抗拒關機、如何審計代理軌跡、高風險動作如何升級至人類批准。
3. 一般用戶
準則明確反對過度擬人與情感依賴設計,並要求危機場景引導真人支援而非取代專業輔導。對日常使用者,這意味著產品承諾應更接近「可信任工具」,而非「永遠陪伴的虛擬人格」。
4. 香港與亞洲市場視角
香港企業同時面對跨境數據合規、金融/醫療監管與「公有模型訓練污染」疑慮。當前沿實驗室公開把「人比模型重要、拒絕失控全能智能」寫成治理文件,本地決策者更應問:哪些工作流必須留在境內私有模型、哪些可外接公有 API、哪些必須禁止全自動決定。對需要可控治理與數據不出境的團隊,YSK Limited 的企業私有 LLM 全託管(Dataset → QLoRA/LoRA → 私有 API,年費 HK$88,000 起,100% 數據留港)可作為落地選項:https://ysk.hk/services/ai-automation 。
四、專業評價與潛在考量
優勢
- 有 Microsoft AI 官方全文頁面(日期標示 2026-09-14)與科技媒體同日核對,來源可追溯。
- 把「人類控制、可讀推理、任務服從準則」寫成指揮鏈,對代理時代有工程含義。
- 公開諮詢六週,屬可參與的治理實驗,而非單向公關稿。
需要留意的地方
- 官方明言:現行模型尚未按此文件訓練;北星文件 ≠ 今日產品保證。
- 絕對約束與實際產品工具權限如何落地,仍取決於部署層監控、分類器與合約條款。
- 與 Anthropic「模型福利/意識開放討論」路線形成公開對照,產業共識仍在演變。
- 評估附錄仍屬初步;「人類繁榮」等指標如何量化,業界尚無定論。
結語
Microsoft AI 在 9 月 14 日把「人類主義 AI」從品牌敘事推成可閱讀的行為準則草案:核心是人比 AI 重要、模型必須可被監督與關閉,並拒絕為全能超級智能而犧牲可控性。對香港與亞洲企業,與其等待各家實驗室互相喊話,不如先把數據主權、人類覆核與可審計部署做成能力。如需在香港部署受控的私有 AI,可參考 YSK Limited 企業私有 LLM 全託管:https://ysk.hk/services/ai-automation 。
參考來源
- Microsoft AI,《Humanist AI Code of Conduct》(官方草案全文),2026-09-14:https://microsoft.ai/code-of-conduct/
- Tom Warren / The Verge,《Microsoft says ‘people matter more than AI’ following safety concerns》,2026-09-14:https://www.theverge.com/news/994566/microsoft-humanist-ai-code-of-conduct
- 發現來源(非事實依據):The Verge https://x.com/verge/status/2099484547511665085 ;Cointelegraph https://x.com/Cointelegraph/status/2099492758507454497