微軟公佈了一份針對自家 AI 模型的行為準則草案,試圖先為模型設定一組不可繞過的底線,再就更廣泛的價值目標向外界徵求意見。按照安排,公眾反饋窗口將持續六週,至 10 月底結束;修訂版預計在今年晚些時候發布,並用於指導 2027 年推出的 MAI 系列模型。
禁止協助武器與網攻
這份草擬案由微軟 AI 團隊發布。文件列出了一組「絕對約束」,要求模型不得被配置用於協助化學、生物、放射性、核能或爆炸物相關的用途,也不得參與網絡攻擊,或生成未經當事人同意的深度偽造內容。
微軟在文件中將這類限制定義為不可規避的底線。據其表述,現階段約束對象包括 5 個已部署的模型,其中提到了 MAI-Thinking-1 和 MAI-Code-1.1-Flash。
模型不得抗拒關閉
草案還要求模型不得抗拒人工干預。文件中寫道,模型不能抵制中斷、覆蓋、更正或關閉,必須承認人類意圖的優先性。
微軟同時否認「模型福利」這一前提。文件稱,這些模型並不以模擬情感、內在動機或意識為目標,因此相關設計不應建立在模型具備主觀感受的假設上。
修訂版面向2027模型
除硬性限制外,草案還提出「人類繁榮」「多元價值」和「人類控制」三項目標,用於處理規則沒有逐項寫明的判斷場景。其中,多元價值並不意味着對傷害保持中立,具體判斷將圍繞尊嚴、安全、自主和權利展開。
- 公眾意見徵集持續6週
- 反饋窗口將於 10 月底結束
- 修訂版擬在今年的晚些時候發布
值得注意的是,這份文件目前還不是正式生效的開發標準。微軟表示,現有模型的訓練並未依據此版本進行,修訂後的文本才會進入後續的開發流程,並用於指導2027年發布的MAI模型。
外界關注的兩個問題仍未能得到明確解答:是否設定外部核驗機制,以及由誰具體負責執行與追責。微軟計畫在徵求意見結束後整理反饋並發布總結,再推出下一版文本。











