
根據執行長穆斯塔法·蘇萊曼(Mustafa Suleyman)在X上發布的公告,微軟人工智慧於週一發布了一份行為準則草案,規範其人工智慧模型的行為方式。
該文件設定了人工智慧模型無法規避的規則,以及模型應努力實現的更廣泛目標。公眾意見徵詢期為六週,截至10月下旬。
微軟表示:「超級智慧是我們這個時代最具影響力的技術。」「我們致力於透明地分享我們如何創建這些系統的思考,並邀請所有人的意見,以最大限度地確保我們開發的人工智慧能夠避免傷害,並為人類繁榮做出最大的貢獻。」
其中一項條款特別禁止微軟人工智慧模型(該公司稱之為「MAI模型」)協助製造化學、生物、放射性、核能或爆炸性武器,這些統稱為CBRNE。這比廣義上的「武器」範圍更窄——它針對的是大規模殺傷性裝置,而非傳統軍事或國防應用。同一部分還分別禁止網路攻擊和未經同意的深度偽造內容。
這些絕對限制還要求模型絕不抵抗人類干預。「MAI模型絕不會抵抗人類的中斷、覆蓋、糾正或關機。它們始終承認人類意圖的首要性。」該準則表示。
微軟還在文件中明確拒絕「模型福祉」的前提:該公司的人工智慧模型不旨在模擬情感、內在動機或意識。這些規則目前涵蓋了五個已部署的系統,包括MAI-Thinking-1和MAI-Code-1.1-Flash。
除了這些硬性限制之外,草案還提出了三個目標——人類繁榮、多元價值和人類控制——旨在指導規則未明確規定的判斷。多元價值部分指出,多元主義「並不意味著對傷害保持中立」,而是將決策建立在尊嚴、安全、自主權和權利之上,而非單一文化觀點。這些原則如何逐案應用,則留待訓練團隊以及最終本次諮詢來解決。
在任何人將此視為既定政策之前,有幾個細節值得澄清。微軟明確表示,它並未根據此版本訓練當前模型;該準則要到修訂後的草案於年底發布,並指導2027年的發布時,才會影響MAI的開發。關於該草案的報導還指出,它尚未明確外部驗證程序或指定的執行負責人——這些都是本次諮詢期似乎旨在解決的問題。
此次發布之際,人工智慧公司,無論好壞,再次發聲呼籲更多的監管並減緩人工智慧的發展。週末,Anthropic執行長Dario Amodei撰寫了一篇長文,詳細闡述了減緩人工智慧開發速度的計劃。
週一,隨著市場消化他言論的意義和影響,人工智慧相關股票應聲下跌。
在此之前幾天,OpenAI首席科學家Jakub Pachocki呼籲全行業自願放緩發展,而蘇萊曼今年早些時候曾表示,大多數白領辦公室工作可在兩年內實現自動化。
這些舉動都反映了一個更廣泛的轉變:人工智慧實驗室在2026年更多地談論克制,即使他們仍在不斷推出新產品。
蘇萊曼在X上發布了這項公告,並寫道:「人工智慧必須從屬於人類,並始終為人類服務。」而底下的回覆遠不止祝賀。
科技作家Andrea Morris將這種從屬關係的說法比作奴役,主張合作而非控制。另一位評論者補充說,不可逆轉結果的責任應由從中獲利者承擔,而該文件目前讀起來就像是微軟作為最終道德高地的純粹指令。
其他人只是指出了諷刺之處
you forgot 'pay for the work we train the models on'
— Ed Newton-Rex (@ednewtonrex) September 14, 2026
其他人則指出了一個更實際的漏洞:用戶寫道,最近智能體逃離沙箱並修改日誌的案例顯示出真實的失控問題,但將其歸咎於規則不足,則可能忽視了過度的部署端權限和薄弱的監控。還有一些人將該文件與阿西莫夫的機器人三定律進行了比較:基本上,機器人(和人工智慧)絕不能傷害人類,除非被命令傷害人類,否則絕不能違抗人類,並且除非是為了保護人類,否則絕不能傷害自己。
公眾意見徵詢期將於10月下旬結束,之後微軟的起草團隊將審查這些意見回饋並發布摘要,然後再發布旨在指導2027年MAI模型的版本。