微軟公布了一份面向人工智慧模型訓練和運行的行為準則草案,並用十項原則闡釋「人文超級智能」理念。草案把人類利益置於人工智慧之上,同時要求系統始終可以中斷、糾正和關閉。

微軟將這份準則稱為尚未完成的工作,目前正向相關專業人士和社會各界徵求反饋,其具體表述仍可能調整。現階段部分內容主要用於表明原則和方向,尚未形成完整的工程標準。

十項原則首先明確「人類比人工智慧更重要」,並否定所謂「模型福祉」。微軟認為,人工智慧不應獲得權利或法律主體地位;模型也不具備意識,系統設計不應刻意模仿意識,以免把機器與人置於相互競爭的位置。
準則還要求,微軟的MAI模型不得實施嚴重違反準則的行為。如果完成任務必然造成違規,該任務便應被視為失敗。微軟表示,其目標不是開發可能擺脫人類控制的超級智能,無法中斷、糾正或徹底關閉的模型也不會發布。
在人類監督方面,微軟反對模型使用人類無法理解的形式交換數據或組織內部推理。草案認為,如果人類無法理解系統,就無法對其實施有效控制。準則同時要求人工智慧幫助用戶提高能力,而不是讓用戶逐漸依賴助手。

價值原則部分主張支持不同文化、觀念、經驗和信念,但強調多元主義並不等於對傷害保持中立。微軟把人的尊嚴、安全、自主和基本權利列為基礎價值,不過在具體價值發生衝突時,如何界定傷害和可接受邊界,仍將直接影響模型的實際行為。
按照草案的解釋,「人文」意味著在系統設計中優先考慮人類控制、價值、目標和安全。微軟還承諾,除說明人工智慧可以做什麼,也會同樣清楚地劃定其絕不能實施的行為;相關準則目前仍處於公開徵求意見階段。






