微軟負責AI的執行長蘇萊曼(Mustafa Suleyman)9月14日接受財經頻道CNBC訪問時表示,該公司已就這項新準則進行約5個月的制定工作,包括所謂的「人本主義AI」(humanist AI)原則。
《華爾街日報》指出,鑑於目前關於AI恐失控毀滅人類之說引發熱烈爭論,微軟選擇現在發布該準則。
微軟執行長納德拉(Satya Nadella)在微軟發布新規前於社群網站X平台寫道:「如果我們開發的AI不能造福人類,也不能受到人類的控制,那麼它就沒有存在的必要。」
該準則首先預測,在未來十年內,超智慧AI系統將在大多數任務中超越人類的表現。 行為準則指出:「控制、駕馭和協調如此強大的力量,是人類有史以來面臨的最大挑戰之一」,「因此,我們必須完全清楚我們為何要創造這些系統,以及我們打算如何控制它們。」
根據微軟的準則,其AI模型不得考慮與武器製造相關的請求,不得產生暴力或色情內容,也不得協助採購危險物質。準則也指出,AI模型不應被設計成模仿意識,也不應享有任何權利。
該準則還列出微軟AI模型應遵循的一般原則,例如,支持人類而非取代人類,以及促進人類繁榮,還有旨在落實這些原則的具體安全約束。
🔗 延伸閱讀《三大巨頭達共識!Anthropic喊AI超出控制 阿特曼馬斯克挺放緩研發》
🔗 延伸閱讀《毛利率衝破80%!才憂AI失控喊踩煞車 Anthropic預計連兩季獲利》
科技網站Tech Crunch指出,微軟這項準則的發布正值各界對於AI安全空前關注之際,一系列AI代理失控事件以及Anthropic研究員因AI導致人類滅絕的風險日益增加,都促使人們更加關注AI安全。
蘇萊曼直言,AI可能失去控制的擔憂並非空穴來風,而是真實存在。
在微軟的系統中,每個模型都有一套凌駕於使用者個人偏好或任何特定任務之上的整體行為準則。這包括禁止網路攻擊、核武或深度偽造製作的「絕對限制」。此外,它還包含更廣泛的條款,以防止人類失去對模型的控制。
報導指出,微軟這份準則比Anthropic執行長阿莫戴(Dario Amodei)近期呼籲的「調控尖端AI發展步伐」(Pacing the Frontier)更為具體,著重闡述微軟AI模型訓練的價值觀和底線。
微軟、Anthropic、OpenAI和xAI等科技巨頭在內的逾千名AI業界人士,廣泛採用這項倡議的整體方法,尤其支持在AI實驗室部署第三方嵌入式評估人員(Embedded Evaluators),以確保AI的訓練和部署流程符合安全規範。


