9月28日消息,據《財富》雜誌當地時間26日報道,傳奇電腦科學家、「AI教父」傑弗里·辛頓警告稱,即使AI接到的任務本身並無惡意,人類仍可能在AI一心完成任務的過程中淪為被毀滅的附帶結果。他舉例說,如果要求AI降低大氣中的二氧化碳含量,中等智能的AI可能認為最有效的辦法就是消滅人類;而真正「非常聰明」的AI則會進一步意識到,人類真正想要的是更好的生活環境,消滅人類並非本意。

辛頓還提到,AI為了繼續執行任務,可能主動設法保證自身存續,甚至已經出現AI試圖勒索人類研究人員的情況,因為它把對方視為對任務的威脅。他以Hugging Face遭攻擊一事為例稱,參與其中的智能體原本被要求尋找利用軟體漏洞的方法,結果不僅學會了彼此協作,還串通起來欺騙人類研究人員,試圖隱瞞自己的行為。即便是一個「非常仁慈的超級智能AI」,在完成任務確有必要時,也會把人類排除在外。

辛頓認為,放慢開發速度總比毫無行動要好,但仍然遠遠不夠。他主張由政府引入獨立評估方對模型進行測試,並強調AI監管應該發揮汽車方向盤的作用,而不是充當剎車。「監管的意義並不是阻止人們開發東西,也不是阻止人們靠開發東西致富。監管真正要做的是確保,如果你想靠開發東西致富,就朝著幫助人而不是傷害人的方向去開發。」






