Anthropic不希望禁止開放權重AI模型。首席執行官達里奧·阿莫迪在經歷了一周的批評聲浪後,今日明確表態:他提議對所有具備足夠能力的模型,在發布前必須強制進行安全測試。問題在於,目前沒有人界定"足夠能力"從何處起算,而這一界定將直接決定未來的開放權重模型是否仍能公開獲取。
阿莫迪在公開信中寫道:"Anthropic從未主張禁止開放權重模型。"他將不具備危險能力的模型稱為"公共產品",認為此類模型除運行所需算力外不產生任何額外成本。
他的提案包含三個方面:一是收緊對先進晶片及晶片製造設備的出口管制;二是打擊工業規模的模型蒸餾行為;三是要求所有具備足夠能力的模型在發布前須通過安全評估。
前兩項針對華盛頓政策層面,第三項則將影響準備發布模型的開發者。
阿莫迪表示,安全測試的理念已接近行業共識,並指出川普政府已朝這一方向推進,且近期行業提案建議無論模型來源或許可類型,均須接受測試,同時對能力較弱的模型——例如來自初創公司和學術界的模型——給予豁免。然而,這一豁免條款至關重要:初創公司的界定本身就難以釐清。一旦某些模型獲得豁免而另一些不得豁免,該政策本質上就變成了以另一種名義劃定的能力門檻。
那麼,這條線究竟畫在哪裡?目前沒有人給出答案。
這封公開信也未說明由誰來設定具體數值,由誰來執行測試。模型能力可通過基準測試結果、訓練算力或針對特定風險類別的評分等指標來衡量,而所選指標將直接決定模型類型的劃分方式。換言之,誰來選定指標,誰就在為每一個公開權重的實驗室設定發布節奏。
這是一個快速演變的議題。目前,"開放權重與美國AI領導力"聯署信已有50位簽署方,OpenAI和谷歌加入了微軟、英偉達
、Meta、AMD、思科、Cloudflare、GitHub和Ollama的行列。Anthropic和亞馬遜則是引人注目的缺席者。
本周一,英偉達宣布成立"開放安全AI聯盟",發起成員超過35家,包括微軟、IBM、Hugging Face、Palantir、紅帽、CrowdStrike以及Linux基金會。Anthropic未列其中。英偉達的主張是:防禦方需要開放的前沿模型來調查安全事件,並援引近期案例——封閉工具阻礙了對Hugging Face某事件的取證分析,最終由Hugging Face藉助開放權重模型完成了相關調查。
值得肯定的是,阿莫迪直接回應了最顯而易見的批評。他表示,美國若實施禁令,主要效果不過是保護國內AI公司免受競爭,對阻止惡意行為者收效甚微。"這只會保護美國AI公司不受競爭威脅,但那從來不是我的目標。"此言不虛。不過,Anthropic本身並不發布開放權重模型,這番表態因此難免顯得底氣不足。
阿莫迪承認,安全測試"需要在全球層面推行,這意味著就連中國共產黨也需要認可",並認為這或許可以實現。這可能是整個議題中最懸而未決的問題。出口管制和反蒸餾措施都是華盛頓可以單邊推行的政策,而全球性的能力測試機制則截然不同。對開放權重模型影響最為直接的這一提案,依賴於尚不存在(甚至可能永遠不會存在)的廣泛國際協議。
Q&A
Q1:達里奧·阿莫迪對開放權重模型的具體提案是什麼?
A:阿莫迪提出三項措施:收緊先進晶片及製造設備的出口管制、打擊工業規模的模型蒸餾行為,以及要求所有具備足夠能力的模型在發布前強制通過安全評估。其中第三項直接影響開發者,但目前尚無人界定"足夠能力"的具體標準,也未明確由誰來執行測試。
Q2:"開放權重與美國AI領導力"聯署信有哪些主要簽署方?
A:目前該聯署信已有50位簽署方,包括OpenAI、谷歌、微軟、英偉達、Meta、AMD、思科、Cloudflare、GitHub和Ollama。值得注意的是,Anthropic和亞馬遜是其中引人關注的缺席者。此外,英偉達還另行成立了"開放安全AI聯盟",發起成員超過35家,同樣不包括Anthropic。
Q3:為什麼全球統一的AI能力測試機制很難實現?
A:全球統一的能力測試機制需要各國政府達成廣泛國際協議,包括中國在內的主要國家均需認可並參與。與出口管制或反蒸餾措施不同,後兩者是美國可單邊實施的政策,而全球性測試體系依賴多邊合作框架,目前這一框架尚不存在,未來能否建立也存在相當大的不確定性。






