阿里巴巴發布了其最新旗艦大語言模型Qwen3.8,並聲稱這是目前最強大的模型之一。
具體而言,該公司在周日的發布公告中稱,Qwen3.8"僅次於Fable 5",即Anthropic備受矚目的旗艦模型。然而,阿里巴巴既未提供模型卡,也未給出任何基準測試數據或其他有價值的資訊。
值得注意的是,此次發布恰好是在競爭對手——中國AI公司月之暗面推出Kimi K3後數日內。Kimi K3在Arena編程排行榜上登頂,並在內部基準測試中與Anthropic和OpenAI旗下的系統相抗衡,同時獲得BBC、彭博社等主流媒體的廣泛報道。
儘管月之暗面尚未公布K3的模型權重,但已發布了相當詳實的技術說明文檔,包含與其他主流系統的完整基準對比表、架構細節以及定價資訊,並將開放權重的日期定在7月27日。
相比之下,阿里巴巴在很大程度上僅憑一條X平台發帖就發出了這一大膽聲明。此外,該帖子還出現了若干語法錯誤,其中一處將"兼容"(compatible)與"可比"(comparable)明顯混淆。雖然這並非致命問題,但對於一款意圖躋身前沿競爭的模型來說,這類細節難免令人對此次發布缺乏信心。
開放權重AI的整體市場需求在今年快速增長。分析師和基礎設施供應商認為,開放模型與閉源前沿模型之間的差距已縮短至約四個月,且成本僅為後者的一小部分。
這種價格差距正在改變企業採購AI的方式。今年6月,The New Stack報道稱,AI智能體初創公司Lindy正將全部生產流量從Anthropic模型遷移至DeepSeek
v4,其CEO表示此舉將為公司節省數百萬美元。供應商鎖定也成為日益突出的隱患,業界許多人士警告過度依賴單一專有模型棧的風險。
Qwen在這一趨勢中受益頗豐。基礎設施提供商Runpod的平台數據顯示,Qwen已超越Meta的Llama,成為其用戶中部署量最大的開放權重大語言模型。
然而,儘管Qwen憑藉高產的開放權重發布建立起了良好聲譽,其最近兩款旗艦模型卻打破了這一慣例。今年4月發布的Qwen3.6-Max-Preview是Qwen歷史上首個僅提供API訪問、不公開權重的旗艦模型;5月隨後推出的Qwen3.7-Max同樣是閉源的,既無本地可運行版本,也未公布相關計劃。
此次Qwen3.8發布時,阿里巴巴明確表示將以開放權重形式發布,似乎是在回歸初心。但最大的疑問在於:何時發布?以及這次發布的時機究竟是出於對開放性的承諾,還是針對某個特定競爭對手的戰略考量?
私募股權公司Fortino Capital的AI運營合伙人、前Hugging Face和AWS AI布道者朱利安·西蒙(Julien Simon)認為,真正的關鍵在於他所說的"檢查點空缺"——即從前沿聲明發出到任何人都能驗證的實際產物出現之間的時間窗口。
"Kimi K3發布時的每一項主張都可以按日曆逐條核驗。"
西蒙在周日發表的The AI Realist新聞通訊中指出,Kimi K3的空缺期"激進但有章可循":有基準測試表、公開的定價,以及7月27日這一明確的權重發布日期。
"那次發布中的每一項聲明,都可以與日曆逐條對照核驗,"他寫道。
相比之下,Qwen3.8同樣存在這樣的空缺期,卻缺乏任何約束:沒有基準表,沒有定價,沒有日期——只有一句含糊的"即將開放權重"。一個沒有截止日期的空缺期,實際上是供應商可以隨時行使的選項,同時又能持續"收割開放權重的敘事紅利"。
這兩款模型背後,其實都與同一家公司有所關聯。截至2024年,阿里巴巴是月之暗面的最大股東,已累計投入約8億美元,當時持股比例約為36%——此後隨著月之暗面融資規模和估值的持續攀升,該持股比例可能已有所稀釋。
據報道,僅Kimi K3的發布就導致全球半導體市值在數日內蒸發逾3萬億美元。而就在數日之後,阿里巴巴發布了一款參數規模略小的模型(2.4萬億 vs 2.8萬億),聲稱排名略高,並同樣打上了"開放權重"的標籤——卻缺少關鍵細節。
"從文字到數據之間的空缺越長,說明發布本身才是真正的產品。"
眼前一個顯而易見的問題是:一家公司為何要與自己的被投企業競爭?西蒙的解釋歸結於:一張真正的基準測試表,將迫使阿里巴巴披露不願公開的資訊。他認為,若數字足夠亮眼、能夠超越Kimi K3,則會讓阿里巴巴持有的月之暗面股權顯得不如押注自家模型合算——而此時月之暗面正規劃上市。若數字不及預期,則直接讓"僅次於Fable 5"的定位站不住腳。兩頭都不表態,反而成了最優解——Qwen得以在媒體頭條和企業對話中搶占位置,同時又無需與K3並排接受檢驗。
"從文字到數據之間的空缺越長,說明發布本身才是真正的產品,"西蒙寫道。
簡而言之,這次公告從一開始就不是真正關於模型本身的,更多是為了借勢一個備受矚目的競爭對手,將自己插入話題中心。
"對於一個2.4萬億參數的模型來說,缺失架構細節至關重要。"
目前已出現一些對Qwen3.8進行獨立基準測試的早期嘗試。其中一項於周日發布,由Trilogy公司AI卓越中心副總裁李奧納多·岡薩雷(Leonardo Gonzalez)在相同任務上將託管預覽版與Kimi K3進行了對比。但這僅是一次測試,由單一評審者評分,測試對象是阿里巴巴自稱在正式發布前仍會持續變更的預覽版本,遠不能替代阿里巴巴迄今尚未發布的正式基準測試表。
"對於一個2.4萬億參數的模型來說,缺失架構細節至關重要,"岡薩雷坦言。
目前,Qwen3.8仍停留在最初的狀態:一個對標Anthropic的漂亮標題,僅此而已。
Q&A
Q1:Qwen3.8和Kimi K3在發布方式上有什麼不同?
A:Kimi K3發布時附有完整的基準測試表、公開定價和明確的權重發布日期(7月27日),資訊透明可供核查。而Qwen3.8的發布則缺乏上述關鍵資訊,僅在X平台發帖聲稱性能"僅次於Fable 5",未提供基準數據、定價或具體發布時間,可信度存疑。
Q2:阿里巴巴既投資月之暗面,又發布Qwen3.8與之競爭,原因是什麼?
A:分析人士認為,阿里巴巴選擇不公開詳細基準數據,可能是為了規避兩難局面:若Qwen3.8數據優於Kimi K3,會令自身對月之暗面的投資顯得不明智;若數據不如Kimi K3,則會直接否定其"僅次於Fable 5"的聲明。因此,含糊其辭反而是最安全的策略。
Q3:Qwen系列模型在開放權重方面有什麼歷史?
A:Qwen此前以高頻發布開放權重模型著稱,一度超越Meta的Llama成為Runpod平台上部署量最大的開放權重大語言模型。但近兩款旗艦產品——Qwen3.6-Max-Preview和Qwen3.7-Max均為閉源,僅提供API訪問。Qwen3.8宣稱將恢復開放權重,但未給出具體日期。






