谷歌今日推出了迄今為止最強大的入門級人工智慧模型。
Gemini 3.7 Flash 在上一代產品發布僅三周後便正式上線。儘管發布周期較短,谷歌工程師仍實現了輸出質量的顯著提升。谷歌表示,Gemini 3.7 Flash 在九項基準測試中均超越了來自 Anthropic 和 OpenAI 的同類模型。
其中一項奪得第一名的評測為 FrontierCode 1.1 Main,該基準包含 100 個涵蓋多種編程語言的編程任務,不僅要求模型生成可運行的代碼,還需滿足企業軟體項目中常見的其他要求,包括代碼在提交前須經過錯誤測試,並遵循項目特定的代碼風格規範。
與上一代相比,Gemini 3.7 Flash 在生成用戶界面方面表現尤為突出。谷歌表示,該模型設計的布局與用戶上傳的參考圖像更為貼合。此外,Gemini 3.7 Flash 每次提示最多可處理 100 萬個 Token 的圖片、影片和文本內容,響應輸出最多可包含 64,000 個 Token 的文本。
谷歌產品管理高級總監 Tulsee Doshi 在部落格中寫道:"Gemini 3.7 Flash 相較於 3.6 Flash,為開發者帶來了明顯改善的使用體驗。它能更好地應對障礙,在必要時澄清意圖,並以更高的準確性執行指令。它的思考更加嚴謹,在多步驟規劃和工具調用方面投入了更多精力。"
該模型的應用範圍不局限於編程領域。谷歌通過 GDP.pdf 基準對其進行了測試——這是一項要求模型回答商業文檔相關問題的評測,Gemini 3.7 Flash 正確回答了 34% 的問題,分別領先 Claude Sonnet 5 和 GPT-5.6 Terra 達 6% 和 9.3%。此外,谷歌表示 Gemini 3.7 Flash 還可用於驅動 AI 智能體集群
。
谷歌未透露該模型的具體架構。Gemini 3.7 Flash 的模型說明卡顯示,其架構與上一代 Gemini 3.6 Flash 相同,而後者源自 Gemini 3 Pro,該模型採用基於 Transformer 的混合專家架構
。
Gemini 3.7 Flash 的模型說明卡中同樣未提供訓練相關資訊。開發者通常會通過蒸餾同系列中更強大模型的輸出來訓練入門級神經網路。例如,Meta 近期發布的 Muse Glimmer 大語言模型便是通過蒸餾 Muse Spark 得到的。
谷歌將在年底前以 Gemini 3.6 Flash 半價的方式向開發者開放 Gemini 3.7 Flash 的訪問權限。此外,谷歌還將把該模型引入 Gemini Spark——這是一款於今年三月推出的面向消費者的 AI 智能體,能夠瀏覽網頁並在其他谷歌服務中執行操作。
Q&A
Q1:Gemini 3.7 Flash 和上一代 Gemini 3.6 Flash 相比有哪些提升?
A:Gemini 3.7 Flash 在多項能力上有顯著改進:生成用戶界面時與參考圖像的匹配度更高;在多步驟規劃和工具調用上表現更穩定;在 FrontierCode 1.1 Main 等編程基準以及 GDP.pdf 商業文檔問答基準中均超越同類競品。此外,它還支持每次提示處理最多 100 萬個 Token,輸出最多 64,000 個 Token 的文本內容。
Q2:Gemini 3.7 Flash 的架構是什麼?
A:根據谷歌發布的模型說明卡,Gemini 3.7 Flash 採用與 Gemini 3.6 Flash 相同的架構,該架構源自 Gemini 3 Pro,核心為基於 Transformer 的混合專家(Mixture-of-Experts)架構。谷歌未進一步披露該模型的詳細架構資訊及訓練方式。
Q3:Gemini 3.7 Flash 的價格如何?普通用戶能用到嗎?
A:谷歌表示,在今年年底前,開發者可以以 Gemini 3.6 Flash 半價的價格訪問 Gemini 3.7 Flash。對於普通用戶,谷歌還將把該模型接入 Gemini Spark——一款面向消費者的 AI 智能體,於今年三月上線,支持網頁瀏覽及在谷歌其他服務中執行操作。






