SpaceX公司今日發布了迄今為止能力最強的大語言模型Grok
4.7。
Grok算法系列最初由伊隆·馬斯克創立的初創公司xAI Corp.開發。馬斯克去年將該公司與xAI Inc.進行合併。合併後的組織隨後併入SpaceX,SpaceX因此不僅獲得了Grok模型系列,還獲得了多個人工智慧數據中心。
該公司使用名為CursorBench 4.0的基準測試對Grok 4.7進行了評估,該基準由SpaceX近期收購的另一家公司Cursor
開發。Grok 4.7完成基準測試中挑戰任務的平均成本為每項任務4.69美元,領先於GPT-5.6 Sol和Fable 5.1。SpaceX評估的是後兩款模型中優先考慮輸出質量而非成本效益的硬體密集型版本。
該公司還使用更廣泛採用的基準測試對Grok 4.7進行了測試。該模型在分別包含法律和晶片設計任務的Harvey Legal Agent Benchmark和EEBench測試中,輕鬆超越了Fable 5.1。不過,Grok 4.7在後一項基準測試中的得分落後於OpenAI Group PBC的最新大語言模型GPT-6 Astra。
SpaceX將Grok 4.7的性能提升歸功於全新的基礎模型。大語言模型的訓練過程包含多個階段,每個階段都會改進算法開發中的不同方面。基礎模型是訓練過程第一階段結束後產生的大語言模型初始版本。AI提供商通常會在不同的大語言模型發布版本中復用基礎模型。
據SpaceX介紹,其工程師還優化了Grok 4.7的強化學習工作流程。強化學習是一種用於增強基礎模型推理能力的AI訓練方法。與前代產品相比,Grok 4.7接受了更具挑戰性的訓練任務,且訓練時間更長。
該公司在構建這款大語言模型時,使其能夠與Grok Bot框架兼容。這是一套技術資源集合,使Grok 4.7能夠將複雜工作拆分給多個AI智能體處理。這些智能體可以並行執行多項不同任務,從而加快處理速度,並相互驗證輸出結果的準確性。
SpaceX還為Grok 4.7配備了新的安全防護機制。該公司表示,該模型在LatchBio和HackerBench基準測試中創下了新紀錄,這兩項測試分別用於檢驗大語言模型阻止惡意生物學研究請求和網路安全攻擊請求的能力。
Grok 4.7的定價為每百萬輸入Token 2美元起,每百萬輸出Token 6美元起。針對對延遲敏感的工作負載,SpaceX還推出了處理速度提升一倍、價格也相應提高一倍的模型版本。
此次發布距離SpaceX上一次發布模型不到一周時間。上周五,該公司推出了一款文本轉語音模型,其準確率是前代產品的兩倍,而成本僅為前代產品的一半。SpaceX表示,Grok Voice Transcribe 2.0在文本轉語音領域的表現也超越了多個競爭對手的產品。
Q&A
Q1:Grok 4.7有哪些主要提升?
A:Grok 4.7採用了全新的基礎模型,並優化了強化學習工作流程,接受了更具挑戰性、更長時間的訓練。在多項基準測試中表現優異,尤其在成本效益方面領先於GPT-5.6 Sol和Fable 5.1等競品模型。
Q2:Grok 4.7的定價是多少?
A:Grok 4.7的定價為每百萬輸入Token 2美元起,每百萬輸出Token 6美元起。SpaceX還提供了處理速度更快的版本,價格為標準版的兩倍。
Q3:Grok 4.7在安全性方面有哪些改進?
A:SpaceX為Grok 4.7配備了新的安全防護機制,該模型在LatchBio和HackerBench基準測試中創下新紀錄,能夠有效阻止惡意生物學研究請求和網路安全攻擊請求。






