SuperCLUE發布DeepSeek V4 Pro正式版中文評測,該模型8月13日發布,其智能體編程進步顯著。其原生支持百萬級長文本解析,官方稱推理、編程、智能體任務達行業第一梯隊。

本次評測對比13個國產模型,設六大考核項,智能體編程權重占25%。相比預覽版,DeepSeek V4 Pro核心分數提升明顯:智能體編程從47.37分升至63.16分,漲15.85分;智能體任務規劃漲6.48分;幻覺控制從79.70分升至89.73分;推理耗時也得到優化。但精確指令遵循小幅下滑,顯示團隊優先強化長鏈路智能體與深度推理能力。


橫向對比Qwen3.8 Max,其幻覺推理更優,但指令遵循、智能體編程仍有差距,智能體任務規劃差約5分。測試均為純文本場景,限制了智能體任務規劃表現。
總體而言,此次更新亮點在編程與智能體能力,適合開發者處理代碼及複雜任務規劃。但並非全維度增強,部分能力仍需優化,用戶選型應結合實際需求判斷。






