話說,Kimi K3帶來的巨大震動還沒結束,國產大模型又迎來了兩條重磅消息。
第一條來自阿里。
今天,阿里通義千問團隊預告,
Qwen3.8很快將發佈並開源,新模型參數2.4T,正在以“天”爲單位持續進化,可能是除了
Fable 5外最強大的模型
。
與此同時,
Qwen3.8-Max Preview
已經率先上線Token Plan、Qoder和Qoder Work。官方介紹稱,新模型總參數達到
2.4T
,並且正在以”天”爲單位持續進化,內部目標直指全球最強模型。
第二條來自DeepSeek。 多家媒體和開發者消息顯示, DeepSeek V4正式版已經進入灰度測試 ,測試視頻已經流出。按照目前業內流傳的信息, 最快有望於明天正式發佈 ,不過截至目前,DeepSeek官方尚未公佈具體發佈時間。
如果消息屬實,那麼就在Kimi K3發佈後不到一週,中國三家頭部大模型公司——月之暗面、阿里、DeepSeek,將連續推出自己的最新旗艦模型。這種更新節奏,即便放到全球AI行業來看,也非常罕見。
更重要的是,它們已經不是在爭”國產第一”了,而是在衝擊全球第一梯隊。
Kimi K3率先打響了這一槍。作爲目前全球最大的開源權重模型,它擁有 2.8T總參數 ,在Web開發、Agent、長程Coding等多個第三方評測中躋身全球第一梯隊,甚至部分榜單已經逼近Anthropic最新的Claude Fable 5,因此一經發布便引發海外開發者圈廣泛討論。
緊隨其後的Qwen3.8,雖然總參數略低於Kimi K3( 2.4T vs 2.8T ),但阿里此次釋放出的信號同樣強烈:官方直接表示,新模型正在快速迭代,也有開發者試用後認爲,其Coding能力已經開始逼近Claude Fable 5。不過,目前完整的技術報告和第三方基準測試尚未公佈,這一判斷仍有待驗證。
至於DeepSeek,更值得關注的是它會不會再次刷新”性能/成本比”。過去一年,DeepSeek最擅長的不是單純堆參數,而是用更低的訓練和推理成本,把模型能力推到全球領先水平。 之前, 有測試者稱,DeepSeek V4正式版的性能達到了 Claude Opus 4.8 的水平 。甚至有激進的人士認爲, 在某些測試中,DeepSeek V4正式甚至壓過了 Fable 5 和 GPT-5.6。當然,現在沒有正式的版本和評測出來, 但如果V4正式版能夠進一步提升推理和Agent能力,它很可能再次成爲全球開發者關注的焦點。
而就在一個多月,另一家國產頭部模型公司智譜也剛剛發佈了 GLM-5.2 。這款模型同樣獲得了不少海外開發者認可,在Agent和Coding能力上進入了全球第一梯隊,被不少分析人士認爲縮小了與國際頂尖閉源模型的差距。路透社甚至評價,中國AI公司的發佈節奏正在明顯加快,已經開始持續向OpenAI、Anthropic等美國頭部公司施壓。
回頭來看,今年這個夏天,國產大模型最大的變化,其實不是誰暫時排第一。
而是 中國頭部模型公司開始幾乎同時向全球最強模型發起衝擊 。
Kimi K3、GLM-5.2、Qwen3.8、DeepSeek V4……過去大家討論的是”中國模型還差多久”,如今討論的已經變成了:“下一週,又會是誰刷新排行榜?”