DeepSeek-V4

DeepSeek-V4是深度求索(DeepSeek)于2026年4月24日以預覽版形式發布的人工智能大型语言模型,分為V4-Pro與V4-Flash兩個版本,是深度求索的第四代旗艦模型。

架構
DeepSeek-V4系列包含兩個採用混合专家模型(MoE)架構的大型語言模型。

  • DeepSeek-V4-Pro:總參數量為1.6兆,每個token激活490億個參數,預訓練用了33兆個token。
  • DeepSeek-V4-Flash:總參數量為2840億,每個token激活130億個參數。以V4-Pro為例,其輸出定價約為Claude Opus 4.7的七分之一。此外,深度求索在發布後數小時即宣布對V4-Pro提供75%的限時折扣,並將全平台API緩存命中輸入價格調降至原价的十分之一。

測試成績
在編程基準方面,V4-Pro在Codeforces競技程式設計評分中達到3,206分,超越GPT-5.4的3,168分,為當時所有模型中最高的競技程式設計得分。在SWE-bench Verified(衡量真實世界軟件工程任務的標準基準)中,V4-Pro得分為80.6%,僅比Claude Opus 4.6的80.8%低0.2個百分點。

不過V4-Pro在部分基準上仍落後於頂級閉源模型:在衡量專家級跨領域推理的Humanity's Last Exam中,V4-Pro得分為37.7%,低於Claude(40.0%)、GPT-5.4(39.8%)及Gemini-3.1-Pro(44.4%)。分析師指出,去年引發市場震動的特定條件,包括美國科技股高估值、對少數頭部廠商主導市場的預期,以及低成本中國AI廠商的突然崛起所帶來的市場驚訝,目前已不復存在,投資者的預期已作出相應調整。此外,Kimi、Qwen等中國AI廠商亦已縮窄與DeepSeek的差距,業內競爭日趨激烈。

在地緣政治層面,V4在华为昇腾AI芯片上進行了效率優化,外界視此為中國在美國出口管制持續收緊下,加快建立自主AI計算生態系統的重要信號。

現狀
V4目前仍處於預覽版階段,深度求索公布正式版發布時間为七月中旬。原有API端點deepseek-chat及deepseek-reasoner將於2026年7月24日正式停用,在此之前其分別轉接至V4-Flash的非思考模式與思考模式。

參見

  • DeepSeek-R1
  • DeepSeek-V3

參考資料
外部連結
官方網頁

评论 (0)

  • 还没有评论,来抢沙发吧。