[新聞] DeepSeek再出招!更新V4模型版本 推理速度提升最高85%
工商時報
2026.06.28 10:29 工商時報 張全慶
DeepSeek再出招!更新V4模型版本 推理速度提升最高85%
完成人民幣500億元融資後,大陸AI模型開發商DeepSeek可謂動作頻頻,不僅大舉擴招團隊
規模,更在近日為旗下最新V4模型更新版本,據稱可將該模型推理速度最高提升85%,同時
大幅降低了部署成本。
綜合陸媒報導,DeepSeek在6月27日更新了V4模型,推出推測解碼(Speculative Decoding
)框架DSpark,並開源了全棧工具DeepSpec。
DeepSeek-V4-Pro-DSpark並非全新架構模型,而是在DeepSeek-V4-Pro的基礎上引入了推測
解碼模組。因此,此次更新的重點在於工程應用,而非模型能力本身的反覆運算。
推測解碼是一種在不影響模型輸出結果的前提下,有效提升推理效率的技術。該技術先由羽
量級模型預先生成候選內容,再交由主模型進行驗證,從而加快大型語言模型(LLM)的推
理速度。
DeepSpec則是用於訓練與評估推測解碼草稿模型(Draft Model)的完整開源工具,包含資
料準備、模型訓練、草稿模型實現及性能評估等功能。這可協助研究人員直接訓練推測解碼
模型,大幅降低部署門檻。
根據DeepSeek創始人梁文鋒與北京大學共同發表的論文,將DSpark部署在DeepSeek-V4線上
服務系統中並在真實使用者流量環境下運行,可有效減少因無效驗證而造成的算力浪費。
相較於既有的生產環境基準方案,DSpark在相同輸送量下,可將單一使用者的生成速度提升
60%至85%。
據OpenRouter的資料顯示,在大陸更加低廉的大模型Token定價衝擊下,截至今年6月,向谷
歌、OpenAI和Anthropic模型發出的Token請求份額,已從一年前的72%大幅降至33%;而截
至3月,大陸AI模型的市占率已攀升至60%以上。
https://www.ctee.com.tw/news/20260628700307-430804
------
便宜治百病,
各種成本比不上,
電力也沒中國那樣量大管飽,
中國還發展初期就已加入競爭
美國AI大廠,
該不會還沒進入高利潤收割期,
就要被中國給卷死了吧?
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 211.23.3.56 (臺灣)
※ 文章網址: https://www.ptt.cc/bbs/Gossiping/M.1782696415.A.99E.html
噓
06/29 09:33,
1月前
, 1F
06/29 09:33, 1F
噓
06/29 09:36,
1月前
, 2F
06/29 09:36, 2F
→
06/29 09:37,
1月前
, 3F
06/29 09:37, 3F
推
06/29 09:38,
1月前
, 4F
06/29 09:38, 4F
推
06/29 09:38,
1月前
, 5F
06/29 09:38, 5F
噓
06/29 09:45,
1月前
, 6F
06/29 09:45, 6F
→
06/29 09:45,
1月前
, 7F
06/29 09:45, 7F
推
06/29 09:46,
1月前
, 8F
06/29 09:46, 8F
→
06/29 09:47,
1月前
, 9F
06/29 09:47, 9F
→
06/29 09:48,
1月前
, 10F
06/29 09:48, 10F
→
06/29 09:48,
1月前
, 11F
06/29 09:48, 11F
→
06/29 09:49,
1月前
, 12F
06/29 09:49, 12F
→
06/29 09:49,
1月前
, 13F
06/29 09:49, 13F
推
06/29 09:58,
1月前
, 14F
06/29 09:58, 14F
推
06/29 10:36,
1月前
, 15F
06/29 10:36, 15F
→
06/29 10:38,
1月前
, 16F
06/29 10:38, 16F
→
06/29 10:40,
1月前
, 17F
06/29 10:40, 17F
→
06/29 10:47,
1月前
, 18F
06/29 10:47, 18F
→
06/29 10:47,
1月前
, 19F
06/29 10:47, 19F