現有會員可[按此]登入。未成為會員可[按此]註冊。
[公司模式 - 關]  [懷舊模式 - 開
[Youtube 預覽 - 關]  [大字型]  [小字型]

您現在聚腳在 AI技術台內。

跳至第

發起人
DeepSeek模型更新,推理速度最高提升85%
1 個回應
韓玄

完成人民幣500億元融資之後,大陸AI模型開發商DeepSeek可謂動作頻頻,不僅大舉擴招團隊規模,更在近日推出「DSpark」框架,據稱可以將旗下最新的V4模型推理速度最高提升85%。該框架最主要的作用便是讓推理算力能更高效地運作,可進一步的降低成本。

 DeepSeek於27日推出由創辦人梁文鋒與北京大學研究團隊聯合開發的「DSpark」推理加速框架,並同步開源了支撐該版本的全端推測解碼框架「DeepSpec」。該框架並非全新模型,而是一種在高負荷情況下應對模型延遲與吞吐量難題的模組。

 推測解碼是一種在不影響結果的前提下,提升推理效率的技術。該技術先由輕量級模型預先生成草稿,再交由主模型進行驗證,從而加快模型的推理速度。DeepSpec則是用於訓練與評估推測解碼草稿模型的完整開源工具,可協助研究員直接訓練推測解碼模型。

 梁文鋒與北京大學的論文顯示,將DSpark部署在DeepSeek-V4線上服務系統中,並在真實的流量環境下運行,可有效減少因無效驗證而造成的算力浪費。在相同吞吐量下,DSpark可將單一使用者的生成速度提升60%至85%。

 由於DeepSpec本身是開源工具,意味著許多模型都可加裝DSpark進行加速,目前除DeepSeek自家模型外,包括阿里Qwen3與Google的開源模型Gemma都可適用。

 雖然DSpark不會使模型更加聰明或增加其他功能,但生成速度的提升,便意味著相同時間內同等規模的算力可承擔更多演算任務,這將使算力成本進一步下降。而DeepSeek-V4的API費用早已相較美國主流模型便宜數十倍,此舉料將加倍體現其成本優勢。


#good2#0    #bad#1  
標籤:
500億元融資[sosad2]lm


跳至第



  快速回覆 - 輸入以下項目

本討論區現只接受會員張貼文章,本站會員請先登入。非會員人仕,您可以按此加入為新會員,費用全免,並可享用其他會員服務。


上次光臨時間: 24/9/2026 23:00
今天貼文總數: 608 | 累積文章數目: 7,529,642

聯絡我們 |  服務條款 |  私隱政策
Copyright © 2026 HKGolden.com. All Rights Reserved.