GPT 5.6 發布之時:GPT-5.6來了,強到沒邊,但普通人還摸不到
DeepSeek 開源了 DSpark,給 DeepSeek-V4 Flash / Pro 裝上了一套推理加速引擎,開啟渦輪增壓模式
它的核心思路是“先打草稿,再讓大模型驗稿”:小模型先一次性預測多個 token,大模型再批量驗證,通過的直接輸出,從而大幅減少等待時間
DSpark 更厲害的地方在于,它不只是粗暴加速,而是用半自回歸生成提升草稿質量,再用置信度調度判斷哪些 token 值得驗證,把 GPU 算力用在最有效的位置
官方數據顯示,在真實線上流量中,DSpark 可讓 V4-Flash 單用戶生成速度提升 60%-85%,V4-Pro 提升 57%-78%。同時它還適配 Qwen、Gemma 等其他模型,說明這不是 DeepSeek 自用的小技巧,而是一套可擴展的開源推理加速方案
老章預測,目前開源的一眾模型,或許很快就會有 DSpark 版本,尤其是我喜愛的 Qwen3.6 27B 和 35B ,蠻期待[讓我看看]
![]()
![]()
![]()
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.