DeepSeek 推出全新實驗模型 V3.2-Exp:首創稀疏注意力機制,API 價格全面砍半

DeepSeek 發布實驗性模型 V3.2-Exp,導入稀疏注意力機制(DSA)提升長文本訓練與推論效率。

• DeepSeek 正式推出最新實驗模型 DeepSeek-V3.2-Exp,現已全面在 App、Web 與 API 上線。 • 該模型基於 V3.1-Terminus 打造,首度導入 DeepSeek Sparse Attention (DSA) 技術。 • DSA 技術能在對輸出品質影響極小的狀況下,實現更細粒度的稀疏注意力,大幅提升長文本處理效能並降低計算成本。 • 效能評測顯示,V3.2-Exp 的表現與 V3.1-Terminus 不相上下。 • 官方同步宣佈 API 價格大降 50% 以上,即日起立即生效以回饋開發者。 • 為了方便進行對比測試,V3.1-Terminus 將透過臨時 API 持續提供至 2025 年 10 月 15 日。 • 此次更新同步釋出開源模型、技術報告以及基於 TileLang 與 CUDA 的關鍵 GPU 核心。


來源:DeepSeek

閱讀原文 ↗
← 回首頁