【太平洋科技快訊】9 月 29 日消息,深度求索公司正式發布 deepseek-v3.2-exp 模型。據官方消息,這是一個實驗性(experimental)版本,旨在通過技術創新提升模型在處理長文本時的效率表現。
據了解,v3.2-exp 模型在 v3.1-terminus 的基礎上引入了稀疏 deepseek sparse attention 架構。該架構專門針對長文本的訓練和推理效率進行了探索性優化,能夠有效降低計算資源消耗並提升模型推理效率。
雖然該模型已在公開評測集上完成有效性驗證,但仍需在用戶真實使用場景中進行更廣泛、大規模的測試。為方便用戶進行對比測試,官方為 v3.1-terminus 臨時保留了額外api訪問介面,使得研究人員和開發者能夠同時訪問新舊兩個版本,便於在實際應用中比較性能差異。
科技分類資訊推薦
-
漲價壓不住、補貼夠不著,這個五一6000元以上機型難住手機經銷商 - 天天要聞 -
AI能否超越人類?中南大學院士,走進武鋼三中,開講「硬核」AI課 - 天天要聞 -
引領科技豪華MPV新風尚 第二代騰勢D9西安車展亮相 - 天天要聞 -
採購禁入!科華數據材料造假被拒門外 - 天天要聞 -
潮聲丨「硅基」勞動節來了,揭秘AI智能體的「五一」勞動日誌 - 天天要聞 -
馬斯克手撕OpenAI:一場「初心」保衛戰,還是富人的「酸葡萄」? - 天天要聞 -
五一25城車展,ID. 與眾家族齊亮相,購車權益最高享5.6萬 - 天天要聞 -
快評樂道L80:15萬元級買大五座,這波值得沖? - 天天要聞 -
成都直擊凱威德:純電全尺寸SUV的張揚與大氣 - 天天要聞 -
空氣炸鍋哪個品牌最好?2026十大品牌排行榜深度橫評,誰最靠譜 - 天天要聞
科技分類視頻推薦