【太平洋科技快讯】9 月 29 日消息,深度求索公司正式发布 deepseek-v3.2-exp 模型。据官方消息,这是一个实验性(experimental)版本,旨在通过技术创新提升模型在处理长文本时的效率表现。
据了解,v3.2-exp 模型在 v3.1-terminus 的基础上引入了稀疏 deepseek sparse attention 架构。该架构专门针对长文本的训练和推理效率进行了探索性优化,能够有效降低计算资源消耗并提升模型推理效率。
虽然该模型已在公开评测集上完成有效性验证,但仍需在用户真实使用场景中进行更广泛、大规模的测试。为方便用户进行对比测试,官方为 v3.1-terminus 临时保留了额外api访问接口,使得研究人员和开发者能够同时访问新旧两个版本,便于在实际应用中比较性能差异。
科技分类资讯推荐
-
涨价压不住、补贴够不着,这个五一6000元以上机型难住手机经销商 - 天天要闻 -
AI能否超越人类?中南大学院士,走进武钢三中,开讲“硬核”AI课 - 天天要闻 -
引领科技豪华MPV新风尚 第二代腾势D9西安车展亮相 - 天天要闻 -
采购禁入!科华数据材料造假被拒门外 - 天天要闻 -
潮声丨“硅基”劳动节来了,揭秘AI智能体的“五一”劳动日志 - 天天要闻 -
马斯克手撕OpenAI:一场“初心”保卫战,还是富人的“酸葡萄”? - 天天要闻 -
五一25城车展,ID. 与众家族齐亮相,购车权益最高享5.6万 - 天天要闻 -
快评乐道L80:15万元级买大五座,这波值得冲? - 天天要闻 -
成都直击凯威德:纯电全尺寸SUV的张扬与大气 - 天天要闻 -
空气炸锅哪个品牌最好?2026十大品牌排行榜深度横评,谁最靠谱 - 天天要闻
科技分类视频推荐