首页 景点排名文章正文

DeepSeek-V3.2-Exp模型发布 引入稀疏架构提升推理效率

景点排名 2025年09月29日 19:01 0 aa

【太平洋科技快讯】9 月 29 日消息,深度求索公司正式发布 DeepSeek-V3.2-Exp 模型。据官方消息,这是一个实验性(Experimental)版本,旨在通过技术创新提升模型在处理长文本时的效率表现。

DeepSeek-V3.2-Exp模型发布 引入稀疏架构提升推理效率

据了解,V3.2-Exp 模型在 V3.1-Terminus 的基础上引入了稀疏 DeepSeek Sparse Attention 架构。该架构专门针对长文本的训练和推理效率进行了探索性优化,能够有效降低计算资源消耗并提升模型推理效率。

DeepSeek-V3.2-Exp模型发布 引入稀疏架构提升推理效率

虽然该模型已在公开评测集上完成有效性验证,但仍需在用户真实使用场景中进行更广泛、大规模的测试。为方便用户进行对比测试,官方为 V3.1-Terminus 临时保留了额外API访问接口,使得研究人员和开发者能够同时访问新旧两个版本,便于在实际应用中比较性能差异。

发表评论

长征号 Copyright © 2013-2024 长征号. All Rights Reserved.  sitemap