DeepSeek-V3.2-Exp发布,API成本降低50%以上
9月30日消息,DeepSeek通过官方公众号宣布,正式发布实验性大语言模型DeepSeek-V3.2-Exp。该版本作为迈向新一代架构的过渡产物,在V3.1-Terminus基础上引入自研的DeepSeek Sparse Attention(DSA)稀疏注意力机制,重点针对长文本场景的训练与推理效率开展技术验证与优化。
据介绍,DeepSeek Sparse Attention(DSA)首次实现了细粒度稀疏注意力机制,在几乎不影响模型输出效果的前提下,实现了长文本训练和推理效率的大幅提升。

为了严谨地评估引入稀疏注意力带来的影响,DeepSeek特意将DeepSeek-V3.2-Exp的训练设置与V3.1-Terminus 进行了严格的对齐。在各领域的公开评测集上,DeepSeek-V3.2-Exp的表现与V3.1-Terminus基本持平。

在新模型的研究过程中,需要设计和实现很多新的GPU算子。DeepSeek使用高级语言TileLang进行快速原型开发,以支持更深入的探索。在最后阶段,以TileLang作为精度基线,逐步使用底层语言实现更高效的版本。
因此,本次开源的主要算子包含TileLang与CUDA两种版本。DeepSeek建议社区在进行研究性实验时,使用基于TileLang的版本以方便调试和快速迭代。

目前,官方App、网页端、小程序均已同步更新为DeepSeek-V3.2-Exp,同时API大幅度降价,开发者调用DeepSeek API的成本将降低50%以上。
相关阅读
- Arm 发布《人工智能就绪指数报告》,定义全球 AI 实施新基准
- 苹果公司宣布增加美国制造业投资至 6000 亿美元,推出美国制造计划
- 投资约80亿元!德方纳米年产50万吨新型磷酸盐系正极材料项目落地
- 马斯克脑机接口公司Neuralink准备进行第二例植入手术
- sureCore PowerMiser IP 使用于人工智能应用的鲁汶工程大学芯片可实现 40% 以上的动态节电
- ExaGrid发布2025财年业绩——季度和年度表现双双创纪录
- 国际人工智能产业联盟AI+医疗健康闭门论坛新共识:技术革命必须以患者为中心
- 奥特维获光伏龙头2.1亿元划焊一体机等设备订单
- 康宁公布 2024 年第三季度财报,宣布“Springboard”计划重大进展
- Gartner:2024年全球IT总支出预计将达5万亿美元