DeepSeek-V3.2-Exp 发布,训练推理提效,API 同步降价
2025-09-29 18:17:32AI云资讯1373
今天,我们正式发布 DeepSeek-V3.2-Exp 模型,这是一个实验性(Experimental)的版本。作为迈向新一代架构的中间步骤,V3.2-Exp 在 V3.1-Terminus 的基础上引入了 DeepSeek Sparse Attention(一种稀疏注意力机制),针对长文本的训练和推理效率进行了探索性的优化和验证。
目前,官方 App、网页端、小程序均已同步更新为 DeepSeek-V3.2-Exp,同时API 大幅度降价,欢迎广大用户体验测试并向我们反馈意见。
DeepSeekSparse Attention(DSA)稀疏注意力机制DeepSeek Sparse Attention(DSA)首次实现了细粒度稀疏注意力机制,在几乎不影响模型输出效果的前提下,实现了长文本训练和推理效率的大幅提升。

为了严谨地评估引入稀疏注意力带来的影响,我们特意把 DeepSeek-V3.2-Exp 的训练设置与 V3.1-Terminus 进行了严格的对齐。在各领域的公开评测集上,DeepSeek-V3.2-Exp 的表现与 V3.1-Terminus 基本持平。
论文链接 & 模型开源
DeepSeek-V3.2-Exp 模型现已在 Huggingface 与魔搭开源:
HuggingFace:
https://huggingface.co/deepseek-ai/DeepSeek-V3.2-Exp
ModelScope:
https://modelscope.cn/models/deepseek-ai/DeepSeek-V3.2-Exp
论文也已同步公开:
https://github.com/deepseek-ai/DeepSeek-V3.2-Exp/blob/main/DeepSeek_V3_2.pdf
TileLang & CUDA 算子开源在新模型的研究过程中,需要设计和实现很多新的 GPU 算子。我们使用高级语言 TileLang 进行快速原型开发,以支持更深入的探索。在最后阶段,以 TileLang 作为精度基线,逐步使用底层语言实现更高效的版本。因此,本次开源的主要算子包含 TileLang 与 CUDA 两种版本。我们建议社区在进行研究性实验时,使用基于 TileLang 的版本以方便调试和快速迭代。
API 支持得益于新模型服务成本的大幅降低,官方 API 价格也相应下调,新价格即刻生效。

在新的价格政策下,开发者调用 DeepSeek API 的成本将降低 50% 以上。
目前 API 的模型版本为 DeepSeek-V3.2-Exp,访问方式保持不变。欢迎用户使用 DeepSeek 官方的 API 服务。
用户场景对比测试作为一个实验性的版本,DeepSeek-V3.2-Exp 虽然已经在公开评测集上得到了有效性验证,但仍然需要在用户的真实使用场景中进行范围更广、规模更大的测试,以排除在某些场景下效果欠佳的可能。为方便用户进行对比测试,我们为 DeepSeek-V3.1-Terminus 临时保留了额外的 API 访问接口。用户只需修改base_url="https://api.deepseek.com/v3.1_terminus_expires_on_20251015" 即可访问 V3.1-Terminus,调用价格与 V3.2-Exp 相同。该接口将保留到北京时间 2025 年 10 月 15 日 23:59,更详细的使用方法请参考官方文档https://api-docs.deepseek.com/zh-cn/guides/comparison_testing。
相关文章
- 基石智算上线 DeepSeek-V3.1-Terminus,更强 Agent 能力
- 青云AI算力云首登 AI Ping,刷新DeepSeek吞吐性能榜首
- 破解 AI “安全与性能” 难题!DeepSeek-R1-Safe 基础大模型在华为全联接大会2025正式发布
- 声网对话式AI引擎已接入DeepSeek-V3.1
- 腾讯云上线DeepSeek-V3.1 API,智能体开发平台和TI平台同步上线
- 特斯拉在中国市场放弃xAI的Grok大模型 选择接入DeepSeek AI技术
- DeepSeek-V3.1 发布,迈向 Agent 时代的第一步
- 如何查找全国新建工程项目信息?RCC瑞达恒接入DEEPSEEK,推出AI助手
- DeepSeek-R2要来了?速领450元代金券,模型测评快人一步!
- 禁令解除72小时:141GB H20 跑满血实测,DeepSeek 性能超预期
- 工学通与 DeepSeek:AI 领域的专业细分与通用探索
- 百度AI搜索全面接入DeepSeek R1 最新版 进一步强化智能搜索体验
- 青云科技AI算力云大模型服务上线 DeepSeek-R1-0528
- AI营响力:DeepSeek和智能体写短视频脚本,有什么不同?
- 北大杨仝团队发布FairyR1模型:5%参数量数学和代码能力超越满血DeepSeek
- 中文大模型幻觉测评:豆包大模型准确率全球第一,超越DeepSeek-R1、Gemini-2.5、GPT-4o