deepseek-v3.2
DeepSeek · deepseek-v3.2
我们推出 DeepSeek-V3.2,这是一款兼顾高计算效率与卓越推理及智能体(agent)性能的模型。我们的方法建立在三大关键技术突破之上: 1. DeepSeek 稀疏注意力(DSA): 我们推出了 DSA,一种高效的注意力机制,在保持模型性能的同时大幅降低计算复杂度,并针对长上下文场景进行了专门优化。 2. 可扩展强化学习框架: 通过实施稳健的强化学习方案并扩展后训练计算,DeepSeek-V3.2 的表现与 GPT-5 相当。值得注意的是,我们的高算力变体 DeepSeek-V3.2-Speciale 超越了 GPT-5,并展现出与 Gemini-3.0-Pro 相当的推理能力。 - 成就: 🥇 在 2025 年国际数学奥林匹克(IMO)和国际信息学奥林匹克(IOI)中斩获金牌水平的表现。 3. 大规模智能体任务合成管线: 为了将推理能力整合到工具使用场景中,我们开发了一种全新的合成管线,可系统性地大规模生成训练数据。这促进了可扩展的智能体后训练,提升了在复杂交互环境中的顺从度与泛化能力。






