DeepSeek 正式发布实验性模型 DeepSeek-V3.2-Exp。 本期专刊分三篇文章,分别讲清楚 DSA 稀疏注意力、API 定价下调, 以及 V3.1-Terminus 限时保留这三件事。
三篇文章,分别对应这一版模型迭代的三个关键点。
细粒度稀疏注意力机制如何在几乎不影响输出效果的前提下,让长文本训练和推理效率大幅提升。
成本下降最直接的受益者是开发者。这一篇讲清楚价格变化、默认模型切换与官方平台同步升级。
为了让新旧版本可以对照测试,官方保留了 V3.1-Terminus 的临时通道,价格与 V3.2-Exp 相同。