DeepSeek 发布实验性模型 DeepSeek-V3.2-Exp,核心突破在于引入 DeepSeek Sparse Attention(DSA)稀疏注意力机制,首次实现细粒度稀疏注意力,在几乎不影响模型输出效果的前提下,大幅提升长文本的训练与推理效率。官方将新模型训练设置与 V3.1-Terminus 严格对齐,在各领域公开评测集上表现基本持平。得益于效率提升,API 调用成本直降超过 50%,开发者可更低成本构建应用。目前官方 App、网页端、小程序及标准 API 均已默认切换至新模型,模型已在 HuggingFace 与魔搭开源,论文同步公开。为便于对比,V3.1 模型 API 通道限时保留至 2025 年 10 月 15 日,且调用价格与新版相同。此次发布意味着长文本处理效率与成本结构同时迎来实质性改善。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅