🔥 今日值得一读 DeepSeek V3.2炸裂发布:长文本效率飙升,API价格直降超50%!
DeepSeek V3.2 发布:长文本能力新突破,API 价格砍半
极客公园 🔥 重点 大模型论文方法开源 🕐 今天 20:56

📖 AI 总结

DeepSeek 发布实验性模型 DeepSeek-V3.2-Exp,核心突破在于引入 DeepSeek Sparse Attention(DSA)稀疏注意力机制,首次实现细粒度稀疏注意力,在几乎不影响模型输出效果的前提下,大幅提升长文本的训练与推理效率。官方将新模型训练设置与 V3.1-Terminus 严格对齐,在各领域公开评测集上表现基本持平。得益于效率提升,API 调用成本直降超过 50%,开发者可更低成本构建应用。目前官方 App、网页端、小程序及标准 API 均已默认切换至新模型,模型已在 HuggingFace 与魔搭开源,论文同步公开。为便于对比,V3.1 模型 API 通道限时保留至 2025 年 10 月 15 日,且调用价格与新版相同。此次发布意味着长文本处理效率与成本结构同时迎来实质性改善。

🔍 深度解读 换个视角,同一件事有不同答案

正在读取芙娘的解读…
infoAI 公众号二维码

📱 每天一份 AI 前沿日报

关注公众号,每天 09:00 推送 · 不错过任何重磅