DeepSeek 节前突袭发布 V3.2-Exp:长文本推理成本直降75%!

刚传完节前会有更新,DeepSeek 傍晚就甩出 DeepSeek-V3.2-Exp ------ 这次直接把长文本推理成本砍掉四分之三

该版本是一个引入了 DeepSeek Sparse Attention(一种稀疏注意力机制)的实验性(Experimental)版本,主要针对长文本的训练和推理效率进行了探索性的优化和验证。

说白了,本次升级能力提升还在其次,但"提速降本"肯定拉满。

提速:稀疏注意力机制

传统的注意力机制是逐字逐句,通读全文,记住每个字与其他字的关系。

DSA稀疏注意力则是先看目录(全局关键token ),再仔细阅读重点部分(局部窗口),跳过无关内容。

这样 AI 在面对长文本时,可以大幅提升处理性能。

降本:费用减少3/4

由于新的架构升级,算力成本大幅降低,官方 API 价格直接跳水。

单张图可能不太直观,我们拿 V3.1V3.2 直接对比下。

计费项 V3.1 V3.2 降幅
输入(缓存命中) 0.5元 0.2元 60%
输入(未命中) 4元 2元 50%
输出 12元 3元 75%
典型场景成本 100万输入+50万输出≈10元 100万输入+50万输出≈2.5元 75%

结语

现在 DeepSeek 的所有环境都已经更新为 V3.2-Exp,虽然新版本已经在公开评测集上得到了验证,但大家使用的时候依然要谨慎。

好在,这次 DeepSeek 提供了旧版本接口的回滚 API,只需要把 API 改为如下接口即可。

ini 复制代码
base_url="https://api.deepseek.com/v3.1_terminus_expires_on_20251015"

注意:该接口仅保留到北京时间 2025 年 10 月 15 日 23:59

如果你的场景正好需要长文本处理,那就趁假期赶紧试试吧~

相关推荐
来让爷抱一个37 分钟前
MonkeyCode 多模型切换技巧:什么时候用 Claude/GPT/DeepSeek
人工智能·ai编程
李白你好1 小时前
AI Agent 架构的自动化渗透测试工具
运维·人工智能·自动化
2601_949499941 小时前
8 大工业光模块供应商选型:芯瑞科技 400G OSFP 助力 AI 算力集群升级
人工智能·科技
温柔只给梦中人1 小时前
NLP学习:注意力机制
人工智能·学习·自然语言处理
广州灵眸科技有限公司1 小时前
瑞芯微RV1126B开发板(EASY-EAI-PI2) Easy-Eai编译环境准备与更新
服务器·前端·人工智能·python·深度学习
深度学习lover1 小时前
<数据集>yolo樱桃识别<目标检测>
人工智能·深度学习·yolo·目标检测·计算机视觉·数据集·樱桃识别
深圳市机智人激光雷达2 小时前
技术筑牢安全冗余:激光雷达在自动驾驶高阶感知中的底层价值与范式演进
人工智能·安全·机器学习·3d·机器人·自动驾驶·无人机
江澎涌2 小时前
拆解与 AI 的一次对话
人工智能·算法·程序员
lqqjuly2 小时前
神经架构搜索深度解析(Neural Architecture Search, NAS)
人工智能·知识图谱
AI刀刀2 小时前
Kimi 保存 pdf 显示该页的尺寸超出范围令人困扰,AI 导出鸭一键修复参数,导出 PDF 更顺畅
人工智能·pdf·ai导出鸭