什么都没干,DeepSeek 先把我的账单降了
打开 DeepSeek 后台查用量,弹出来的不是账单,是一条公告:

公告原文的关键就一句:V4.1 Flash 正式上线后、V4.1 Pro 上线前,V4 Pro 的请求会被全部路由到 V4.1 Flash,并按 V4.1 Flash 的单价计费。
翻译成人话:你一行代码不用改,从 9 月 10 日起,用的模型更强了,账单反而便宜了三分之二。
账单直接打三折
价格不用猜,官方牌价摆在那(每百万 tokens):
| 项目 | V4 Pro | V4.1 Flash 计费 | 降幅 |
|---|---|---|---|
| 输出 | 27 元 | 9 元 | -67% |
| 输入(未命中缓存) | 9 元 | 3 元 | -67% |
| 输入(命中缓存) | 0.3 元 | 0.1 元 | -67% |
给 Agent 跑批的人感受最直接:输出 1 亿 tokens 的活,原来 2700 元,现在 900 元。夜间跑任务还有闲时半价,900 再砍到 450——同样的活,成本直接从四位数掉到三位数。
更气人的是性能还涨了:官方说 V4.1 Flash 在性能、费用、速度、总用时上"全面超越 V4 Pro"。贵的东西被便宜的东西替了,行业里这叫清仓,在 DeepSeek 这叫例行更新。
Pro 切到 Flash,你什么都不用做
公告的另一半更省心:9 月 10 日前后起,所有发往 V4 Pro 的请求会自动路由到 V4.1 Flash,按 Flash 单价计费——代码、API key、接入方式全都不用动,服务端直接切。唯一建议:别把自动路由当长期依赖,生产系统的模型名主动换成 deepseek-v4.1-flash,主动权在自己手里。
Flash 敢接旗舰的活,不是硬撑。官方文档里它的配置和 Pro 几乎一样:1M 上下文、384K 最大输出、思考模式三档全支持;并发上限还是 Pro 的五倍(2500 对 500)。你现在付的旗舰价,一大半其实是在为"用不满的性能上限"买单。
"总用时"这个词被官方单独列进超越指标里——Agent 时代算的是总账:token 单价 × 跑完任务的时间。速度上去,等于在降价之外又打了一层折。
两盆冷水
- 这个价格有期限。路由只维持到 V4.1 Pro 上线前,那一代上线后怎么计费,公告没说。现在的三分之二折扣是窗口价,不是永久价。
- "全面超越"是官方自述。判定标准没公开,重度使用前建议拿自己的真实任务跑一遍回归。
最省心的部分
这次升级的操作成本是零:不迁移、不改代码、不重新签合同,9 月 10 日前后自动生效。DeepSeek 用一条后台公告完成了别家要开发布会的事——把旗舰的价格,打到了地板上。
相关链接:
- DeepSeek 开放平台:https://platform.deepseek.com/
- 官方文档·模型与价格:https://api-docs.deepseek.com/zh-cn/quick_start/pricing
- 官方文档·更新日志:https://api-docs.deepseek.com/zh-cn/updates
暂无评论。