V4 Pro 才活了 28 天,接班的 Flash 还更便宜
8 月 13 日,DeepSeek 的旗舰 V4 Pro 正式版悄悄上线,我当晚写过一篇。28 天后,官方后台弹出一条通知——不是 V4.1 Pro,也不是 V4 Pro 的升级包,而是给这个旗舰安排了一场体面的让位仪式:

公告原文就一段话,信息密度拉满:V4.1 Flash 计划北京时间 9 月 10 日前后发布;经内部、外部多方测试,它在性能、费用、速度、总用时上已全面超越 V4 Pro;V4.1 Flash 上线后、V4.1 Pro 上线前,所有发往 V4 Pro 的请求会被直接路由到 V4.1 Flash,并按 V4.1 Flash 的单价计费。
翻译成人话:你点的是旗舰,给你上的是 Flash,按 Flash 的价收钱。
先拆公告里最狠的那句
"将把对 V4 Pro 的请求全部路由到 V4.1 Flash"——这句话在行业里是反常的。
正常剧本是新旧模型并存:老的继续服务存量客户,新的慢慢接管增量。DeepSeek 选了直接切流,连过渡期都懒得演。理由其实就藏在公告里:一个被 Flash 全面超越的旗舰,继续留在 API 列表里,对谁都没好处——对用户是花冤枉钱,对 DeepSeek 是白白养着一个 1.6T 参数的吞卡兽。
值得一提的是公告里那个词:总用时。性能、费用、速度好理解,"总用时"被单独列出来,是给 Agent 时代定的调——跑完一整个任务的时间,比单 token 吐字速度重要得多。你的自动化流水线里,模型要在几十轮工具调用里反复进出,每一轮的启动延迟和思考时间都会被乘以调用次数。
Flash 反杀旗舰,DeepSeek 玩第二次了
去年这时候,"Flash 档"还是"阉割档"的代名词。现在,它成了弑旗舰的专业户。
先看上一代就已经发生的战况。第三方实测数据:V4 Pro 总参数 1.6T,V4 Flash 只有 284B 总参数、每 token 仅激活 13B。参数量差着 5.6 倍,榜单上却几乎贴脸——LiveCodeBench 93.5 对 91.6,GPQA Diamond 90.1 对 88.1,SWE-bench Verified 80.6 对 79.0,差距全线压缩到 2 分上下。上一代 V4-Flash 正式版上线时,官方口径就是"Agent 能力翻倍,多项指标碾压 Pro 预览版"。
这一代 V4.1 Flash 换了全新模型结构、长出了原生多模态,官方测试口径从"碾压预览版"升级成了"全面超越正式版旗舰"。
还有个昨天埋好的彩蛋:内测模型名叫 deepseek-v4.1-flash-expires-on-0910——名字里直接写着死线,9 月 10 日。现在回头看,那个死线就是生日。内测模型过期下线的同一天,正式版顶上来,命名即排期。
给常驻用户算笔账
按当前牌价:V4 Pro 每百万 token 输入 0.435 美元、输出 0.87 美元;V4 Flash 是 0.14 和 0.28——内测期间官方说过 V4.1 Flash 计费跟 V4 Flash 持平。
也就是说,路由切换后,同样一批请求,账单直接除以三。缓存命中的输入更是从 0.003625 美元掉到 0.0028 美元每百万 token,常年挂 Agent 常驻任务的人,这块降幅最实。
对重度用户,这次切换几乎是无感升级:请求格式不用改、模型名不用换(当然,主动切到新模型名更聪明),唯一要留意的是生产系统的回归测试——模型换了,输出风格和能力边界会跟着变,依赖 V4 Pro 具体行为的下游,明天最好跑一遍自己的评测集。
这不是 DeepSeek 一家的事
把镜头拉远,Flash 档篡位已经是全行业的集体剧本:GLM-5.3-Flash 用 57 分打平 Opus 4.8,价格只有 1/40;Qwen3.8-Flash 在 SWE-bench Pro 上领先 Opus 4.6 达 9.1 分,要价 DeepSeek 的 1/3。今天 DeepSeek 再添一笔——官方亲自宣布 Flash 全面超越自家旗舰,顺手把旗舰的流量也切了过去。
逻辑不复杂:推理成本持续下探,测试时算力(多想一会儿)越来越便宜,"小激活参数 + 长思考"开始正面赢过"大而全"。当"总用时"都成了官方宣传指标,比拼的就不只是模型多聪明,而是谁的单位任务成本更低、周转更快。
最后泼盆冷水
一,"全面超越"目前只有官方自述,第三方榜单明天才见分晓——DeepSeek 历史上的官方口径基本没虚标过,但等一天实测再下结论不亏。
二,V4.1 Pro 还没影。这次让位的是 Flash 接棒,真正的大旗舰对决还在后面——V4 Pro 的 1.6T 参数火力不会凭空消失,大概率会在 V4.1 Pro 身上换个活法。
三,路由是暂时的:公告写得很清楚,V4.1 Pro 上线之后怎么办,没说。把生产系统长期押在"自动路由"上,不如现在就把模型名切到 deepseek-v4.1-flash,把主动权拿回自己手里。
相关链接:
- DeepSeek 开放平台(模型与价格):https://platform.deepseek.com/
- 本文是一篇续集,前作:《DeepSeek V4.1 Flash 内测:原生多模态,模型名里藏着 9 月 10 日》
暂无评论。