Pro用户彻底傻了。
DeepSeek一纸通知:V4.1 Flash上线后,所有打到V4 Pro的请求全部静默路由到Flash,按Flash价格计费。开发者调了半个月的提示词、对齐好的输出格式,说换就换。一位Apache项目作者直接回了四个字:“请不要这样做。”
这事荒唐在哪,官方说了,V4.1 Flash性能、费用、速度、总用时全面超越V4 Pro,听起来是白送福利。但开发者不买账,理由很简单:你替我做决定,却不问我同不同意。
model_id不是随便起的名字,它是一份隐性契约,背后拴着多少团队熬夜调出来的参数和格式。
你一个路由改动,人家半年的活儿全白干了,C114的报道说得很直白,开源社区几乎一边倒地反对,有开发者直接建议平台应该发布公告、提供迁移期,让用户自己决定什么时候切换。
更讽刺的是,官方在反馈问卷里直接问了用户一个问题:“你觉得这个模型能全面替换线上的V4 Pro么”。自己都没底的事,为什么替用户拍了板。
速度确实炸裂,有开发者敲了句“你好”,模型思考时间0.3秒,生成速率飙到每秒159个token,整轮对话端到端0.8秒。SVG代码生成比旧版快6倍,长上下文检索快5倍多。
但快不代表稳,有开发者实测发现,复杂任务里模型会疯狂开启子Agent反复验证纠错,仅子任务就烧掉1亿Token。5分钟10块钱,账单比旧版还贵。单价降了,总价涨了,这账怎么算都不对。
降价也是真降了,9月10日12时起,缓存命中输入单价从0.05元降到0.02元,降幅60%。但注意,8月13日V4 Pro上线时刚涨过一轮价,有个开发者晒出账单,7月和8月同样请求次数,实际支出涨了近3倍。
这次Flash的缓存价格回到了涨价前的原点,可输出价格从2元变成了4元,翻了整整一倍。说白了,部分回调,不是全面恢复。
企业用户已经在用脚投票了,某软件开发企业负责人告诉蓝鲸财经,公司已经大量减少DeepSeek调用,常规任务转用GPT和GLM,“写代码我们不用DeepSeek了”。信任这东西,建起来要一年,塌下去只要一天。
V4 Pro推迟到9月14日中午12点正式下线,届时所有请求自动路由到Flash。不同意新计费方式的用户可以申请退费,选择权看似给了,实际上留给开发者的时间只有四天。
DeepSeek追求“智能密度”没错,Flash的速度也确实让人服气,但当一家公司把“对用户负责”四个字挂在公告里,转头就替用户做了最不该替用户做的决定,那些还在调提示词的开发者,大概只能对着屏幕苦笑。
Pro用户不傻了,他们只是还没找到下一个落脚点。
