话说DeepSeek又要降价了,9月10日12:00起会调整flash系列定价,输入、输出每百万token,空闲时段降0.5元,高峰时段降1元,算下来输出大概打9折,其实还是高的。
为什么这时候会降价,看我贴的第一张图你就会明白。
这是OpenCode上的主流模型token消耗趋势,8月初V4 Flash发布后,token急剧上升,一度占据了OpenCode 80%以上的模型用量,其他开源agent平台估计也出现类似的情况。
DeepSeek的算力资源扛不住这么大的token消耗,这在梁文峰闭门会议时也提到AI芯片是缺的。
到了8月中旬开始上调价格,起码涨了3倍以上,原因还是供需失衡了,只能通过涨价来限制用户使用。
8月底,V4 Flash在OpenCode的访问量较高峰时期跌了约600%,回到正式版上市之前的用量。
因为大家确实用不起,我同事在Trae上用V4 Flash跑了一份ppt,一下午消耗了快30元。
同时GLM 5.3出来,也分走一部分用户。
尽管如此,我看了这个月OpenRouter的排名,V4 Flash依然高居第一,大家用脚投票的结果,就是好用啊。
现在V4 Flash token消耗趋势平稳,DeepSeek算力资源估计也没那么紧张了,这时候下调价格也很正常。
昨天V4.1 Flash发布了公测,看样子是训练成本下来了,这也可能是这次降价的另一个原因。
但是我看有评论说V4.1 Flash消耗token更快,不知道真假,如果真的这样,那使用成本还是没咋变。deepseekai大模型

