上周 DeepSeek V4 多模态模型上线之后,不少人赶紧用起来了。不过也有人担心,对话里加入图片之后,会不会让模型调用成本大增?上传的图片是不是尺寸越大,消耗的Token越多?
其实大可不必担心,对此 DeepSeek 官方也早做出了解释:在进入模型前,每张图片都会被自动缩放,每张图片消耗的 token 数存在上限,最多384个。一张5000×5000的图片,和2000×2000的图片,最终可能花一样多的Token。
那384个Token大概是多少呢?其实官方也告诉你了:一个中文字符大概是0.6个Token,因此你现在看到的这条微博,大概就是240个Token(约400字)。如果按照 Deepseek-v4-flash 1.5元/百万Token的输入价格来算,上传2600张图片成本也才 1.5 元。
不难看出来,其实图片对于 Token 消耗的影响是不大的,我们日常使用中最主要的消耗还是来自模型的输出,尤其是开了思考模式后的思维链,这就是为什么,当你把模型的思考等级开高之后,Token 消耗速度会飞涨的原因。
deepseekv4视觉模型上线AI大模型
