群发资讯网

美国最怕的事发生!中国DeepSeek全面革新,全球70%AI公司被死刑

一家常年被同行喊作"价格屠夫"的公司,突然发公告说自己要涨价了——而且涨幅还不小。这事儿要搁在别的行业,多半是撑不下去了

一家常年被同行喊作"价格屠夫"的公司,突然发公告说自己要涨价了——而且涨幅还不小。这事儿要搁在别的行业,多半是撑不下去了要割用户韭菜。

可当这家公司叫DeepSeek的时候,味道就完全变了。DeepSeek在8月6日发布公告,宣布计划近期整体上调API服务定价,预计涨幅较大,并提醒用户合理安排使用需求。

我一开始也纳闷。一个把价格打到全球地板的玩家,凭什么敢主动往上抬价?

后来我想明白了:能涨价,恰恰是最硬的底气。当你手里攥着全球最能打、又最便宜的模型,涨不涨、涨多少,都是你说了算。

这才是真正的定价权。而更让人心里一紧的是,就在涨价公告前几天,它的服务器差点被自己的火爆给挤爆了——仅8月1日一天,DeepSeek V4 Flash单日处理量就达到8万亿Token,8月4日甚至因前所未有的访问量而出现容量不足的情况。

你能想象吗?一个中国团队做的大模型,火到自己都接不住流量。这背后藏着的,是一场悄无声息、却足以让大洋对岸辗转难眠的产业翻盘。

参数虽大激活极小 长文再多算力照省

先泼盆冷水,别把DeepSeek的成功简单理解成"便宜"。我见过太多人张口就来"不就是低价内卷嘛",说这话的,基本没搞懂它真正牛在哪。

便宜是果,不是因。真正的因,是它在最枯燥、最费功夫的底层工程上,抠出了别人抠不出来的东西。

关键的技术跃迁,就藏在那次决定性的开源里。当天,深度求索正式上线全新的DeepSeek-V4预览版并同步开源,该系列以百万字超长上下文为核心亮点,在Agent能力、世界知识和推理性能三大维度均达到开源领域领先水平。

这话听着挺官方,我给你翻译成人话——它一次能读一百万字,而且读得又快又准。更妙的是它怎么做到又强又省的。

V4-Pro总参数达1.6万亿、每Token激活约490亿参数,V4-Flash总参数2840亿、激活约130亿参数,两者共享100万Token的上下文窗口。这是什么概念?

打个比方,传统大模型就像每次答题都得把整套百科全书从头翻到尾,累死累活;而DeepSeek用的这套混合专家(MoE)设计,相当于养了一屋子各科专家,你问数学它就叫数学老师,问代码就喊程序员,其他人该干嘛干嘛。参数库可以无限大,但每次只唤醒一小撮,把"参数越大成本越高"这条老规矩,直接掀翻了。

真正让我拍大腿的,是它在长文本上的那套注意力机制。DeepSeek-V4设计了一套混合注意力架构,结合压缩稀疏注意力(CSA)与重度压缩注意力(HCA),大幅提升长上下文处理效率。

数据摆出来更吓人——在100万Token的上下文场景下,V4-Pro所需的单Token推理算力仅为DeepSeek-V3.2的27%,KV缓存占用更是低至10%。搞过大模型的都知道,长文本处理就是个吞金兽,处理十万字文档卡得你怀疑人生,电费哗哗地烧。

DeepSeek愣是靠算法把这个无底洞给填得差不多平了。这不是砸钱能砸出来的,是真本事。

海外码农用脚投票 硅谷新贵集体转向

技术是里子,好不好使,市场最诚实。而市场给出的答案,说实话,比我预想的还要狠。

先看一个足以载入行业史册的时刻。当周,中国大模型以4.12万亿Token的调用量首次超越同期美国模型的2.94万亿Token,实现历史性反超。

这是零的突破,是天平第一次向中国这边倒。你以为这是运气?

是昙花一现?那接着往下看。

到了盛夏时节,差距已经不是"超越",而是"碾压"了——中国大模型周调用量已达14.19万亿Token,同期美国仅为3.2万亿Token,全球调用量排名前五中前四款均为中国模型。短短几个月,14万亿对3万亿,四比一霸榜前五。

这个反转的速度,快得让人有点不真实。但真正让我服气的,不是这个总量数字,而是这数字背后是谁在用。

OpenRouter平台的用户以海外开发者为主,其中美国开发者占比高达47.17%,中国开发者仅占6.01%。看清楚了——这不是咱们自己人捧场刷出来的成绩,是一群美国程序员、全球开发者,掏着自己的钱包,一票一票投给中国模型的。

硅谷那边的风向更能说明问题。知名风投机构a16z的合伙人观察到,如今在硅谷寻求融资的AI初创公司中,其核心模型高达80%使用中国的开源模型。

你品品这个画面:一堆想拿美国资本钱的美国创业公司,底层跑的却是中国的开源模型。这要是几年前说出去,怕是要被人当笑话。

而这场出海,从来不是DeepSeek一个人在战斗。通义千问、Kimi、智谱GLM、MiniMax……一整个梯队齐头并进。

至于很多人最关心的"我们和美国到底还差多少",权威答案也来了:斯坦福大学《2026年AI指数报告》显示,中美AI模型的性能差距已缩小到2.7%,在代码生成、数学推理等核心任务上,国产模型已与顶尖闭源模型不相上下,甚至在部分中文场景和长文本处理上实现反超。2.7%是什么概念?

就是那种考试你考97分、对手考100分的差距。可问题是,人家那100分的卷子,报价是你的十倍。你说,精明的企业老板会怎么选?

峰谷计费率先落地 粗放烧钱时代终结

聊到这儿,就得说说DeepSeek最狠的一招——它不光在拼产品,它在改规则。这套体系是怎么把70%的同行逼到墙角的?

答案藏在价格表里。目前V4-Flash每百万Token的缓存命中输入价格仅为0.02元,缓存未命中输入1元、输出2元。

注意那个缓存命中价格——0.02元,只有未命中价的2%。对企业来说,那些反复调用的重复内容,成本几乎可以忽略不计了。

而DeepSeek将原本的限时优惠调整为永久降价,相较原价实现约75%的降幅,创下全球大模型的价格新低。可便宜从来不是它的软肋。

V4-Pro在SWE-bench Verified上取得80.6%的成绩,首次让开源大模型在代码能力上比肩顶级闭源模型。又便宜又能打,这就把中间那一大票公司架在火上烤了:比它笨的,卖不上价;比它贵的,没人买单。

夹在中间那70%,商业上其实已经宣判了死刑。产品节奏上,它也早就不是"预览尝鲜"的阶段了。

7月20日,V4模型家族正式从预览版进入全量商用;4天后的7月24日,此前大量API调用仍在使用的两个旧模型名deepseek-chat与deepseek-reasoner被彻底停用。紧接着7月31日,经过Agent能力专项后训练的官方版V4-Flash进入公开测试,在多项基准上表现突出。

最有开创性的,是它把电力行业那套"峰谷电价"直接搬到了AI上。DeepSeek率先落地峰谷分时计费,工作日高峰时段(北京时间9:00–12:00、14:00–18:00)价格翻倍,而凌晨、周末及法定节假日执行平峰原价。

白天贵、半夜便宜,逼着大家把不着急的活儿挪到夜里跑,算力利用率一下就上去了。这种精细化玩法,标志着行业彻底告别了从前那种"谁钱多谁横"的粗放烧钱时代。

回到开头那个涨价的悬念——现在你该懂它为什么敢涨了吧。随着Agent智能体大规模落地,机器驱动机器的调用模式让单次复杂任务产生多轮思考、工具调用与循环纠错,Token消耗量较传统对话呈数量级增长,叠加全球高端GPU与显存供给紧张,纯靠低价跑量的模式已难以为继。

这不是DeepSeek一家扛不住,是整个行业的成本在回归理性。而它敢第一个涨,恰恰因为——现在全球的定价标尺,握在中国企业手里了。

海外那些靠垄断收割暴利的日子,一去不返。资本也没闲着。

DeepSeek首轮外部融资即将落地,募资总额超过500亿元,投后估值突破3380亿元,其中创始人梁文锋出资200亿元,腾讯以100亿元成为外部最大股东,宁德时代出资50亿元。真金白银砸进来,就是对这条路最实在的看好。

说到底,中美AI这盘棋,早就不是"谁跑分高"那么简单了。这里我得说句公道话,咱们也别飘。

美国在最原始的模型创新、最顶尖的芯片和算力底座上,家底还是厚,咱们的底层算法和生态也还有得补,盲目自嗨要不得。但话说回来,中国靠着扎实的工程能力、实打实的成本优势,加上AI赋能千行百业那么多真实场景,硬是走出了一条跟人家闭源高价完全不一样的普惠路子。

这不是谁把谁彻底干趴下的故事,而是全球AI从"一家独大"迈向"多极并立"的开始。那个曾经被认为遥不可及、连大洋对岸都最怕看到的格局翻盘,正被一群中国工程师用一行行代码、一次次迭代,踏踏实实地变成现实。这份底气,我觉得,值得咱们每个人为之自豪。