群发资讯网

AI 圈有个心照不宣的共识,算力焦虑等于显卡焦虑。谁抢到 GPU,谁就是爷。 可

AI 圈有个心照不宣的共识,算力焦虑等于显卡焦虑。谁抢到 GPU,谁就是爷。
可这周曝出来的一条消息,把这个共识戳了个窟窿。

The Information 在 8 月 7 日报道,AWS 的高管今年 5 月召集工程师开了一场会,会上传下来的话很不客气,想尽一切办法,节省算力。
注意,省的对象不光包括 AI 芯片,还包括那些撑了互联网二十多年的传统 CPU 服务器。
紧跟着的细节更扎眼。
一位在 AWS 干了好几年的工程师说,以前申请 CPU 资源,等几个小时就到手,现在要等好几天。
职业生涯里从没碰上过这种事,项目交付都可能被拖住。
云厂商的头把交椅,自己人先用不上自家服务器了。这事说出去,多少有点魔幻。

再往下看,AWS 还给各团队划了死线,今年晚些时候必须削减计算资源占用。
工程师们正忙着下线闲置的 EC2 虚拟服务器,把省出来的算力腾给外部客户。连以大幅折扣甩卖的竞价实例,那种两分钟内可被收回的溢出资源,最近几个月也越来越难大批量抢到了。
弹性空间快被榨干了。
这话的潜台词是什么?云要涨价了。
AWS 官方当然不认。
回应四平八稳,即便面对大量需求,公司仍能满足绝大多数内外部客户的计算需求,一如既往。
一如既往这四个字,熟悉公关话术的人都懂,越是强调没变,越是说明变了。

那么问题来了,到底是谁在抢 CPU?
答案藏在英特尔财报会的两句话里。4 月,CEO Lip-Bu Tan 披露,AI 推理环节里 CPU 和 GPU 的使用比例是 1 比 4。到了 7 月,首席财务官 David Zinsner 改口,比例已接近 1 比 1。
AMD 和 Arm 的高管也说了类似的话。
三个月,从四比一到几乎一比一。抢 CPU 的不是别人,正是当下最风光的 AI Agent。
这就有意思了。
过去两年,所有人谈算力,张口闭口都是英伟达,都是 GPU,仿佛 AI 世界只烧一种芯片。可 AI Agent 真跑起来才发现,它是个碎嘴子。
写代码、调工具、查文档、跑流程,每一步都要调云计算资源,每一步背后都是 CPU 在吭哧吭哧干活。
GPU 负责聪明,CPU 负责忙活。
聪明可以外包给一块卡,忙活却躲不掉,还得一刻不停。
AI 咨询机构 Elendil Labs 的 Jing Xie 说了句大实话,客户的人均 IT 支出翻倍了,直接原因就是 AI Agent 的大规模使用。

说好的 AI 降本增效呢?
效率是上去了,账单也跟着上去了。
Agent 越能干,调用的资源越多,云厂商的收银机转得越欢。企业兴冲冲引入数字员工,年底一看云服务费,好家伙,比真人工资涨得还快。
再把视野放宽一点,你会发现算力紧张这事,已经成了巨头们的集体心病,而且疼法各不相同。
谷歌去年专门成立了一个高管委员会,在云业务、DeepMind 和消费者业务之间分算力,跟计划经济时代分粮票似的。
即便如此,明星研究员 Noam Shazeer 今年夏天还是因为拿不到算力,愤而离职。人才可以挖,算力挖不来,这话如今成了硅谷的新烦恼。
微软倒是走出另一条路。
首席财务官 Amy Hood 上月在财报会上说,Azure 的增长有一部分来自 CPU 和 GPU 机群管理的效率提升,还补了一句,效率提升带来的收益会被迅速货币化。
同样的算力荒,亚马逊在节流,谷歌在分配,微软在变现。三家三种活法,高下自在人心。

往后这盘棋怎么走,我粗看三点。
其一,云计算涨价是大概率事件。
供需缺口摆在那,竞价实例先紧,接着就是常规算力。过去十几年云越用越便宜的好日子,可能要画上句号了。企业的 IT 预算,得重新做。

其二,CPU 迎来第二春,英特尔们捡了个意想不到的红包。
GPU 的军备竞赛还没打完,CPU 和内存的争夺战又开打了。英特尔的命运这几年一言难尽,没想到 AI Agent 成了它的救命稻草之一。风水这东西,转起来比芯片快。

其三,算力分配权正在变成科技巨头内部最敏感的权力。
研究员因算力出走,工程师排队等资源,往后谁能高效调度算力,谁就握住了 AI 竞赛的方向盘。技术是面子,调度是里子。

互联网的黄金年代,算力像自来水,拧开就有。
现在水管开始限流了。巨头们关起门来算细账的样子,像极了那些一面高喊 AI 改变未来、一面精打细算度日的普通人。
技术革命的尽头,往往是一道再朴素不过的算术题。这一回,题目叫,CPU 不够用了。