群发资讯网

同一片晶圆,没换一颗芯片,Cerebras 把 CS-4 的性能直接拉到 CS-

同一片晶圆,没换一颗芯片,Cerebras 把 CS-4 的性能直接拉到 CS-3 的两倍,CEO Andrew Feldman 当场贴上"业界最快"的标签。

数字确实唬人:机架级 CS-4 装了 3 片 WSE-3 晶圆,单机架每用户每秒最高吐 4,400 tokens,对外口径"比 Nvidia GPU 快最高 30 倍"。但背后没有新架构也没有新制程,CS-4 沿用 5nm WSE-3,靠功耗与散热重做,把时钟频率硬抬到两倍。直白讲,单芯片这一代已经快撞上物理天花板,厂商只能往封装、供电、散热方向继续挖潜。

野心也在这里。CS-4 用了一种叫 Backpack 的模块化设计,部署还能拉上 AMD、AWS Trainium 这些搭档做"分解式推理",把任务切成几块分摊到不同硬件上跑。Cerebras 想卖的不是一颗晶圆,而是一整个机柜加一套可照搬的部署蓝图。

但 30 倍怎么比出来的,官方没披露工作负载和对比基线;SemiAnalysis 分析师也直接点出,CS-4 在网络层面的提升相当有限。单机柜再快,节点之间拖后腿,"业界最快"就只能在单点工况下成立。

真要替它下定论,还得等 CS-4 的实际功耗、单价、交付时间,以及在多机柜真实推理链路里那个 30 倍还剩多少水分。在那之前,把它当一款上限很高的单点硬件,比当 GPU 的全面替代品更稳。

你觉得 Cerebras 这种"芯片不动、只换供电散热"就把性能翻倍的做法,是逼近物理极限的硬功夫,还是包装出来的营销高点?