这头"牛"全球刷屏一周,但扛起它的全是国产芯片
一头没有名字的"牛",上周把整个海外开发者社区搅翻了。
它叫Ox-Alpha。没人知道它是谁家的,但第一天上线就刷新OpenRouter单日历史纪录,一周处理23万亿Token,是同期第二名DeepSeek的两倍,还顺手终结了DeepSeek在OpenCode长达56天的霸榜。
所有人都想知道它是谁。三个独立研究员做了25组分词器指纹测试、11项交叉探针——结论惊人一致:"99%指向智谱"。
8月26号晚上,谜底揭晓。智谱官宣:这就是GLM-5.3-Flash。
但真正让所有人坐不住的,不是性能,是另外两件事。
第一件事:性能追平最贵旗舰,价格只卖它的1/40。 Artificial Analysis智能指数拿了57分,追平Anthropic最贵的Claude Opus 4.8,把自家上一代GLM-5.2和DeepSeek V4 Pro正式版(都是53分)都甩开。调用价格:输入0.8元/输出2.8元/百万Token——是Opus 4.8的四十分之一。
第二件事:所有流量,跑在10万张国产芯片上。
这头"牛"在全球跑了一周,累计处理62T Token,全部由10万张国产芯片(华为、海光、摩尔线程)组成的超大集群承载。这是国产算力芯片第一次大规模直接扛起全球真实负载——之前很多人争论"每天100万亿Token的算力从哪来",现在答案摆在眼前。
半导体研究机构SemiAnalysis直接发文:"继OpenAI自研推理芯片之后,CUDA护城河再度受到考验。"
巧的是,同一天凌晨英伟达财报里藏了一句话——第二财季运往中国大陆的数据中心收入,占比已经不到1%。
一边是国产芯片扛起全球第一的模型,一边是英伟达在中国的收入归零。
这条消息落地第二天,智谱港股收涨12.62%,市值重返5000亿港元。OpenRouter榜单前五,全是中国模型。
这头"牛"跑得真快,而且吃的是国产的草。
你怎么看国产算力撑起全球第一这件事?
