2大巨头同日亮剑,AI赛道再洗牌
9月2日,Google和Meta几乎同时甩出新模型。Google端出Gemini 3.8 Flash及网络安全专用版Gemini 3.8 Flash Cyber;Meta则发布Muse Spark 1.3。两天之内三场前沿发布,大模型竞赛进入按小时计的时代。
Google的Gemini 3.8 Flash距离3.7版本发布仅过去三周。这是六周内第三款Flash,也是不到四个月里的第四款。在DeepSWE v1.1长程软件工程测试中拿到73.7%,距Claude Opus 5的74.0%仅差0.3个百分点。HLE-Verified得分54.9%,压过Opus 5和GPT-5.6 Sol。
更加值得关注的是Gemini 3.8 Flash Cyber。
这款网络安全专用模型通过Fairwind计划向受信防御者开放。在CyberGym漏洞查找基准测试中达到前沿水平。Chrome安全团队实测发现,它生成的有效漏洞补丁数量是更大体量商业模型最佳结果的2.6倍。
网络安全正在成为AI落地的新战场。
Meta的Muse Spark 1.3则是五个月内的第四次版本迭代。在Artificial Analysis智能指数上拿到62分,位居全场第三。代码任务工具调用减少约20%,完成任务所需token减少25%。Meta AI负责人称其编程能力已优于GPT-5.6 Sol。模型已上线Muse Code和Meta Model API。
两条路线在同一天正面碰撞。Google打“高频小步”,六周三款的节奏把Flash性能不断推向旗舰级水准。Meta打“单点爆发”,每一款都试图在指数榜上直接冲击前三。Artificial Analysis数据显示Muse Spark 1.3以61分小幅领先Gemini 3.8 Flash的59分。
大模型竞争的计量单位正在发生变化。比的已不再是“谁更聪明”,而是谁迭代更快、谁更便宜、谁更垂直。Google把前沿能力塞进越来越便宜的模型,Meta让Agent用更少的token和工具调用完成同一个任务。
你觉得,Google的“机海战术”和Meta的“单点爆发”,哪条路线能笑到最后?





