谷歌深夜放大招,一次性放出两款新模型——Gemini 3.8 Flash 和 3.8 Flash Cyber。
距离上一代3.7 Flash发布才三周,这迭代速度有点离谱。
几个值得关注的点:
· 编程能力大幅提升:在DeepSWE测试中接近Claude Opus水平,谷歌内部工程师甚至更偏爱这款新模型
· 主打“干活”而非“聊天”:强化长周期软件工程和智能体任务,能自主规划、调用工具、检查修正
· 价格依然很香:年底前输入$0.75/百万tokens,比Claude Opus便宜太多
· 还有一款网安专用模型:漏洞挖掘成功率超70%,Chrome团队用它生成的修复补丁是其他模型的2.6倍
有意思的是,谷歌这次直接放弃了旗舰模型路线,用轻量级模型硬刚对手最贵的版本。大模型竞争已经从“谁更聪明”变成“谁更适合干活”了。
你觉得这种“便宜又能打”的路线能改变AI竞争格局吗?
