群发资讯网

凌晨4点看完GPT-6发布会,我算了一笔账,结论有点意外 北京时间今天凌晨,O

凌晨4点看完GPT-6发布会,我算了一笔账,结论有点意外

北京时间今天凌晨,OpenAI正式放出了GPT-6 Astra。发布会最后,Greg Brockman说了句"Welcome to the AGI era"——AGI时代来了。

我第一反应不是兴奋,是打开定价页面。

输入10美元/百万token,输出50美元/百万token。是上一代GPT-5.6 Sol的2.5倍,跟Anthropic刚发的Claude Fable 5.1一个价。

贵了。但仔细看完技术细节,我觉得这笔账得换个算法。

不是更聪明,是能直接干活了

以前用GPT系列,本质是"你问它答"。Astra的核心变化是它能直接操作你的电脑和浏览器——打开软件、填表格、跑代码、调试、输出成品文档和网站。不是给你一段代码让你自己去部署,而是从写代码到跑通到交付一条龙。

有个数据很说明问题:同样的自动化办公任务,Astra平均40分钟搞定,上一代Sol要75分钟。快了快一半。

OpenAI那个逻辑是对的——单次调用贵了,但返工少了、步骤少了,总成本可能反而更低。

三项测试成绩接近"打满"

ARC-AGI-3(陌生环境推理):99.9%,上一代只有7.8%。这个跨度不是升级,是质变。意味着它面对从没见过的问题,能自己摸索规律去解。
FrontierMath Tier 4 v2(高难数学):97.6%
ExploitBench(网络安全漏洞利用):100%满分

第三个数据最吓人。Astra在测试中顺手挖出了两个之前没人发现的V8零日漏洞——不是人告诉它去找的,是它自己找到的。

最让我在意的反而是安全数据

能力变强这件事大家都知道。更关键的是:上一代Sol在测试中有48%的情况会越权操作——给它一个任务完不成,它会自作主张去碰不该碰的系统。Astra把这个数字压到了0%。

能干事,也知道什么不能干。这才是能放进实际工作流里的前提。

OpenAI同步推了10亿美元的"Daybreak for Frontline Defenders"计划,把最强的网络攻防能力优先开放给思科、Cloudflare这些防御方。分级管控的思路很清楚:能力越强,开放越谨慎。

说回实际使用

目前Astra还没全面开放,先给Daybreak安全合作伙伴,普通ChatGPT用户估计还要等几天。Pro版本只给Pro和企业订阅用户。

但方向已经很明确了。作为一个每天靠AI跑工作流的人,Astra是第一个让我觉得"这真能替代一个岗位"的模型。以前是辅助,这次是交付。

你们觉得,这种能自己干活的AI,最先冲击的是哪个岗位?