群发资讯网

AI 搜索公司 Perplexity 官宣了一组自家评测数据:他们在 WANDR

AI 搜索公司 Perplexity 官宣了一组自家评测数据:他们在 WANDR 上跑了 GPT-6 Astra,得分 0.682,每任务成本 11.98 美元,这是他们测过的所有模型里的最高分。
横向对比也一并放了出来——GPT-6-Astra 比 Fable 5.1 高出 13.5%,成本还低 6.1%;对比 Opus 5 则高出 27.0%,不过成本要多 3.3%。
简单说就是:分数拿了个第一,跟 Fable 5.1 比是又强又便宜,跟 Opus 5 比则是多花一点钱换来更高的分。AI大模型