AA模型竞技场更新了一波测试集,把前言模型的分数又重新拉回到了50分档位,最新的排名如图所示,GPT-6 Astra以55分排在第2,还是没打过Claude Fable 5.1。
另外,在任务成本帕累托效率(可以理解为性价比)方面,也就是所谓的非斩杀线区域,目前由4家公司占据:Anthropic、OpenAI、Meta、智谱。

AA模型竞技场更新了一波测试集,把前言模型的分数又重新拉回到了50分档位,最新的排名如图所示,GPT-6 Astra以55分排在第2,还是没打过Claude Fable 5.1。
另外,在任务成本帕累托效率(可以理解为性价比)方面,也就是所谓的非斩杀线区域,目前由4家公司占据:Anthropic、OpenAI、Meta、智谱。
