群发资讯网

目前正在参加一个新的比赛,我看了一下午和图论相关的内容,最后打磨出来了一版(我认为的)冠军方案。 又想测试一下现在前沿模型的能力,把赛题加上我一些简单的思考输入了进去,让它们输出夺冠计划,我来评估一下它们方案如何: - Kimi K3:95 分,伟大无需多言,言语简洁,思路和我不谋而合。 - G ​

目前正在参加一个新的比赛,我看了一下午和图论相关的内容,最后打磨出来了一版(我认为的)冠军方案。

又想测试一下现在前沿模型的能力,把赛题加上我一些简单的思考输入了进去,让它们输出夺冠计划,我来评估一下它们方案如何:

- Kimi K3:95 分,伟大无需多言,言语简洁,思路和我不谋而合。- GPT 5.6 Sol Xhigh:90 分,写模拟器,强调不确定性,疯狂防御式计划,但确实什么都考虑到了。- 豆包 Seed 2.1 Pro:70 分,思路是对的,但是有些逻辑错误。- DeepSeek V4 Pro:50 分,完全在复述经典论文的方法,没有自己根据题目产生的见解。

明天出第一轮成绩,看看是我的方案真的 nb,还是大模型们在联合起来哄我开心 🤡