加入 Qwen 3.8 后,用 6 个模型比较了 VoxelArt Bench(附参考图像),所以来分享一下。
主观排名如下所示。
Fable ≒ Kimi K3 > Qwen3.8 > glm-5.2 > grok 4.5 > gpt-5.6 sol
※顺便说一句,glm-5.2 不是 VLM,所以使用了单独的图像识别技能AIニケちゃん

加入 Qwen 3.8 后,用 6 个模型比较了 VoxelArt Bench(附参考图像),所以来分享一下。
主观排名如下所示。
Fable ≒ Kimi K3 > Qwen3.8 > glm-5.2 > grok 4.5 > gpt-5.6 sol
※顺便说一句,glm-5.2 不是 VLM,所以使用了单独的图像识别技能AIニケちゃん
