让Gemini- 3.7-flash用自制skill总结文献,出现了上下文不一致的问题。在方法部分,gemini提到作者在拟合过程中固定了温度A,让温度B变化。但是在后续结果与讨论的部分,gemini一直在提温度A的变化以及解释😮💨。——在skill的最后一步新增了上下文一致性检查,也算是塞翁失马吧~多亏gemini,skill又变得更好了呢!
从3.5-flash开始用Gemini,感觉它是一个性能方差很大的模型,上限很高,下限也很低。有时候一个很复杂的任务,shu地一下就做完了(他很快!),而且很漂亮!但是有时候一个我认为不难的任务,几轮也搞不定,甚至误解了我的意思。Gemini容易抢跑,比如,让他检查脚本有没有问题,他检查完就自己跑起来了。必须要加额外指令,禁止xxx来限制行为。另外,Gemini很谄媚,同样的提示词,claude-4.6已经冷的像冰块一样了,gemini还在夸我(⺣◡⺣)♡~嘿嘿嘿,我哪有那么好。
在我的使用场景下(科研和vibe coding 做app),gemini 3.5,3.6-flash的性能介于deepseek-v4预览版和gpt 5.5之间。我还是很喜欢他的速度和多模态的。3.5 Pro一直没出有点失望。希望他越来越好吧!
Gemini Gemini-3.7-flash LLM 大语言模型 AI
