Gemini 3.6 Flash(Extended Thinking)测评报告!结果吓你一跳!
本期实测开启深度思考模式的 Gemini 3.6 Flash,对比未开启该功能的版本,模型逻辑推理能力大幅提升,约束文本生成全部顺利完成,24 点运算结果准确,此前答错的密码推理题也顺利算出正确答案。但代码生成表现反而明显下滑,制作浏览器系统时长时加载卡顿,前期甚至拒绝输出前端代码,重新发起会话生成的程序存在交互弹窗缺失、射击游戏按键冲突等问题;3D 赛车直接触发代码报错无法启动;复刻 Trello 看板基础操作可用,重置数据按钮存在逻辑 bug。开启深度思考后模型擅长多层逻辑推导,却容易过度发散打乱代码逻辑,出现明显”过度思考”副作用,推理与代码能力呈现两极反差,懂原理的朋友可以在评论区聊聊背后成因。







