GPT5.6 Luna 迎来大幅调价,性价比对标 DeepSeek V4 Flash,本期用统一测试用例与高思考深度完成完整实测:

  • 推理与文本约束:默认中等深度输出语句生硬,切换高深度后文本约束效果明显提升,24 点、密码锁推理题全部答对
  • 代码项目:浏览器桌面界面美观可用,太空射击游戏无法正常操作,3D 赛车体验尚可但左右按键反向
  • Trello 看板:拖拽编辑功能齐全,新增拓展按钮无交互反应
  • 综合结论:整体综合性能和 DeepSeek V4 Flash 不相上下,适合有低成本推理、前端开发需求的用户

两款热门平价模型实测对比看完就能分清适配场景。