期待已久的 Qwen‑3.8‑Flash 实测报告新鲜出炉!这款全新的 MoE 多模态大模型,主参 125B,每次仅激活 6B 参数,原生 256K 上下文最高可扩容至 1M,API 定价性价比极高,网传办公编稿实力十分强悍。本次依旧使用祖传全套测试用例,在 Claude Code 上将思考模式拉满展开测评。约束生成、24 点运算、密码推理题全部顺利通过,推理表现亮眼。但深度编程测试当中,浏览器操作系统、太空射击游戏、Trello 看板等项目出现了界面布局、物体方向、按钮排版等小 bug,3D 赛车游戏整体完成度较高。综合来看它的推理能力稳定在线,编程实力可圈可点,想要上手的小伙伴可以参考这份实测结果……