GLM 5.3 FlashX测评报告!究竟有多能打?
智谱最新发布的 GLM 5.3 FlashX 测评报告来了,还是在 PI 中接入、思考深度放大最高。来看看这个高速版本实际表现如何。
第一题:强约束指令遵循——句子生成测试。 生成速度相当快,有点 DeepSeek V4 Flash 的味道,起码比 GLM 5.3 Flash 快多了。仔细检查生成的句子,第四、六、七、八、十句为了凑成数字结尾都硬生生去掉了单位,读起来不太通顺。
第二题:鹈鹕土星环骑自行车 SVG 测试。 效果不错,虽然这几期提示词难度调低了,但 GLM 5.3 FlashX 依然是第一个实现得比较完整的模型,值得肯定。
第三题:复合弓射箭 SVG 测试。 如果不吹毛求疵的话,还算是可以的了。非要挑毛病的话也有不少:箭是被弓箭手推出去的而不是射出去的,弓弦应该在复合弓左边,但弓箭手却用右手拉弓,存在方向矛盾。
第四题:精美浏览器操作系统。 UI 看上去不错,右上角弹窗、dock 栏应用功能都没有问题,太空射击游戏则是这题的压轴大戏——可惜效果不大行,飞机和子弹离得太远,不移动的话根本看不出子弹是从自己飞机发射出去的,子弹大、飞机小,如果游戏能实现得更好这题应该能拿高分。
第五题:3D 赛车游戏。 为什么最近几次测试的模型实现的赛车游戏都感觉模糊?总有一种蒙查查的感觉,撞车都不太看得清,其他方面倒是没有明显问题。
第六题:无第三方库实现高颜值 trail 看板。 奇怪的是实现出来没有内置示例数据,但重置按钮点击后又出来了,这个交互设计比较奇怪。列表添加后整个屏幕会闪动,卡片拖动和列表拖动也存在同样问题,比较影响体验。
整体测评下来,GLM 5.3 FlashX 应该是纯粹为了提升 GLM 5.3 Flash 的速度而推出的版本,大家觉得呢?
相关工具已收录于 AI工具严选

GLM
智谱AI大语言模型









