Muse Spark 1.3 测评报告!Meta翻身之作?
Meta Muse-Spark-1.3 测评报告来了!这款模型热度远不如 GPT-6,网传却是实力强悍、价格低廉的高性价比选手。本次通过 OpenRouter 接入测试,Harness 选用干净的 PI-Agent,文末附带本次测评完整开销与 Token 消耗数据。
第一项强约束指令生成测试,1-10 结尾格式无误,但 6、9 句存在缺陷,六七句语句生硬不通顺,第八句缺少文字,第九句时间逻辑出现错误。新版 24 点三道解法全部合规正确。七位数密码锁推理顺利答对。
来到编程测试,浏览器操作系统、太空射击游戏功能完整可运行,只是游戏效果对比 GPT-6、Claude Fable5.1 差距明显。3D 赛车项目翻车,道路无法渲染几乎不能游玩。Trello 看板整体 UI 好看,唯独卡片编辑标题栏过窄存在显示 bug。
本次测评一共消耗 301K tokens,缓存命中率 23.8%,花费 0.89 美元,折合人民币六块出头。看完实测,你觉得这款模型值不值得入手,欢迎评论区聊聊……







