Deepseek V4.1 多模态测评!能打吗?
Deepseek V4.1 预览版多态实测来了!上一轮我们测试推理与编程能力,今天直接拿祖传多态测试用例检验图像能力,该模型暂不支持视频,所以只做图片测试。
首先传入《老无所依》电影截图片名询问影片名称,任务跑了二十多分钟,Deepseek Harness 浏览器几乎卡死,只能终止任务。过程中模型可以识别画面内容,但始终识别不出电影名字。换一张同影片简单截图,耗时五分钟多才成功识别出来。
接下来判断图片里对话亭相对黄色货车的方位,模型准确答出右侧,答案无误。
找不同题中,精确定位第一行第四列倾斜十二度,多观察能力可圈可点。再提升难度,统计画面里雄鸳鸯数量,雄性 5 只识别正确,雌性统计出错——把画面左侧的野鸭错误计入雌性鸳鸯数量。
原本准备两道视频测试题,受限于模型不支持视频输入无法开展。整体图片测试有亮点也有明显短板,大家觉得这个模型多模态水平到底如何……










