国内首个能直接”看懂”视频内容的大语言模型正式发布!与只能处理文字和图片的传统模型不同,这款模型支持直接输入视频,理解视频中的动态内容——包括人物动作、场景变化、事件发展等。在视频分析、内容审核、智能安防等场景有重要应用价值。本视频首发测评这款模型的视频理解能力。