超乎想象!首个端到端全模态大模型!全面测评报告
发表于|更新于|大语言模型
阿里发布并开源首个端到端全模态 Qwen3-Omni 模型,据说性能出色且功能强大,既然说得这么厉害,还是首个端到端的全模态,那当然要去测评下了。最终结果超乎你想象!
相关推荐
2025-07-24
Qwen3-2507测评!超越Kimi K2?
上个视频介绍了阿里最新推出的开源大模型Qwen3 2507, 看官方介绍的这么天花乱坠的,承诺会找些cases测评下,那就来吧。来到QwenChat,选中对应模型。开始测试 访问入口
2025-07-24
Kimi K2 瞬间不香了!阿里Qwen3新王炸!
兄弟们,阿里这一波操作太炸裂了!他们直接甩出来个新模型Qwen3 2507,这玩意儿简直是开源界的新核弹。最狠的是,他们这次不玩虚的,直接把之前的“混合思维”模式给扔了,现在走的是专精路线!这次放出来的,就是那个超级能打的“Instruct”(指令)模型,也就是官方说的“非思维”模式。意思就是,这个模型就是个纯粹的执行官,专门干活儿,又快又准,不搞那些花里胡哨的内部思考流程。这么一搞,模型专注度直接拉满,性能直接起飞,把前段时间大火的Kimi K2都给比下去了 访问入口
2025-12-03
Seedream 4.5杀到!豆包P图大升级!
这几天图片AI模型的江湖真是杀疯了!有关注我的应该都知道,上几天纳米香蕉才出来,跟着flux 2也面世,而今天发现豆包的Seedream4.5也杀到了!认真测试了一遍,把我震惊的压麻呆住了…. 访问入口

2026-04-23
Qwen 3.6 Max!是否真的能打?打得过GLM 5.1吗?
通义千问Qwen 3.6 Max的独立测评!作为阿里云的旗舰模型,Qwen 3.6 Max在各项能力上都有全面提升。本视频将其与GLM-5.1进行一对一的全面对比测试,涵盖语言理解、编程、数学推理、中文创作等核心维度。通过实际测试结果帮你判断:Qwen 3.6 Max是否真的”能打”?它在哪些方面优于GLM-5.1?哪些方面还有差距? 访问入口

2025-03-01
Claude3.7 + Trae:最强AI编程组合?
Claude 3.7 Sonnet免费用啊!我昨天分享了个视频对全球首个混合推理模型Claude 3.7进行了测评,同一套测试用例打败了DeepSeek r1。可惜官网的免费额度有限。今天我们看一个可以完全免费用的方法,那就是字节的Trae这个AI编程IDE了… 访问入口
2024-11-29
Commabot:AI操作电子表格
Commabot是一款AI驱动的电子表格助手,它让你彻底告别复杂的Excel/Google Sheets公式。你只需要用自然语言描述你的需求(如”计算A列和B列的差值,如果差值为负数则显示为0”),Commabot就会自动生成对应的公式并应用到表格中。它还支持数据清洗、图表生成、数据透视等高级功能,全部通过自然语言交互完成。对于不熟悉电子表格公式的职场人士来说,Commabot是一个极大的生产力提升工具。 访问入口
公告






