Qwen3-2507测评!超越Kimi K2?
发表于|更新于|大语言模型
上个视频介绍了阿里最新推出的开源大模型Qwen3 2507, 看官方介绍的这么天花乱坠的,承诺会找些cases测评下,那就来吧。来到QwenChat,选中对应模型。开始测试
相关推荐
2025-09-09
Kimi K2 0905发布!不全面测评报告!
Kimi K2 模型刚发布了 0905 最新版本,号称编程能力进一步做了增强,上下文长度从 128K 扩展到 256K,还提供了支持 60到100 Token每秒输出速度的高速版 API。可惜的是还是没有支持多模态和推理模式。在手机app和官方网页版已经全量进行了升级。 这里为了响应粉丝“欧豪的小格格”的要求,准备对其进行下测评,这次主要会测评下编程能力。同时也会测几道推理题。好,那就开始吧 访问入口
2025-11-14
Kimi K2 Thinking测评报告!打败GPT-5?
早上介绍了Kimi K2 Thinking,看官网上各种benchmarks着实厉害,推理拳打GPT-5,编码脚踢Claude 4.5的。那得赶紧裤兜里套出我们大语言模型测评系列的那套测试用例,到官网上试下。废话不多说,来到官网。这里我们选择K2, 工具这里打开长思考。那就来吧… 访问入口
2025-09-25
超乎想象!首个端到端全模态大模型!全面测评报告
阿里发布并开源首个端到端全模态 Qwen3-Omni 模型,据说性能出色且功能强大,既然说得这么厉害,还是首个端到端的全模态,那当然要去测评下了。最终结果超乎你想象! 访问入口
2025-07-15
Kimi K2!国产Claude!Cline接入指南!
家想要知道怎么快速在vscode中接入号称最新国产之光的Kimi K2来进行氛围编程的可以来看下。 我这里用cline为例子,其他roo code,cursor,windsurf等是通用的 访问入口
2025-07-24
Kimi K2 瞬间不香了!阿里Qwen3新王炸!
兄弟们,阿里这一波操作太炸裂了!他们直接甩出来个新模型Qwen3 2507,这玩意儿简直是开源界的新核弹。最狠的是,他们这次不玩虚的,直接把之前的“混合思维”模式给扔了,现在走的是专精路线!这次放出来的,就是那个超级能打的“Instruct”(指令)模型,也就是官方说的“非思维”模式。意思就是,这个模型就是个纯粹的执行官,专门干活儿,又快又准,不搞那些花里胡哨的内部思考流程。这么一搞,模型专注度直接拉满,性能直接起飞,把前段时间大火的Kimi K2都给比下去了 访问入口
2025-07-15
国产版Claude?Kimi K2测评报告!
moonshot 推出开源 kimi k2,这是个万亿参数的混合专家架构,每次激活 320 亿参数,直接对标claude opus!如此厉害,我们来实测下它真是的performance究竟如何… 访问入口
公告






