QwQ-32B测评报告:能打败DeepSeek r1吗?
发表于|更新于|编程工具
阿里最新QwQ-32B推理模型测评报告啊,最终结果是否能打败DeepSeek r1呢?废话不多说,直接开测,先先选择好QwQ-32B模型,下面深度思考也确认打开…
相关推荐

2025-01-29
Qwen2.5-Max:阿里最新大模型打败DeepSeek V3
阿里推出Qwen2.5 Max,performance打败DeepSeek V3啊。国产大模型真是过年都没有歇着,惊喜一波接着一波啊!废话不多说,赶紧去Demo下,准备让它写个代码试下… 访问入口
2025-04-02
DeepSeek:如何生成流程图?
今天快速跟大家分享下怎么用deepseek r1来画流程图和时序图等,这里要用到的工具有两个,一个是deepseek,一个是免费在线绘图工具drawer.io,牵涉到的技术除了我们知道的大语言模型之外就是mermaid了,这是一种基于文本的图表绘制语言,类似markdown,通过支持mermaid的第三方工具如drawer.io就能将它渲染出来… DeepSeek访问入口 Drawer.io访问入口

2025-01-30
OpenAI证明DeepSeek抄袭?
OpenAI声称证明DeepSeek抄袭他们?今天逛海外科技网站的时候看到个新闻,说OpenAI提出证据证明DeepSeek如此成功是因为DeepSeek团队用了OpenAI的模型来蒸馏出的DeepSeek…
2025-04-14
DeepSeek 技巧:设计图转代码!
今天快速跟大家分享个deepseek的使用技巧,利用deepseek强大的编程能力,直接将设计图转成可运行代码… 访问入口
2025-04-28
DeepSeek R2泄露:联袂华为突破封锁!
DeepSeek R2 遭泄露?当国产大模型之光碰上国产硬件之光,会碰出什么样的火花呢?我们知道R1出来有段时间了,最近通用版本V3.0也升级到v0324, 大家一直翘首以盼R2究竟什么时候出来,将会是什么样的一个配置…

2025-02-08
DeepSeek是怎么做到的?
首先,我们看数据,V3训练用了2788K的GPU Hours,相当于一块GPU用了近300多年,而他们用了2000块GUP,所以用了越2个月时间就训练出来了。对比下LLama 3.1 405B, 它们用了近3100万个GPU Hours来训练,deepseek的11倍还多,同时还要考虑deepseek用的GPU肯定是没有人家老美的性能好的,这也就是为什么V3的训练花费比海外这些同等级别模型低几个数量级的原因,从而打破老美的算力霸权,也打破了顶尖大模型只能掌握在OpenAI和谷歌这些屯了大量卡的大公司的垄断… 官网入口
公告






