梁文锋:DeepSeek背后的扫地僧
发表于|更新于|编程工具
揭秘AI界“扫地僧”:他靠数学和代码,打造出中国最牛量化私募,如今又要颠覆AI行业!
相关推荐
2025-04-02
DeepSeek:如何生成流程图?
今天快速跟大家分享下怎么用deepseek r1来画流程图和时序图等,这里要用到的工具有两个,一个是deepseek,一个是免费在线绘图工具drawer.io,牵涉到的技术除了我们知道的大语言模型之外就是mermaid了,这是一种基于文本的图表绘制语言,类似markdown,通过支持mermaid的第三方工具如drawer.io就能将它渲染出来… DeepSeek访问入口 Drawer.io访问入口

2025-03-08
QwQ-32B测评报告:能打败DeepSeek r1吗?
阿里最新QwQ-32B推理模型测评报告啊,最终结果是否能打败DeepSeek r1呢?废话不多说,直接开测,先先选择好QwQ-32B模型,下面深度思考也确认打开… 访问入口

2025-03-26
DeepSeek V3.1 测评:最强非推理大语言模型!
DeepSeek 推迟最新非推理模型 DeepSeek v3.1升级,大幅度提升数学和编程等能力,今天我们来测评下它的能力去到哪… 访问入口

2025-03-31
DeepSeek R1 vs V3:推理模型是什么鬼?
这里快速跟大家澄清两个东西,一个是推理模型,一个是通用模型,也就是非推理模型。因为之前有粉丝在评论区问过我说,为什么DeepSeek r1是推理模型,DeepSeek V3不也是需要推理才能得出答案吗?我看不少人也在评论区提出相同的疑问。这里主要是大家把英语里面的inference和reasoning搞乱了…

2025-02-01
O3-Mini:OpenAI推出免费版应对DeepSeek挑战
OpenAI推出O3-Mini硬扛国产DeepSeek的挑战啊!我这段时间分享了不少我们国产之光DeepSeek R1推理大语言模型的视频,以其强大的性能和低廉的API价格直接冲击OpenAI的O系列的地位。OpenAI应该也是迫于这种压力,今天赶紧推出O3-Mini来应战,无论付费用户还是免费用户,都将会逐渐用上O3-Mini,而O3-Mini呢又分为三个版本low,medium和high,并且开始支持上函数调用等各种高级功能… 访问入口

2025-02-08
DeepSeek是怎么做到的?
首先,我们看数据,V3训练用了2788K的GPU Hours,相当于一块GPU用了近300多年,而他们用了2000块GUP,所以用了越2个月时间就训练出来了。对比下LLama 3.1 405B, 它们用了近3100万个GPU Hours来训练,deepseek的11倍还多,同时还要考虑deepseek用的GPU肯定是没有人家老美的性能好的,这也就是为什么V3的训练花费比海外这些同等级别模型低几个数量级的原因,从而打破老美的算力霸权,也打破了顶尖大模型只能掌握在OpenAI和谷歌这些屯了大量卡的大公司的垄断… 官网入口
公告





