梁文锋:DeepSeek背后的扫地僧
发表于|更新于|编程工具
|浏览量:
揭秘AI界“扫地僧”:他靠数学和代码,打造出中国最牛量化私募,如今又要颠覆AI行业!
相关推荐

2025-02-21
Grok3推理模型测评:打败DeepSeek r1?
Grok3 reasoning model推理模型测试报告啊。今天终于发现可以在官网上免费用上Grok3了,鉴于上次在lmarena上测试的是early-grok-3,这次准备在官网上正式测试下,我们这次先测试的是推理模型。去到官网,看到这里已经是grok 3了,选择Think,打开推理模式… 访问入口
2025-05-03
DeepSeek数学模型测评:难道是我打开方式不对?
昨晚分享了DeepSeek最新推出的专门做数学题的DeepSeek-Prover-V2-671B,今天就发现huggingface已经有space托管出来了,我们立刻上去看下。 既然是专门处理数学模型的,我们就找一些数学题给他做下吧… 访问入口

2024-12-28
DeepSeek V3:打败GPT4O的国产开源大模型
最新开源大语言模型王者出炉啊。国产开源模型DeepSeek v3发布,在各种benchbarks上超越llama3等一众大模型,更在编码领域打败Claude 3.5 sonnect和GPT 4o。循例,我们今天的任务就是快速对这种新模型做一次测评… 访问入口

2025-02-08
DeepSeek是怎么做到的?
首先,我们看数据,V3训练用了2788K的GPU Hours,相当于一块GPU用了近300多年,而他们用了2000块GUP,所以用了越2个月时间就训练出来了。对比下LLama 3.1 405B, 它们用了近3100万个GPU Hours来训练,deepseek的11倍还多,同时还要考虑deepseek用的GPU肯定是没有人家老美的性能好的,这也就是为什么V3的训练花费比海外这些同等级别模型低几个数量级的原因,从而打破老美的算力霸权,也打破了顶尖大模型只能掌握在OpenAI和谷歌这些屯了大量卡的大公司的垄断… 官网入口

2025-03-26
DeepSeek V3.1 测评:最强非推理大语言模型!
DeepSeek 推迟最新非推理模型 DeepSeek v3.1升级,大幅度提升数学和编程等能力,今天我们来测评下它的能力去到哪… 访问入口

2025-02-03
O3-mini vs DeepSeek r1 对比评测
OpenAI免费O3-mini效果惊人啊!上两天我分享了个视频说OpenAI迫于DeepSeek R1的压力推出了免费的O3-Mini来硬扛,今天我们就循例用这套测试用例快速的测试下。我们来到官网,我当前这个是免费账号,这里我们可以看到我们用的是O3-mini,要用上这个记得这里选上推理… ChatGPT访问入口 DeepSeek访问入口
公告





