梁文锋:DeepSeek背后的扫地僧
发表于|更新于|免费AI工具
|浏览量:
揭秘AI界“扫地僧”:他靠数学和代码,打造出中国最牛量化私募,如今又要颠覆AI行业!
相关推荐

2025-03-08
QwQ-32B测评报告:能打败DeepSeek r1吗?
阿里最新QwQ-32B推理模型测评报告啊,最终结果是否能打败DeepSeek r1呢?废话不多说,直接开测,先先选择好QwQ-32B模型,下面深度思考也确认打开… 访问入口

2025-01-29
Qwen2.5-Max:阿里最新大模型打败DeepSeek V3
阿里推出Qwen2.5 Max,performance打败DeepSeek V3啊。国产大模型真是过年都没有歇着,惊喜一波接着一波啊!废话不多说,赶紧去Demo下,准备让它写个代码试下… 访问入口

2025-03-26
DeepSeek V3.1 + Cline:最强AI编程组合?
今天早上被DeepSeek v3.1的数学能力和编程能力惊艳到了,所以今天赶紧在cline上用起来!如果大家已经用上的,可以忽略这个视频。我们首先打开vscode,去到插件扩展这里找到cline,没有安装的安装上…

2025-02-06
DeepSeek R1 是怎么训练出来的?
这几天发了不少DeepSeek的视频,看到有不少同学对V3和R1的关系不是很清楚,这里简单说下我自己的理解。首先,我们要知道大语言模型的训练最开始是用各种网络数据训练出能对语言有基本理解的模型,这通常叫做预训练过程,得出来的模型通常叫做Base Model,比如这里的DeepSeek-v3就是个base model,这个base model就像一个打破任督二脉的武林高手,一身知识和内功,但是不懂怎么运用…

2025-04-08
文心推理模型X1测评:和DeepSeek有很大差距!
看来无论是4.5还是x1,文心一言在编程方面都是一样的拉胯。所以总的来说,在我看来文心一言这些模型的能力和deepseek嘴型 v3.1 以及推理模型 r1还是存在比较大的差距… 访问入口

2024-12-28
DeepSeek V3:打败GPT4O的国产开源大模型
最新开源大语言模型王者出炉啊。国产开源模型DeepSeek v3发布,在各种benchbarks上超越llama3等一众大模型,更在编码领域打败Claude 3.5 sonnect和GPT 4o。循例,我们今天的任务就是快速对这种新模型做一次测评… 访问入口
公告





