DeepSeek R1 是怎么训练出来的?
发表于|更新于|学习
这几天发了不少DeepSeek的视频,看到有不少同学对V3和R1的关系不是很清楚,这里简单说下我自己的理解。首先,我们要知道大语言模型的训练最开始是用各种网络数据训练出能对语言有基本理解的模型,这通常叫做预训练过程,得出来的模型通常叫做Base Model,比如这里的DeepSeek-v3就是个base model,这个base model就像一个打破任督二脉的武林高手,一身知识和内功,但是不懂怎么运用…
相关推荐

2025-04-09
腾讯混元T1推理模型测评:没有对比就没有伤害!
昨天测评了腾讯混元大模型的通用模型,一般问答都挺好,但编程能力拉胯,今天再测评推理模型T1,最后会对比下它和deepseek r1的编程能力… 访问入口

2025-02-21
Grok3推理模型测评:打败DeepSeek r1?
Grok3 reasoning model推理模型测试报告啊。今天终于发现可以在官网上免费用上Grok3了,鉴于上次在lmarena上测试的是early-grok-3,这次准备在官网上正式测试下,我们这次先测试的是推理模型。去到官网,看到这里已经是grok 3了,选择Think,打开推理模式… 访问入口

2025-03-26
Gemini 2.5 Pro 测评:最强推理大语言模型!
昨天测评了下最新的DeepSeek V3.1,着实惊艳!有粉丝留言说希望我测试下最新的Gemin 2.5 Pro,义不容辞啊!首先大家要知道这是个推理模型,所以我今天的测试加了几道粉丝提供的推理题,然后它在lmarena上多个benchmarks上打败了o3-mini, gpt-4.5, claude 3.7,deepseek r1等模型… 访问入口

2025-01-27
DeepSeek R1:怎么实现国产免费加强版Perplexity
国产加强版Perplexity啊!我们知道Perplexity可谓是大语言模型应用落地最成功的产品,他可以将网络搜索的内容帮我们整理好再给我们答案,不需要我们点开各个搜索结果网页查看,但它做的更多还是将拿回来的网站内容文本做总结,并不确保结果一定合理。如果我们将它这个网络搜索总结能力结合推理大模型的能力,那我们将会得到加强版的Perplexity了。而这,就是今天我要跟大家分享的最强免费推理大语言模型deepseek r1了,通过它的深度思考和网络搜索能力… 访问入口

2025-03-08
Lightning AI:免费微调DeepSeek r1
这可能是最简单的用自己数据微调出自己的DeepSeek r1的方法了。今天淘到的这个AI工具叫做lightning ai,它让我们只需要简单几步就能微调出自己的DeepSeek r1. 而它每月提供免费的GPU额度给我们用,足够我们一般人玩耍了。废话不多说,我们立刻看Demo… 访问入口
2025-12-01
Trae solo 实战之自定义智能体怎么玩?
上一个视频去体验了字节的Trae solo。这一集视频准备玩下自定义智能体,Trae号称是能定义不同的智能体来专注于解决不同领域的问题。好,废话不多说,我们看下怎么自定义一个智能体并用起来 访问入口
公告





