大语言模型(如ChatGPT)是如何训练出来的?这个问题如果向不懂技术的长辈解释,该怎么说得通俗易懂呢?本视频用生活中常见的比喻,把大模型训练过程拆解成三个简单步骤:第一步”海量阅读”——让模型读遍整个互联网的书籍、文章、网页,学会语言的基本规律;第二步”跟学”——人类示范高质量的问答,让模型学习如何与人对话;第三步”反馈优化”——让人类对模型的回答打分评价,模型根据反馈不断改进自己。通过这种层层递进的训练方式,一个什么都不会的初始模型就变成了知识渊博的AI助手。