GoAlgo

大语言模型原理(三):后训练——让模型学会对话

sanyinchen

预训练结束时,手上的基座大模型只会做一件事:接着前面的内容往下续写。用户输入「我应不应该好好学习」,它回一句「天天向上」。距离一个能用的 AI 助手,还差最后一个阶段。 一、回顾:从接龙大师说起 1.1 前两个阶段做了什么 第一节讲数据准备:资料收集与清洗得到干净文本,文本切分成 token,每个 token 转换成…

正在进入完整页面…