5.2 AI大模型的训练.pptxVIP

  • 1
  • 0
  • 约4.32千字
  • 约 29页
  • 2026-09-29 发布于山东
  • 举报

人工智能通识课·第五章生成式人工智能从数据到智能的进化:预训练、微调、对齐与轻量化AI大模型的训练5.2

学习目标学完本节,你能说清楚这五件事01按顺序说出大模型训练的四个阶段及其作用02解释自监督学习与LoRA参数高效微调分别在做什么03对比国内外模型单次预训练成本,说明轻量化为何重要04列出LLaMAFactory微调所需的最低环境配置05用Qwen2-VL走完一次文旅模型微调的关键参数与验证步骤

学习路线这一节,我们按这条路径走一、训练四阶段预训练→监督微调→奖励建模→强化学习,看清每阶段各做什么。二、成本与轻量化国内外成本对比,国内模型如何把门槛打下来。三、动手微调实践用LLaMAFactory微调Qwen2-VL做一个文旅导游模型。四、实战与实训一个完整落地案例,加一个结合AI的动手实训。主线:先理解怎么训,再看为何便宜,最后自己动手训一次。

本节驱动问题大模型那么大,训练为什么不能一步到位?困惑锚点你以为训练就是把海量数据喂给模型、跑完就好。但事实是:这样训出来的模型只会接话,不会听话——它不懂你要什么风格、也分不清什么该说什么不该说。

总览·盖智能大厦训练为什么像盖一座智能大厦?预训练打地基:学语言与世界知识监督微调SFT装修房间:适配具体任务奖励建模设计规则:塑造价值观强化学习适应环境:按反馈迭代四个阶段层层递进

文档评论(0)

1亿VIP精品文档

相关文档