- 1
- 0
- 约2.3千字
- 约 3页
- 2026-08-25 发布于北京
- 举报
一、基础概念类问答
问:大模型和普通的AI程序有什么区别?
答:主要区别在于“通用性”。普通AI程序通常是“专才”,比如下围棋的AlphaGo只会下棋,人脸识
别系统只擅长识别人脸。而大模型是“通才”,它通过海量数据学习,能处理翻译、写作、编程、推理
等各种任务,更像一个具备通用智慧的大脑。
问:参数?为什么参数规模这么重要?
答:你可以把参数理解为模型的“脑细胞”或“知识节点”。它代表了模型从数据中学到的规律和特
征。参数规模越大,意味着模型的“脑容量”越大,能学习和更复杂、更细微的规律,这是产生“涌
现能力”(如推理、创意)的基础。
问:什么是“预训练”和“微调”?
答:这是训练大模型的两个步骤。
预训练:好比“通识教育”。让模型在互联网级别的海量文本上学习,掌握语言的基本语法、知识
和逻辑关系。这是一个成本极高的过程。
微调:好比“专业培训”。基于预训练好的模型,用特定领域(如医疗、法律)或特定任务(如扮演客
服)的数据进行针对性训练,让它变得更专业、更符合我们的需求。
二、原理与技术类问答
问:大模型是如何生成一句话的?
答:它是一个基于概率的“猜词”过程。当你输入一个问题后,模型会根据你的问题,计算出
原创力文档

文档评论(0)