你需要先建立的 4 个概念
- AI(人工智能):让机器表现出类似人类智能的技术总称。
- 机器学习:AI 的一种实现方式,让模型从数据中学习规律,而不是由程序员写死规则。
- 深度学习:机器学习的一个分支,使用神经网络处理图像、语音、文本等复杂数据。
- 生成式 AI:能生成新内容的 AI,例如文本、图片、视频、代码、音乐。
大语言模型是什么
大语言模型(LLM)本质上是一个基于大量文本训练出来的概率模型。它并不是像数据库一样“记住答案”,而是根据上下文预测最可能出现的下一个词。
为什么 2023 之后 AI 爆发
核心原因有三点:
- 模型规模变大,涌现出更强推理与泛化能力。
- 指令微调和人类反馈让模型更像助手。
- 工具调用、多模态、Agent 等能力让模型能真正进入工作流。
学习建议
先不要陷入模型论文和算法细节。更好的路径是:
- 先理解 AI 能做什么、不能做什么。
- 再学习 Prompt、RAG、Agent 等应用层能力。
- 最后再补模型训练、推理、部署等工程知识。