目录
1. 人工智能:让机器表现出智能
人工智能(Artificial Intelligence,AI)是研究、开发用于模拟、延伸和扩展人类智能的理论、方法、技术及应用系统的一门科学。
AI 的本质是对人类智能的模拟。无论是简单规则 if-else,还是复杂神经网络,只要展现出“聪明”的决策行为,都可以归入 AI 范畴。
学界通常分两类:
| 类型 | 目标 |
|---|---|
| 强人工智能 | 制造真正拥有心智、意识、能理解自身存在的机器 |
| 弱人工智能 | 在特定领域表现出智能行为,像人一样好,甚至更好 |
当前 AI 大多属于弱人工智能,例如语音助手、机器人、DeepSeek 等。它们模仿的是智能的“行为”,而非复制智能的“本质”。
2. 机器学习:从人工规则到数据找规律
机器学习(Machine Learning,ML)是 AI 的子领域。它的核心不再是手动编写规则,而是通过数据训练算法,让计算机从历史样本中自动总结规律。
本质可以写成:
text
给定输入 x 和输出 y,让机器自动找到函数 f(x) ≈ y
例如打车费用:
text
y = 2x + 10
传统方式是人类直接写出公式。机器学习则是给出数据:
| X 公里 | 1 | 2 | 3 |
|---|---|---|---|
| Y 费用 | 12 | 14 | 16 |
机器自动求出参数 a=2, b=10,得到模型 y=2x+10。当 x=20 时,预测费用为 50 元。
关键术语:
| 术语 | 含义 |
|---|---|
| 特征 | 输入 x,如图片、语音、公里数 |
| 标签 | 目标 y,如“车/人”“价格” |
| 样本 | 特征 + 标签 |
| 训练 / 学习 | 自动寻找模型参数的过程 |
| 推理 / 预测 | 用训练好的模型计算新结果 |
| 范式 | 反馈信号 | 特点与例子 |
|---|---|---|
| 监督学习 | 人工标注 | 有标准答案,如鸢尾花分类、垃圾邮件识别 |
| 无监督学习 | 数据内在结构 | 无标签,自动找规律,如用户聚类 |
| 半监督学习 | 少量标签 + 大量无标签 | 用伪标签提升效果,如医疗影像 |
| 自监督学习 | 数据自动构造监督信号 | 大模型预训练核心,如预测被遮挡部分、扩散模型 |
| 强化学习 | 环境奖励 / 惩罚 | 试错学习,追求长期收益,如 AlphaGo |
3.1 监督学习
模型通过带标签数据学习输入到输出的映射。典型任务:分类、回归。
例:鸢尾花数据集通过花萼、花瓣特征预测花的品种。
3.2 无监督学习
没有标签,让算法自行发现隐藏结构。
例:电商把“买尿不湿的女性”聚为“宝妈群体”,并推荐婴儿湿巾、奶粉等。
3.3 半监督学习
利用少量有标签数据和大量无标签数据训练。
例:500 张医生标注 X 光片 + 大量未标注 X 光片,通过伪标签提升模型准确率。
3.4 自监督学习
让数据“自己标注自己”。模型隐藏数据一部分,再尝试预测这部分。
例:扩散模型通过“加噪—去噪”学习图像规律,最终能从随机噪声生成图像。
自监督学习也是当前大模型预训练的核心范式。
3.5 强化学习
通过与环境交互,根据奖励或惩罚优化策略。
例:AlphaGo 先监督学习人类棋谱,再通过自我对弈强化学习,最终超越人类。
4. 常见机器学习任务
| 任务 | 类型 | 输出 | 例子 |
|---|---|---|---|
| 分类 | 监督学习 | 离散类别 | 垃圾邮件识别 |
| 回归 | 监督学习 | 连续数值 | 股票价格预测 |
| 聚类 | 无监督学习 | 若干簇 | 音乐 App 用户分群 |
| 关联规则 | 无监督学习 | X → Y | 啤酒与尿布 |
| 序列预测 | 监督/自监督 | 下一个元素 | 机器翻译、文本补全 |
序列预测常见模型:RNN、LSTM、GRU、Transformer。
5. 深度学习:自动特征与多层嵌套
深度学习(Deep Learning,DL)是机器学习的分支,通过构建多层神经网络实现自主学习与预测。
传统机器学习常需要人工设计特征;深度学习则能自动从原始数据中逐层构建抽象特征:
text
像素 → 边缘 → 轮廓 → 物体部件 → 物体神经网络通常包括:
输入层:接收原始数据
隐藏层:逐层处理,可有多个
输出层:产生最终结果
数学本质不再是简单
y=f(x),而是多层嵌套:text
y = f_n(...f_2(f_1(x)))每一层都在上一层结果上继续加工,信息越来越抽象。
例子:AI 判断“西红柿炒鸡蛋”
| 层级 | 作用 |
|---|---|
| 输入层 | 接收图片像素矩阵 |
| 隐藏层 1 | 检测红色、黄色 |
| 隐藏层 2 | 判断块状、絮状 |
| 隐藏层 3 | 判断红黄是否交错混合 |
| 输出层 | 输出“是 / 不是西红柿炒鸡蛋” |
隐藏层之所以“隐藏”,是因为用户只看到最终结果,看不到中间特征报告。
为什么叫“深度”?
深度 = 层数多。常见模型层数:
| 模型 | 层数 |
|---|---|
| 原始 Transformer | 6 层编码器 + 6 层解码器 |
| GPT-1 | 12 层 |
| GPT-3 175B | 96 层 |
| GPT-4 | 传闻约 120 层 |
6. 大模型:深度学习的规模化
大模型通常指参数规模巨大、网络层数很深、训练数据与算力需求极高的深度学习模型,典型代表如 GPT、DeepSeek 等。
它不是一种全新算法,而是深度学习在规模上的跃迁:
text
大模型 ≈ 深度神经网络 + 海量参数 + 海量数据 + 大算力 + 自监督预训练
大模型的核心能力来自:
-
大规模自监督预训练,从无标签数据中学习通用规律;
-
多层 Transformer 结构,具备强大表示能力;
-
参数规模达到数十亿甚至数千亿,涌现出复杂能力。
7. 按数据模态:计算机视觉常见任务
计算机视觉(Computer Vision,CV)目标是让机器“看懂”世界。
| 任务 | 目标 |
|---|---|
| 图像分类 | 识别图中“是什么” |
| 目标检测 | 识别“有什么”并框出“在哪里” |
| 语义分割 | 给每个像素分类 |
| 实例分割 | 区分同一类别的不同个体 |
| 目标跟踪 | 在视频中持续定位目标 |
| 关键点检测 | 找到定义形状的关键坐标 |
| OCR | 从图像中读取文字与符号 |
8. 总结
-
AI:让机器表现出智能,是目标。
-
ML:从数据中自动找规律,是实现 AI 的主要手段。
-
DL:用多层神经网络自动学习特征,是 ML 的主流分支。
-
大模型:深度学习在参数、数据、算力上的规模化产物。
-
学习范式:监督、无监督、半监督、自监督、强化学习。
-
任务类型:分类、回归、聚类、关联规则、序列预测等。

493

被折叠的 条评论
为什么被折叠?



