大模型是什么?一文梳理 AI、机器学习、深度学习与大模型

目录

1. 人工智能:让机器表现出智能

2. 机器学习:从人工规则到数据找规律

3.1 监督学习

3.2 无监督学习

3.3 半监督学习

3.4 自监督学习

3.5 强化学习

4. 常见机器学习任务

5. 深度学习:自动特征与多层嵌套

例子:AI 判断“西红柿炒鸡蛋”

为什么叫“深度”?

6. 大模型:深度学习的规模化

7. 按数据模态:计算机视觉常见任务

8. 总结


1. 人工智能:让机器表现出智能

人工智能(Artificial Intelligence,AI)是研究、开发用于模拟、延伸和扩展人类智能的理论、方法、技术及应用系统的一门科学。

AI 的本质是对人类智能的模拟。无论是简单规则 if-else,还是复杂神经网络,只要展现出“聪明”的决策行为,都可以归入 AI 范畴。

学界通常分两类:

类型目标
强人工智能制造真正拥有心智、意识、能理解自身存在的机器
弱人工智能在特定领域表现出智能行为,像人一样好,甚至更好

当前 AI 大多属于弱人工智能,例如语音助手、机器人、DeepSeek 等。它们模仿的是智能的“行为”,而非复制智能的“本质”。


2. 机器学习:从人工规则到数据找规律

机器学习(Machine Learning,ML)是 AI 的子领域。它的核心不再是手动编写规则,而是通过数据训练算法,让计算机从历史样本中自动总结规律。

本质可以写成:

text

给定输入 x 和输出 y,让机器自动找到函数 f(x) ≈ y

例如打车费用:

text

y = 2x + 10

传统方式是人类直接写出公式。机器学习则是给出数据:

X 公里123
Y 费用121416

机器自动求出参数 a=2, b=10,得到模型 y=2x+10。当 x=20 时,预测费用为 50 元。

关键术语:

术语含义
特征输入 x,如图片、语音、公里数
标签目标 y,如“车/人”“价格”
样本特征 + 标签
训练 / 学习自动寻找模型参数的过程
推理 / 预测用训练好的模型计算新结果
范式反馈信号特点与例子
监督学习人工标注有标准答案,如鸢尾花分类、垃圾邮件识别
无监督学习数据内在结构无标签,自动找规律,如用户聚类
半监督学习少量标签 + 大量无标签用伪标签提升效果,如医疗影像
自监督学习数据自动构造监督信号大模型预训练核心,如预测被遮挡部分、扩散模型
强化学习环境奖励 / 惩罚试错学习,追求长期收益,如 AlphaGo

3.1 监督学习

模型通过带标签数据学习输入到输出的映射。典型任务:分类、回归。
例:鸢尾花数据集通过花萼、花瓣特征预测花的品种。

3.2 无监督学习

没有标签,让算法自行发现隐藏结构。
例:电商把“买尿不湿的女性”聚为“宝妈群体”,并推荐婴儿湿巾、奶粉等。

3.3 半监督学习

利用少量有标签数据和大量无标签数据训练。
例:500 张医生标注 X 光片 + 大量未标注 X 光片,通过伪标签提升模型准确率。

3.4 自监督学习

让数据“自己标注自己”。模型隐藏数据一部分,再尝试预测这部分。
例:扩散模型通过“加噪—去噪”学习图像规律,最终能从随机噪声生成图像。
自监督学习也是当前大模型预训练的核心范式。

3.5 强化学习

通过与环境交互,根据奖励或惩罚优化策略。
例:AlphaGo 先监督学习人类棋谱,再通过自我对弈强化学习,最终超越人类。


4. 常见机器学习任务

任务类型输出例子
分类监督学习离散类别垃圾邮件识别
回归监督学习连续数值股票价格预测
聚类无监督学习若干簇音乐 App 用户分群
关联规则无监督学习X → Y啤酒与尿布
序列预测监督/自监督下一个元素机器翻译、文本补全

序列预测常见模型:RNN、LSTM、GRU、Transformer。


5. 深度学习:自动特征与多层嵌套

深度学习(Deep Learning,DL)是机器学习的分支,通过构建多层神经网络实现自主学习与预测。

传统机器学习常需要人工设计特征;深度学习则能自动从原始数据中逐层构建抽象特征:

text

像素 → 边缘 → 轮廓 → 物体部件 → 物体

神经网络通常包括:

  • 输入层:接收原始数据

  • 隐藏层:逐层处理,可有多个

  • 输出层:产生最终结果

数学本质不再是简单 y=f(x),而是多层嵌套:

text

y = f_n(...f_2(f_1(x)))

每一层都在上一层结果上继续加工,信息越来越抽象。

例子:AI 判断“西红柿炒鸡蛋”

层级作用
输入层接收图片像素矩阵
隐藏层 1检测红色、黄色
隐藏层 2判断块状、絮状
隐藏层 3判断红黄是否交错混合
输出层输出“是 / 不是西红柿炒鸡蛋”

隐藏层之所以“隐藏”,是因为用户只看到最终结果,看不到中间特征报告。

为什么叫“深度”?

深度 = 层数多。常见模型层数:

模型层数
原始 Transformer6 层编码器 + 6 层解码器
GPT-112 层
GPT-3 175B96 层
GPT-4传闻约 120 层

6. 大模型:深度学习的规模化

大模型通常指参数规模巨大、网络层数很深、训练数据与算力需求极高的深度学习模型,典型代表如 GPT、DeepSeek 等。

它不是一种全新算法,而是深度学习在规模上的跃迁:

text

大模型 ≈ 深度神经网络 + 海量参数 + 海量数据 + 大算力 + 自监督预训练

大模型的核心能力来自:

  1. 大规模自监督预训练,从无标签数据中学习通用规律;

  2. 多层 Transformer 结构,具备强大表示能力;

  3. 参数规模达到数十亿甚至数千亿,涌现出复杂能力。


7. 按数据模态:计算机视觉常见任务

计算机视觉(Computer Vision,CV)目标是让机器“看懂”世界。

任务目标
图像分类识别图中“是什么”
目标检测识别“有什么”并框出“在哪里”
语义分割给每个像素分类
实例分割区分同一类别的不同个体
目标跟踪在视频中持续定位目标
关键点检测找到定义形状的关键坐标
OCR从图像中读取文字与符号

8. 总结

  • AI:让机器表现出智能,是目标。

  • ML:从数据中自动找规律,是实现 AI 的主要手段。

  • DL:用多层神经网络自动学习特征,是 ML 的主流分支。

  • 大模型:深度学习在参数、数据、算力上的规模化产物。

  • 学习范式:监督、无监督、半监督、自监督、强化学习。

  • 任务类型:分类、回归、聚类、关联规则、序列预测等。

评论 1
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值