【斯坦福---机器学习】复习笔记之朴素贝叶斯算法

限时加码!20+主流AI编程工具免费用 购周边加赠Coding Plan Lite,Claude Code、Cursor等即刻畅享,学习进阶更高效! 阅读详情

本讲大纲:

1.朴素贝叶斯(Naive Bayes)
2.神经网络(Neural Networks)
3.支持向量机(Support vector machines)

1.朴素贝叶斯

前面讲的主要是是二元值的特征,更一般化的是xi可以取{1,2,3…k},这样的话可以用多项式分布代替伯努利分布对p(x|y)进行建模. 即使一些输入特征是连续值,我们也很容易离散化. 就比如说我们xi表示居住面积,我们可以离散化如下:
这里写图片描述

然后我们可以利用朴素贝叶斯算法,用多项式分布进行建模.
当原始的连续值在多项分布中建模效果不是很好时,离散这些特征然后使用朴素贝叶斯(而不是GDA)常常会得到一个更好的结果.

文本分类的事件模型
在文本分类的特定语境下,朴素贝叶斯使用多变量伯努利事件模型(multi-variate Bernoulli event model).

多项式事件模型(multinomial event model)
为了说明这个模型,换一种记号的方法.
xi表示在一封邮件中的第i个词,xi的取值为这里写图片描述,其中这里写图片描述表示字典的大小. n个词的邮件可以表示为向量这里写图片描述.

假设邮件产生的方式是由垃圾还是非垃圾邮件决定是一个随机的过程,邮件的发送者写的第一个词x1是由服从p(x1|y)的多项式分布产生的,x2是独立与x1的并且来自于同一个多项式分布,同样的,产生x3,x4,一直到xn. 因为所有的这个信息的概率是这里写图片描述.
模型的参数为:
这里写图片描述
这里写图片描述这里写图片描述
这里写图片描述
注意p(xj|y)对所有的j来说都是一样的,也就是说词的产生和它的位置无关.

似然性:
这里写图片描述

参数的最大似然估计为:
这里写图片描述

应用laplace平滑,分子加1,分母加|V|,得到:
这里写图片描述

2.神经网络

现在想讨论的问题是非线性分类器(non-linear classifier).

分类算法中用logistic回归画出一条直线把训练集分开,但是有时候并不能被一条直线分开,我们希望:
这里写图片描述

假设特征是x0,x1,x2,x3,圈圈表示计算节点,最后的输出为hθ(x),得到非线性分界线假设,如图:
这里写图片描述

输入特征输入到多个sigmoid单元,然后这些单元再输入到一个sigmoid单元,得到神经网络,这些中间节点叫做隐藏层,神经网络可以有多个隐藏层.
这里写图片描述

其中的参数:
这里写图片描述
a2,a3都是类似的;
最终的输出,这里写图片描述

展示通过神经网络识别数字的程序,即使有很多的噪音效果依旧非常好!

3.支持向量机(SVM)

很多人认为SVM是最好的监督学习算法.

考虑logistic回归:
预测1等价于这里写图片描述等价于这里写图片描述这里写图片描述越大,这里写图片描述就越大,就越高的程度预测1,也就是可以说如果这里写图片描述,那么y=1. 类似地,如果这里写图片描述那么y=0.
如果能够找到参数使得当y(i)=1时,这里写图片描述,而当y(i)=0时有这里写图片描述. 那么这个预测对训练集很好的.

为了讨论SVM的简单性,介绍一种新的标记:
这里写图片描述
这里写图片描述
这里b代替了这里写图片描述的角色,w代替这里写图片描述的角色.

函数间隔(functional margin):这里写图片描述
如果这里写图片描述,为了使函数间隔很大,这里写图片描述需要这里写图片描述是一个很大的正数;相反,如果这里写图片描述为了使函数间隔很大,需要这里写图片描述是一个很大的负数. 如果这里写图片描述,则我们的预测结果是正确的. 因此,一个大的函数间隔表示一个很确定的正确预测.

但是注意到的一个问题是,如果用2w代替w,用2b代替b,那么由于这里写图片描述,不会对这里写图片描述有任何改变,也就是说这里写图片描述只是取决于符号而跟数量没有关系. 但是用(2w,2b)代替(w,b)会使得函数间隔间隔增大两倍,似乎不用改变任何有意义的东西函数间隔就可以变得任意大. 直接告诉我们可以正规化(normalization), 可以用这里写图片描述代替(w,b).

定义整个训练集的函数间隔为单个训练样本的最小值,记做:这里写图片描述

几何间隔(geometric margins):这里写图片描述

这里写图片描述

w是垂直分隔超平面的,考虑训练样本A,它到决定边界线的距离是这里写图片描述,也就是线段AB的长度. 这里写图片描述是单位向量(unit-length vector), B点表示为为:这里写图片描述,在决定边界线上的所有点满足这里写图片描述因此:
这里写图片描述
解到:
这里写图片描述

如果||w||等于1,函数间隔等于几何间隔. 几何间隔是不会随着参数的调整而变化的.

定义整个训练集的几何间隔为单个训练样本的几何间隔的最小值:
这里写图片描述

朴素贝叶斯算法 朴素贝叶斯优缺点:优点:在数据较少的情况下仍然有效,可以处理多类别问题缺点:对于输入数据的准备方式较为敏感,由于朴素贝叶斯的“特征条件独立”特点,所以会带来一些准确率上的损失。 阅读详情

相关推荐

斯坦福---机器学习复习笔记之生成学习算法

本讲大纲:1.生成学习算法(Generative learning algorithm) 2.高斯判别分析(GDA,Gaussian Discriminant Analysis) 3.朴素贝叶斯(Naive Bayes) 4.拉普拉斯平滑(Laplace smoothing)1.生成学习算法判别学习算法(discriminative learning algorithm):直接学习p(y|x)

ForLearning 1万+

机器学习的向量

向量(Vector)在机器学习中扮演着非常重要的角色。

DXB2021的博客 3781

机器学习-斯坦福】学习笔记5 - 生成学习算法

生成学习算法 本次课程大纲: 1、 生成学习算法 2、 高斯判别分析(GDA,Gaussian Discriminant Analysis) - 高斯分布(简要) - 对比生成学习算法&判别学习算法(简要) 3、 朴素贝叶斯 4、 Laplace平滑

Maverick 5083

机器学习朴素贝叶斯算法

朴素贝叶斯(Naive Bayes)是经典的机器学习算法之一,也是为数不多的基于概率论的分类算法。由于朴素贝叶斯计算联合概率,所以朴素贝叶斯模型属于生成式模型。经典应用案例包括:文本分类、垃圾邮件过滤等。

Dong_ZH的博客 1万+

机器学习算法(7)—— 朴素贝叶斯算法

朴素贝叶斯是一种分类算法,经常被用于文本分类,它的输出结果是某个样本属于某个类别的概率。(1)优点朴素贝叶斯模型发源于古典数学理论,有稳定的分类效率对缺失数据不太敏感,算法也比较简单,常用于文本分类分类准确度高,速度快(2)缺点由于使用了样本属性独立性的假设,所以如果特征属性有关联时其效果不好需要计算先验概率,而先验概率很多时候取决于假设,假设的模型可以有很多种,因此在某些时候会由于假设的先验模型的原因导致预测效果不佳;

hu_wei123的博客 9555

机器学习算法——朴素贝叶斯算法

朴素贝叶斯算法是一种经典的概率分类算法,它基于贝叶斯定理和特征独立性假设。该算法常被用于文本分类、垃圾邮件过滤、情感分析等领域。朴素贝叶斯算法的核心思想是通过已知类别的训练样本集,学习出每个类别的概率分布模型,然后根据待分类样本的特征,利用贝叶斯定理计算出样本属于各个类别的后验概率,最终选择具有最大后验概率的类别作为分类结果。在朴素贝叶斯算法中,特征之间被假设为相互独立,这是为了简化计算。尽管这个假设在现实问题中并不总是成立,但朴素贝叶斯算法仍然表现出良好的分类效果。

huangQK的博客 1969

机器学习概念总记不住?斯坦福CS 229速查手册帮你省一半复习时间

不知道你有没有过这种经历:白天刚看完线性回归的推导,晚上合上书,满脑子只剩"好像学过"四个字。等到真上手写代码,连"什么时候该用 L2 正则化"都要现翻笔记。学机器学习最磨人的,从来不是它有多难,而是**知识点太散、太碎,记不住**。 后来我翻到一个开源仓库 **stanford-cs-229-machine-learning**,里面躺着斯坦福 CS 229 课程的全套 VIP 速查手册。几百

gitblog_00830的博客 733

机器学习速查表终极攻略:用斯坦福CS 229全套手册快速搭建知识体系

斯坦福CS 229机器学习速查表项目(stanford-cs-229-machine-learning)把整门课程的核心概念浓缩为7份PDF手册,覆盖监督学习、无监督学习、深度学习与数学基础,让你告别笔记散乱,快速完成系统性复习--- ## 学了就忘?先治"信息过载"这个病 学过机器学习的你,多半经历过这样的崩溃时刻:课上的公式当时都懂,隔两周再翻开笔记,符号认不全、推导接不上,翻遍十几

gitblog_00928的博客 1243

TextDiffuser 技术实战:用两阶段扩散模型实现可控文字图像渲染、模板迁移与文字修复

TextDiffuser 是微软 unilm 仓库中面向"文字渲染"任务的两阶段扩散模型框架,它能把一句包含引号关键词的文本提示词,渲染成文字拼写准确、且与背景画面协调一致的图像,同时支持基于模板图迁移文字版式、以及基于文字蒙版的图像局部修复。读完本文,你可以掌握其完整的环境搭建与自定义 diffusers 依赖安装、MARIO-LAION 数据集的准备方式、`train.py` 全部关键训练参数

gitblog_00810的博客 447

斯坦福CS 229机器学习速查手册:3步把PDF速查表变成你的随身复习助手

深夜准备机器学习面试,对着厚厚一摞课件翻来覆去,却发现脑子一片空白——这种痛苦我太熟悉了。直到我发现了 **斯坦福CS 229机器学习速查手册**(stanford-cs-229-machine-learning)这个开源项目,它把整门课最核心的知识点压缩成了几张"一页纸"的 PDF 速查表,复习效率直接翻倍。如果你也在为机器学习知识点太多、太散而发愁,这篇文章就是为你准备的。🎯 ## 这份开

gitblog_00057的博客 416

机器学习-斯坦福】学习笔记6 - 朴素贝叶斯

本次课程大纲: 1、 朴素贝叶斯 - 朴素贝叶斯事件模型 2、 神经网络(简要) 3、 支撑向量机(SVM)铺垫 – 最大间隔分类器

Maverick 6061

斯坦福大学Andrew Ng教授主讲的《机器学习》公开课观后感

近日,在网易公开课视频网站上看完了《机器学习》课程视频,现做个学后感,也叫观后感吧。  学习时间 从2013年7月26日星期五开始,在网易公开课视频网站上,观看由斯坦福大学Andrew Ng教授主讲的计算机系课程(编号CS229)《机器学习》(网址http://v.163.com/special/opencourse/machinelearning.html)(注:最早是在新浪公开课

lotus___的专栏 7万+

机器学习速查手册终极指南:10分钟吃透斯坦福CS 229全部核心内容

面对堆积如山的机器学习资料,你是不是也常陷入"公式记不住、算法分不清、复习没头绪"的困境?这套开源免费的**斯坦福CS 229机器学习速查手册**,正是为破解这个难题而生——它把一门顶级名校课程的全部核心知识点,浓缩成几张随查随用的高密度速查表,帮你用最短时间搭起完整知识框架。 ## 别慌,先认识这套"救命"资料 简单说,这是斯坦福CS 229机器学习课程的VIP速查表合集,由课程团队精心整理

gitblog_00299的博客 1014

机器学习-斯坦福】学习笔记6 - 朴素贝叶斯 转maverick

朴素贝叶斯 本次课程大纲: 1、 朴素贝叶斯 - 朴素贝叶斯事件模型 2、 神经网络(简要) 3、 支撑向量机(SVM)铺垫 – 最大间隔分类器 复习: 1、 朴素贝叶斯 一种生成学习算法,对p(x|y)建模。 例:垃圾邮件分类 以邮件输入流作为输入,输出y为{0,1},1为垃圾邮件,0为非垃圾邮件。 将邮件文本表示为一个输入向量x 1) xi∈{0,1},表示字典中的第i个词是否出现在邮件中 2) x长度为n,n为字典的词数 3) 该模型称为多元...

m0_61781914的博客 182

斯坦福CS229机器学习课程笔记一:线性回归与梯度下降算法

应该是去年的这个时候,我开始接触机器学习的相关知识,当时的入门书籍是《数据挖掘导论》。囫囵吞枣般看完了各个知名的分类器:决策树、朴素贝叶斯SVM神经网络、随机森林等等;另外较为认真地复习了统计学,学习了线性回归,也得以通过orange、spss、R做一些分类预测工作。可是对外说自己是搞机器学习的还是不太自信,毕竟和科班出身的各位大牛相比自己对这些模型、算法的理解只能算是“知其然而不知...

diezhangu4106的博客 298

斯坦福CS229机器学习课程2026版:中文字幕与课件资源高效学习指南

机器学习作为人工智能的核心分支,其基础理论是理解现代算法模型的关键。从监督学习到无监督学习,其原理建立在统计学与优化理论之上,通过算法从数据中自动学习规律,为预测与决策提供支持。这一技术价值在于将数据转化为可行动的洞察,广泛应用于推荐系统、计算机视觉、自然语言处理等领域。对于希望系统掌握机器学习核心的学习者,斯坦福CS229课程提供了从线性回归到前沿模型的完整知识体系。本文聚焦于该课程2026年夏季最新版本,其配套的**中文字幕**和**官方课件**极大降低了学习门槛,并提供了从资源获取、学习路径规划到实践

weixin_30562507的博客 379
上一篇: mel的helloworld程序
下一篇: 【斯坦福---机器学习】复习笔记之最优间隔分类器
Andrewseu
博客等级 码龄14年 335粉丝 182原创
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值