PRML 01 绪论:引言与引例

这里写图片描述
作者Christopher M. Bishop

1引言:

模式识别已经有较长的研究历史,甚至在天文和原子光谱(atomic spectra)也有着重要的应用。
下面使用手写识别这个例子对相关概念做通俗的介绍(in a relatively informed way)
这里写图片描述
我们的目的是构建一个模型(Machine)从这些图片的信息中得到我们想要的结果。
图片的信息是我们输入的,这里是28*28像素组成的784维向量
我们可以自己设定规则或者使用启发式的方法来设立这个模型,类似于当图片信息满足某一个条件就是1或者是2,但是这种人工规则的方法有时候并不好用。
使用机器学习的方法有时候可以获得更好的结果,既然是学习,就要有以前的可以学习的样本,这些用来训练机器的样本就是训练样本
如果告诉了每个样本的目标值(1,2,3…)那么这个训练样本就包含目标向量
通过样本学习的过程就叫作训练或者学习
如果我们的训练目标是有限的,就叫做分类,如果是无限的就叫做回归
学习完成之后,用这个训练好的模型可以去识别之前没有遇见过的东西,这样能力叫作泛化
在大多数的应用中,输入值都需要进行预处理,比如可以进行归一化等等。预处理会有助于算法的运行,使计算更迅速,更准确,这个过程也叫作特征抽取。注意对数据进行预处理时可能会丢失有用的信息。
上面这种有目标向量的模型的学习过程,是有监督学习,如果没有目标向量就是无监督学习。无监督学习可能需要将相同的数据放在一起归类,这种就叫做聚类,如果要发现数据分布的规律就叫做密度估计,有的时候需要将数据降维并投影到2d或者3d这一过程叫作可视化
还有一种学习叫作reinforcement learning 增强学习,比如一个机器人有四条腿,我们要让他自己学会先前走,如果他向前走了1步,那我们就给他一个回报reward,鼓励他以下,最后他就会学会如何很好的行走,这种学习方式就是增强学习,这本书不足详细阐述。
上面的学习种类不同,但是也有一些想通之处。
绪论中将会介绍一个引例及以后经常用到的三大部分probability theory, decision theory, and information theory 概率论、决策论及信息论。

2引例 Polynomial Curve Fitting

多项式拟合
本例的任务是用多项式拟合一个正弦图 sin(2πx) ,图中有是个已知点特征是X,目标向量时t,我们目标是用现在的点拟合的方程,在【0,1】内出现新的x时能较好的预测到新的t点。
这里写图片描述
这里写图片描述
如何确定多相式中的参数呢?一个常用的方法就是使用最小二乘法
这里写图片描述
上式是一个大月等于0的方程,只有拟合的函数全部命中时才会等于0.
当多次项次数M如果确定,其各系数可由最小化上式得到。
M如何确定呢?
M的确定是一个模型选择的问题,下图中比较了M=0,1,3,9的四种情况
这里写图片描述
可以看出在0-1范围内,m=0,1和9都不能很好的表示原图像.当M=9时虽然所有的点都与原本的10个点重合,但是与原图像相比相差太多,这种只能拟合现有已知点但是对于未知点不能很好的预测的现象就是过拟合(没有泛化能力)。

2.1泛化性能评价

如何定量的考虑和比较模型的泛化能力呢?
我们可以使用一个新的数据集,代入已经训练好的模型,看其误差函数的表现情况,在这里可以使用下面的误差函数,均方根(root-mean-square)来评价,其分母除以n可以得出平均的误差,因此可以比较在测试集数量不同的情况下的拟合情况。
这里写图片描述
这里写图片描述
上图是M等于1-9时的图像,可以看出在m=9时其预测集的误差太大(虽然在训练集上的误差很小,因为有10个参数所以这10个点可以全部拟合)。
下表给出了不同M值时的参数大小变化情况,太大的正负值变化是我们应该避免的问题,至于原因,在之前的ufldl的笔记中曾经提过,这样会时的震荡更剧烈。
这里写图片描述
其次M越大,将会更多的描述现有的数据集,这意味着其中的噪声部分也会被描述出来。

2.2减小过拟合

2.2.1增大数据集

如何避免过拟合呢?看下图
这里写图片描述
同样M=9时,不同的样本数量得到了不同的结果。
可以发现当n=100时的九次方多项式的拟合结果就比较好了。也就是说样本点越多,得到的模型越不容易过拟合,这也是因为他们的共性更加明显了。
所以一般来说我们要求的样本点数的量 一般要是模型中参数的几倍比如5倍或者10倍。也就是说样本的数量会决定参数的数量的上限。

2.2.2beyas

后面我们将会看到上面的最小二乘法是最大似然法的一个表现形式。其实在beyas角度建立模型时,模型有效参数的数量会根据训练集样本的数量来自动的调整。

2.2.3归则化 regularization

regularization就是在原来误差函数的基础上加上一个规则,也就是对前面提到的过大的参数进行惩罚。
原来的误差函数
这里写图片描述
加了惩罚之后的
这里写图片描述
其中这里写图片描述
其中的 w0 一般不被包含在惩罚项中,因为它的加入会使得到的表达式因为初始训练集目标变量的不同而不同,即使加入有点时候回给他单独弄一个惩罚项。
这种规则化在统计叫作shrinkage,还有一种特殊的规则化叫作ridge regression,在神经网络中叫作 weight decay.
下图是加入不同的惩罚因子 λ 的结果
这里写图片描述
这里写图片描述
下图是不同惩罚因子下得到的测试集结果
这里写图片描述
可以看出太大太小都不好。
从上面可以看出,如果使用最小二乘法求解模型,我们对于复杂度的掌控,现在用的是额外的验证集来测试模型的合理性,但是这有点浪费数据,因此我们将在以后探索更好的形式。
后面的章节中我们将会逐渐减少主观的判断作用,更多地使用概率的角度来解决问题。

内容概要:本文围绕“梯级水电+混合式抽水蓄能+源网荷储”多能协同系统开展深入研究,提出一种集成梯级水电站、混合式抽水蓄能电站及风、光等新能源的源网荷储一体化协同优化运行模型,并基于Matlab平台完成仿真代码实现。研究重点在于构建多时间尺度下考虑电力平衡、水量约束、机组运行特性及可再生能源波动性的联合调度机制,通过优化能量流分配提升系统灵活性、运行经济性可再生能源消纳能力。模型充分考虑梯级水电站间的水力耦合关系抽水蓄能的双向调节能力,实现对复杂多能源系统的协调控制综合性能提升。; 适合人群:具备电力系统分析、优化调度及可再生能源并网等相关基础知识,熟练掌握Matlab编程语言,从事水电能源系统、综合能源系统、储能配置调度优化等领域研究的科研人员工程技术人员,特别适合高校研究生及以上层次的研究者。; 使用场景及目标:①应用于梯级水电混合式抽水蓄能电站的联合调度策略设计;②支撑高比例新能源接入背景下电力系统调峰调频灵活性提升研究;③为源网荷储一体化系统的建模、仿真优化决策提供可复现的代码框架技术参考,助力科研成果转化实际工程应用。; 阅读建议:建议结合文中提供的Matlab代码进行逐模块调试仿真分析,重点关注目标函数构建、约束条件设置及求解算法实现细节,同时可拓展至不同流域梯级电站多种储能形式的集成场景,深化对多能协同机理的理解应用能力。
内容概要:本文系统研究了基于事件触发分布式策略的孤岛微电网二次频率电压恢复控制方法,旨在通过引入事件触发机制优化通信效率,降低传统周期性通信带来的高开销,同时保障控制性能。研究在Simulink仿真平台上构建了包含多台分布式电源的孤岛微电网模型,实现了频率电压的协同恢复控制,验证了所提策略在抑制频率电压偏差、提升系统稳定性方面的有效性。文章深入探讨了事件触发条件的设计原理、控制器参数整定方法及系统在外部扰动和DoS攻击等复杂环境下的鲁棒性,展现了该策略在提升微电网弹性控制通信优化方面的潜力。研究成果为分布式控制在智能电网中的应用提供了理论支持仿真验证范例。; 适合人群:具备电力系统、自动控制或新能源相关背景,从事微电网、分布式控制、智能电网等方向研究的研究生、科研人员及工程技术人员。; 使用场景及目标:①用于孤岛微电网中实现高效、低通信成本的频率电压协同控制;②为研究事件触发机制在分布式控制中的应用提供仿真案例技术参考;③支持对二次控制策略、弹性控制、通信优化等课题的深入探索算法验证。; 阅读建议:建议结合Simulink仿真模型同步学习,重点关注事件触发条件的设计、控制器参数整定及仿真结果分析,宜在掌握基本微电网控制理论基础上进行深入研读复现实验。
内容概要:本文围绕并网离网模式下的风光互补制氢合成氨系统,开展容量配置运行调度的联合优化分析,提出基于Python代码实现的双层优化模型。该模型充分考虑风能太阳能出力的不确定性,结合电解水制氢及合成氨工艺的能量转换特性,构建涵盖设备选型、容量规划多时段运行调度的协同优化框架,旨在实现系统在经济性、能源自给率运行可靠性之间的综合平衡。通过典型场景的仿真分析,验证了模型在不同运行模式下的有效性,深入探讨了系统在离网并网条件下的最优配置方案、调度策略差异及关键设备的运行特性,为可再生能源深度耦合化工生产过程的综合能源系统规划设计提供了重要的理论依据和技术支撑。; 适合人群:具备一定能源系统建模、优化算法及可再生能源技术基础,从事新能源、综合能源系统、氢能绿色化工等领域的科研人员及工程技术人员,特别适用于研究生及以上学历的研究者。; 使用场景及目标:①研究风光等可再生能源在离网或并网条件下驱动制氢、合成氨系统的最优容量配置运行调度策略;②掌握基于数学规划(如混合整数线性规划)的能源系统多目标优化建模方法,实现投资成本、运行成本碳排放的综合优化;③为实际电-氢-氨耦合示范项目的系统设计、经济性评估运行决策提供仿真工具量化分析支持。; 阅读建议:建议结合提供的Python代码进行实践操作,重点关注模型的目标函数构建、约束条件(如能量平衡、设备运行特性、电解槽动态响应等)的数学表达求解器调用流程,宜配合相关专业文献深入理解合成氨反应热力学、电解槽效率模型等关键技术细节,并尝试对不同边界条件(如电价、氢气价格、风光资源禀赋)进行敏感性分析,以深化对系统优化机理的理解。
内容概要:本文针对多个固定翼无人机在复杂环境下的协同飞行需求,提出了一种基于分布式模型预测控制(DMPC)的一致性控制方法。通过结合固定翼无人机的动力学特性多智能体系统的通信拓扑结构,构建了分布式的优化控制框架,实现了无人机群的状态一致性控制编队稳定性维持。研究详细阐述了DMPC算法的设计过程,包括局部代价函数的构造、系统约束的处理、邻居信息交互机制以及滚动优化求解策略,并利用Matlab平台进行了仿真验证,结果表明该方法在轨迹跟踪、编队保持和抗干扰能力方面具有良好的性能鲁棒性。; 适合人群:具备自动控制理论、无人机系统建模或优化算法基础,从事多智能体协同控制、航空航天工程、机器人编队控制等相关领域的研究人员研究生。; 使用场景及目标:① 实现多固定翼无人机在无中心节点条件下的高效协同编队飞行;② 解决复杂动态环境中无人机群的一致性控制实时调整问题;③ 为分布式控制策略在实际无人机集群系统中的工程化应用提供算法支持仿真验证手段; 阅读建议:建议结合提供的Matlab代码深入理解DMPC的求解流程通信拓扑设计,重点关注预测时域、权重参数设置及信息交换频率对控制性能的影响,可进一步拓展至非理想通信(如时延、丢包)场景下的算法鲁棒性研究。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值