拜读完沃尔夫拉姆大神—当然,之前小子确实不知道大神名讳—的《这就是 ChatGPT》,对神经网络、ChatGPT 有了一个粗浅的认识,并且自认为是非常粗浅的认识。这点粗浅的认识也是对自己认知的一个洗礼,因为确实 AI 发展太快,特别是 ChatGPT 的横空出世。
神经网络介绍
文章以神经网络为始,对神经网络的定位是从一个最常规的思路,即根据人类擅长的横向切分方式,
如: 语音转换文本这个事情,可以切为:
1)分析语音中的音频,
2)分解每个音频为音素
但是后来发现这种方式并不能激活整个神经网络,而交给神经网络端到端的问题或任务,让神经网络自己“学习”到中间过程必要的特征、转码等。这种方式能够获取更佳的结果。这种方式造成一个结果是神经网络中间态是人类完全无法掌握或控制的状态,可以说神经网络对于人类来说是一个“黑箱子”,人类只知道它做了什么,但是不知道是怎么做的。这完全打破了先有科学,再有技术的界限,现在完全是有了这项技术,但是没有一个科学层面的解释,真的是已经走到了哲学层面了~。
还有一点是神经网络的特性,就是往往越复杂的问题神经网络越喜欢去解决,但是对于简单的问题它得到的结果往往并不是很理想,书中用了一定的篇幅去描述这个情况,但是对于非科班出身的我来说知道结论应该是我最大的能力了。
作者描述完神经网络,对神经网络有了一个粗浅的认识,之后抛出了训练的学问。现在的 AI 基本都是经历了:训练->人工处理->推理的逻辑,所以训练也是重中之重。其实神经网络是模拟人脑来逐步演进的,而人脑与计算机能力上又有所差异,文章中提出了两个概念:可学习性,计算不可约性;这两个概念是存在根本矛盾的,学习实际上是通过大脑去找到规律并进行学习内容的数据压缩,但是计算不可约意味着做这个事情就需要这么大的算力,而作为正常的人脑,对于简单的大数计算都会宕机,更何况是更复杂的不可约计算。
ChatGPT原理介绍
讲完神经网络的基本概念,作者引出了 ChatGPT 的内部原理,其底层使用的是 Transformer 框架。Transformer 不是仅仅定义了序列中可以连接的固定区域,而是引


1638

被折叠的 条评论
为什么被折叠?



