AI不是“矩阵”也非高级搜索引擎,而是超级计算机,三年后用与不用差距多大?

编者按

本文为投稿,作者为拾光文化创始人肖云。

对AI的认知偏差与本质

在肖云看来,很多人对AI的认知存在偏差,有人把它当成电影《黑客帝国》里无所不能、迟早统治人类的母体Matrix(矩阵),有人觉得它就是高级版搜索引擎,换个界面帮人去网上搜点东西而已,这两个说法都不准确。本质上,AI是一台“超级计算机”,由万张GPU、光模块和液冷系统堆砌而成,基于Transformer架构,通过概率预测运作,它并不理解世界,只是规模大到令人震撼。

分层认知AI

更重要的是要对AI进行分层认知:硬件是身体,大模型是操作系统,应用是决胜场,而水面之下的“组织变革”才是关键,否则,AI就是装了发动机还让马拉着跑。当标准化工作被AI接管,人才选拔要从“执行力”转向“思考力”,流程需重构,私有数据将成护城河。

使用AI的差距

能否理解它并用好它,三年后或许会产生差距。有人已经开始用AI做PPT、安排日程、分析数据、整理会议纪要,甚至用它做网站、写小程序等,大幅提升工作效率。但很多人其实并不清楚它到底是什么。

关键时间点与AI发展

先说几个关键时间点。2017年6月,Google发表论文提出Transformer架构,它是一个底层的算法框架,最大的特点是能“无限堆料”,即算力越多、数据越多,效果就越好。后来的所有大模型,包括今天常用的GPT、Claude、DeepSeek,都建立在它之上。

接下来三年,OpenAI验证了这件事。2018年,GPT - 1(1.17亿参数)证明了这条路走得通。2020年初,一篇Scaling Law论文给出了理论依据:模型参数、数据量、算力,三个变量在合理配比范围内,性能具备可预测提升。2020年6月,GPT - 3(1750亿参数)发布,它不用针对每个具体任务单独训练,同一个模型几乎什么都能干,质变由此发生。从那以后,AI就不再是“解决某个特定问题的工具”,而是一台“超级计算机”。

超级计算机的特点

这是一台花几十块钱就能用的超级计算机。简单来说,它的身体是几万甚至十几万张GPU堆出来的,它的血管是光模块和铜缆连起来的,驱动它运转的是巨大的电力,大型高密度智算中心满载运行时,耗电量堪比一座小型县城。这种级别的算力,以前只有国家实验室才有,而现在,花几十块钱一个月,就能用GPT、Claude、DeepSeek写文章、做分析、出方案,人人都有了使用这台超级计算机的钥匙。

但现阶段的AI并不理解这个世界,它只是在预测这个世界。比如输入“曹操率领大军”,它猜下一个字是“南下”,并非因为它懂三国,而是因为在它的训练数据里,这六个字后面跟“南下”的概率最高,它不知道曹操是谁,更不知道什么叫战争,只是在做概率预测,只不过这台概率预测机的规模大到令人震撼。真正让AI理解世界的模型,叫世界模型,那是下一个十年的事。所以,既不要神化它,也不要轻视它。

超级计算机的结构

这台超级计算机长什么样呢?拆开来看,有三层。

第一层:硬件——超级计算机的身体

把这些硬件塞在一起的地方,叫数据中心,也叫智算中心,可以理解为一栋“专用机房”,现在全球都在疯狂扩建这种机房。它需要五样东西:一是AI芯片。以前靠CPU,AI时代靠专门的计算芯片,英伟达通用GPU占据全球AI算力主要市场,AMD持续追赶;国内华为昇腾AI处理器快速迭代。二是存储。分两种,一种是HBM——高带宽内存,直接焊在AI芯片旁边,保证数据喂得够快,芯片算得再猛,HBM跟不上就白搭,海力士目前是英伟达HBM3E的主力供应商,美光已实现批量供货,三星仍在追赶放量;另一种是普通的数据中心存储,存训练数据和模型,体量巨大。三是网络互联。万张GPU不是各算各的,它们每时每刻都在交换数据,远距离靠光模块传,中际旭创、新易盛都是这条线的核心玩家,近距离用铜缆,量大管饱,交换机芯片负责调度。四是电力供应。算力机房是名副其实的“电老虎”,高密度集群对电网承载力提出极高要求,核电、电网、变压器,全在跟着涨。五是散热冷却。GPU跑起来热量惊人,过去风冷就够了,现在液冷是标配,英维克、高澜这类公司跟着数据中心一起爆发。

第二层:大模型——超级计算机的“智能操作系统”

硬件装好了,得装系统。基座模型(GPT、Claude、DeepSeek、智谱等)可以类比为这台超级计算机的“智能操作系统”,通过预训练吃下全网文本、代码、论文,把通用知识全学进去。

但光有基座还不够,得让它能听指令、不乱说、控制语气。这靠后训练,先让标注员写示范回答给模型模仿(监督微调),再让标注员给模型的多个回答评判优劣(奖励建模),最后让模型自主生成回答、依托奖励反馈持续优化(强化学习)。

然后是商品化,Token计费是标志性的节点,按用量收费,不需要买整台机器。更关键的是,随着芯片升级、算法改进、工程优化,推理成本持续快速下行。

再往上,智能体出现了,它让模型不只是“回答问题”,而是能“干活”,即调用工具、执行任务、跨系统协调。这一层的护城河不是通用数据(公开数据大家都拿得到),而是工程能力(万卡集群不出错)、用户飞轮(用的人越多、反馈越多、产品越好)、生态(插件、API、云服务整合)。

第三层:应用——谁能用好这台超级计算机

这是真正分胜负的一层,有两条路径:路径一:创收。用AI创造新的收入模式,比如AI漫剧、AI短视频、AI生成式广告,过去需要一整个团队做的事,现在一个人加一台超级计算机就能搞定,新的公司有了新的打法。路径二:提效。改善成本结构,思考产品研发、市场营销、客户服务、产品交付等环节有多少能让AI接手。当下,提效的市场比创收大得多,手里有业务、有客户、有团队的公司,接入AI能立刻见到红利,创收值得探索,但提效是现在就能抓住的。

组织变革与私有数据

两条路径都绕不开组织变革。用水面上和水面下来比喻,水面之上是创收和提效,水面之下是组织变革,水面上能看到的只是结果,但结果能不能出来,取决于水面以下。有两个核心要点:第一,人才选拔。过去看重执行力,安排10件事做完10件,现在要找到“大于1的人”,即能用AI把1件事做出10件事效果的人,思考力要大于执行力。第二,流程重构。拿出工作流,对比现在怎么干和接入AI后怎么干,让AI处理标准化、重复性工作,人处理高价值、创造性工作。Shopify CEO已经把“使用AI的能力”纳入绩效评估,申请加人之前,先证明AI搞不定。

还有一个容易被忽视但最关键的是私有数据。通用数据谁都能用,但公司的业务数据、客户行为数据、Know - how集合等私有数据别人拿不到。比如一个打车软件,它的路线数据、用户习惯、高峰时段模型等数据喂给AI,产生的优化是后来者很难赶上的,这才是真正的护城河。

总结与问题

总结来说,AI既不是电影里无所不能的母体程序,也不是升级版的搜索引擎,它是一台超级计算机,以前国家实验室才有,现在人人都有钥匙。问题来了,能用起来的人和不会用的人,三年后的差距会有多大?

内容概要:本文档为陈南男的个人简历,详细介绍了其教育背景、实习经历、项目经验及专业技能。她目前为中国科学院学计算机应用技术专业硕士在读,曾就读于哈尔滨工程学计算机科学技术专业,综合成绩位列前5%。实习期间,她在百度担任AI应用开发工程师,参构建基于文心一言API的智能教育平台,实现个性化学习路径生成;在九坤投资参开发云资源管理平台,完成前后端系统设计云资源集成;目前在阿里巴巴从事AI Agent研发,聚焦跨境电商SKU级资产治理,设计并优化Badcase诊断Agent,显著提升诊断效率准确率。此外,她还主导开发了电商视频生成平台“山竹旺影”,通过Agent工作流降低用户使用门槛。其技术能力涵盖模型应用、Prompt Engineering、AI Agent设计、全栈开发等。; 适合人群:计算机相关专业在校生、应届毕业生及从事AI开发、全栈开发的技术人员。; 使用场景及目标:①了解AI Agent在实际业务中的落地应用,如教育、电商、云运维等场景;②学习如何结合模型工程架构实现复杂系统的设计优化;③参考高水平技术人才的成长路径项目实践经验。; 阅读建议:此简历内容详实、项目含金量高,建议开发者重点关注其AI Agent设计思路、技术实现细节以及跨系统集成能力,借鉴其在复杂业务链路中解决问题的方法论。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值