
AI已像初级工程师,但这不是最重要的变化
2025年5月,Jeff Dean曾判断AI的能力已接近初级工程师。一年后,他认为这个判断相当准确,且模型在相关任务上的进步比预想更快,能力不再局限于写代码,更多Agent系统进入专业领域。把AI类比初级工程师,Jeff Dean更关心组织生产方式的变化,未来更多工程师负责定义问题等,调度Agent完成任务。他预测2027年机器学习系统会更多参与改进自身,AI自动化会先攻入反馈最清晰的领域,AI时代重要的是完整闭环。
改变Google搜索的是一道算术题
2001年,Jeff Dean和Sanjay Ghemawat估算后,将Google搜索索引放入内存,使搜索变快。Jeff Dean认为系统条件变了应重新计算,很多行业创新在这种时刻发生,他建议创业者从第一性原理重新看问题。
三分钟语音,为什么催生了一颗TPU
2013年,Google深度学习语音识别显著提升,Jeff Dean计算后发现按当时CPU效率需扩大服务器规模,这成为TPU的起点。TPU为机器学习核心计算模式做专用硬件,第一代带来数量级收益,且保留支持未来算法演进的空间。Jeff Dean认为下一轮推理硬件机会在专用化,转向低延迟、低能耗推理。
AI的成本中心,不是计算,而是搬运数据
Jeff Dean认为2026年AI工程师应关注芯片内部数据流,数据搬运能量成本比计算高约1000倍,批处理重要但与低延迟冲突。推理对延迟敏感,AI的“能源问题”影响重大。
模型只是一个零件,上下文才是Agent的工作现场
2026年,Jeff Dean更强调模型周围一切,“上下文工程”变得重要。它给小团队机会,创业者可围绕业务组织信息,让通用模型在窄场景表现更好。Jeff Dean举例说明上下文工程是把人做事方法交给模型,“技能”会成Agent生态关键资产。
Agent为什么走到第30步就开始失控
Agent执行任务时会在30步或50步左右出现问题,Jeff Dean归结为分布外问题。解决方法有提供技能和提示、使用多Agent系统。可靠的长程Agent需像分布式系统,未来优秀的Agent平台可能继承分布式系统思想。
两三个人如何赢过Google:寻找模型成功率只有1%的问题
小团队机会在通用模型未充分关注的领域,创业者可组合资源在窄场景提供更好体验。但通用模型变强,创业者需判断优势耐久性,Jeff Dean提出“1%法则”,即寻找通用模型成功率接近0%或1%的任务,盲区包括专有数据、专业评价、窄而深的模型。
当代码不再稀缺,规格、品味和问题选择会更贵
Diana假设未来创始人管理多个Agent,代码由Agent写,Jeff Dean认为“品味”和“规格”会更重要。“品味”指判断让Agent做什么,可通过复盘训练;“规格”指目标要清晰,未来管理者要编写清晰目标和验收标准。
好的思想实验,先把行业最牢固的前提拿掉
Jeff Dean分享思想实验,假设晶体管易出错,探讨系统可靠性。MapReduce就来自类似过程,未来Agent工程可能也需要类似抽象。
AI开始构建更好的AI,科学方法被压缩成高速循环
Jeff Dean对把科学方法自动化兴奋,AI可自动提出和执行更多实验、把昂贵验证器变成廉价近似模型。如量子化学中,近似器比原模拟器快约30万倍,实验变成高频搜索。机器学习也会成为自动化科学对象,未来研究效率指标可能是“每单位算力产生多少有效发现”。
被NeurIPS拒绝的蒸馏论文,以及如何看待失败
2014年,Jeff Dean等人关于知识蒸馏的论文被NeurIPS拒绝,但团队放上arXiv后行业仍使用。如今,蒸馏是Gemini Flash模型的重要方法。这说明评价体系有盲区,创业者要理解问题、持续验证,不把一次评审当最终判断。
年轻的Jeff Dean今天会做什么
访谈尾声,Diana问若把1999年的Jeff Dean传送到2026年,他会如何选择。Jeff Dean未给标准答案,判断标准是解决问题能否让世界明显变好,同时强调同伴的重要性。
结语:AI时代最稀缺的,仍然是把问题看清楚
Jeff Dean职业生涯有诸多传奇,方法是算清数量级、找瓶颈、质疑假设、建立抽象、用测量和反馈迭代。如今AI行业转折,决定生产力的不只是模型智商。创业公司机会在成功率接近0%或1%的问题,真正昂贵的是问题本身。Jeff Dean提供了思考方式,提醒别急着追逐热点,先算清问题。


被折叠的 条评论
为什么被折叠?



