SanDisk与SK海力士推HBF缓解大模型内存焦虑,或降低AI推理成本!

新思路:U盘技术缓解大模型内存焦虑

IEEE最新刊发新思路,大模型的内存焦虑或能用U盘同款技术NAND Flash缓解。不少人印象里,Flash虽便宜、容量大、断电不丢数据,但速度慢,用它驱动大模型推理看似并非正经方案。

推动HBF技术突围

如今,SanDisk和SK海力士正推动High Bandwidth Flash(高带宽闪存,简称HBF)。其思路是将HBM(高带宽内存)的先进封装和芯片堆叠方法用于NAND Flash,让闪存参与AI推理的高速数据供给。据SanDisk公开资料,HBF预计最多可堆叠16颗NAND Flash芯片,目标单个堆栈容量最高达512GB,目标读取带宽最高达1.6TB/s,后续第二代、第三代读取带宽还会提升到2TB/s和3.2TB/s,虽追不上顶级HBM,但已非传统闪存的“慢吞吞存储”状态。

技术突围背后的困局

这一技术突围背后,或是全球存储行业亟待化解的供应紧缺困局。北京时间7月11号,韩国存储巨头SK海力士的首席执行官郭鲁正曾在美股纳斯达克首秀之日公开表示,全球存储行业预计将在2027年面临史上最严重的供应短缺,该言论迅速引爆资本市场与产业舆论。在此背景下,SK海力士携手SanDisk推出HBF,或许是他们为缓解存储供应紧张交出的技术答卷。

Flash写入慢却能用在AI?

很多人疑惑,Flash写入慢,怎么突然能用于AI?半导体市场研究机构Objective Analysis总监Jim Handy在IEEE Spectrum采访中提到,很多人第一反应也觉得说不通。关键在于,Flash慢主要慢在写入。NAND Flash通过浮栅晶体管里的电荷存储数据,并按块和页组织,这种机制使其断电后能保留数据,无需像DRAM那样不断刷新,天然适合长期存储,兼具高密度与低成本优势,但写入时把电荷推进或移出绝缘栅的过程比给电容充放电慢得多,所以在传统计算视角下,Flash难和DRAM、HBM这类高速内存相提并论。

读取情况不同,HBF提高总读取带宽

不过只看读取,情况就不同了。按最新ONFI 6.0闪存接口标准,单颗die理论带宽最高可达4.8GB/s,和DDR5单条DIMM最高70.4GB/s、HBM4E单堆栈3.6TB/s相比,有大约750倍量级差距。HBF通过3D封装和垂直堆叠,把多个NAND Flash die打包,显著提高总读取带宽。SK海力士内存系统研究高级副总裁Hoshik Kim指出:“通过将先进的3D封装和垂直堆叠技术应用于NAND闪存,HBF能够实现远超标准NVMe存储的带宽。”HBF通过堆叠NAND闪存裸片,打造高存储密度芯片,并非让单颗Flash变快,而是通过堆叠和封装堆出读取通道。

HBF找准适合场景——AI推理

HBF真正有意思的地方,不在于取代HBM,而在于找准了适合Flash的场景——AI推理。训练和推理对内存要求不同,训练大模型时,系统要大量读写,Flash写入慢,还涉及寿命和擦写管理问题,对其不友好;但推理阶段,模型已完成训练,权重基本冻结,系统主要是快速读出庞大的模型权重,这正是Flash相对擅长的。SK海力士内存系统研究高级副总裁Kim表示:“在推理环境中,诸如静态的数十亿参数模型权重或预计算的KV缓存(precomputed KV cache)等海量、读密集型数据,均可稳妥地存放于HBF层级。”这样一来,昂贵且容量有限的HBM就能被释放出来,专门充当高速暂存区,这个架构像给AI加了一层“超大容量只读内存池”,HBM负责紧急、频繁的高速计算数据交换,HBF负责装下体量巨大、改动少的模型参数。

解决大模型推理困境,HBF或降低成本

当前大模型推理面临算力短缺、内存不够、带宽不够、能耗太高、部署成本太贵等多重压力,尤其是模型规模持续膨胀,单卡显存容量不足与HBM成本高昂制约其发展,很多时候不是GPU算不动,而是模型装不下或数据喂不过来。而HBF若能在容量、带宽和成本之间找到平衡,就可能让更大的模型以更低的成本跑起来。

第一代HBF参数及潜在收益

SanDisk给出的第一代HBF目标参数为最高512GB容量、1.6TB/s读取带宽。HBM速度快但容量昂贵有限,HBF速度低一些,但能提供更大容量和更低单位成本。这意味着未来AI服务器部署大模型推理时,不一定要把所有权重都塞进HBM,一部分冷一点、静态一点、读多写少的数据可放在HBF里。这样做有几个潜在收益:一是缓解HBM容量瓶颈;二是减少为装下模型而堆更多加速卡的需求;三是降低推理系统整体成本和能耗。Kim判断HBF与HBM不是竞争对手,而是互为补充的工具,HBF能在不牺牲数据供给速度的前提下,缓解HBM容量瓶颈,有望减少运行大规模模型所需的加速器数量,还将提升能效、降低成本,助力数据中心扩展AI推理硬件规模。这也是HBF最值得关注的产业逻辑:让AI系统里的不同数据待在更适合自己的位置,热数据放HBM,大容量、静态、读密集数据放HBF,更低速、更便宜的数据放SSD或其他存储,若这套分层成立,AI推理硬件的内存架构可能会多出一个新层级。

HBF尚不成熟,但发出分工新信号

当然,HBF目前还不是成熟产品。据IEEE Spectrum报道,HBF至少还需一年才可能出货,距离大规模部署可能还要几年。今年2月25日,SanDisk和SK海力士联合举办启动活动,宣布在开放计算项目OCP下推动HBF标准化工作。OCP作为数据中心硬件领域重要的开放产业组织,主导制定了大量服务器、机柜、电源及加速器相关规范。但目前,HBF标准还在推进中,正式发布时间尚未确定,这意味着HBF短期内不会马上改变AI服务器市场,它更像是提前浮出水面的信号:AI推理正在逼着存储和内存体系重新分工。过去,大模型硬件关注点集中在GPU、HBM和互联,当模型变大、推理请求增多,瓶颈就会从“算得快不快”扩展到“装不装得下”“读不读得动”以及“电费扛不扛得住”,HBF切入的正是这个缝隙。

SK海力士的商业考量

有意思的是,SK海力士本身是HBM最大赢家之一,HBM为其带来创纪录收入,推出更便宜的替代性技术HBF似乎不符合商业直觉。但从系统角度看,HBF不一定会抢HBM的饭碗,AI服务器未来需要分层内存,让HBM负责极致性能,HBF负责大容量高带宽读取,SSD负责更低成本的大规模存储,这套组合跑通会让AI推理系统更可扩展。简单说,不是每一份模型数据都值得用HBM,有些数据只需要容量够大、读取够快、成本更低的位置,HBF想做的就是这个位置。从U盘、SD卡里的NAND Flash到AI服务器里的高带宽模型权重池,跨度虽大,但大模型问题明显:参数增多、推理变贵、HBM紧张,而解决方案未必只来自更贵的内存,也可能来自把熟悉的老技术重新封装。

下载代码方式:https://pan.quark.cn/s/28492da20c79 依据所提供的文件资料,本资源将系统地探讨FPGA(即现场可编程门阵列)的核心概念、其在视频图像技术领域的入门及进阶知识要点,以及图像处理算法的实现方法。此外,还将对VIPBoardBig这一特定FPGA开发板的详细资料和使用途径进行深入剖析。 FPGA的入门进阶学习主要涉及以下核心内容: 1. FPGA的基础概念:FPGA是一种能够通过编程进行配置的集成电路,主要目的是达成硬件逻辑的可重构特性。该类芯片由大量的可配置逻辑模块(CLB)、输入输出模块(IOB)以及可编程互连资源共同构成。 2. FPGA开发板相关套件:FPGA开发板是一种用于FPGA芯片学习和测试的硬件平台,通常配备有基础的外设设备,例如LED指示灯、按键开关、LCD显示屏、串口通信接口等。套件则通常包含硬件板卡、技术文档、相关资源,以及可能的软件工具和示例代码集。VIPBoardBig即为本教程选用的FPGA开发板,拥有特定的硬件配置和功能特性。 3. FPGA的开发流程:FPGA开发一般涉及硬件描述语言(HDL)的设计仿真阶段,常用语言为VerilogVHDL。随后,借助综合工具将设计蓝图转化为FPGA内部的逻辑网络,最终通过编程设备将配置文件传输至FPGA芯片中,从而实现设计的预期功能。 4. 外设开发设计工作:涵盖LED显示控制、键盘驱动、LCD显示驱动、UART串口设计等基础外设的开发任务。这部分知识将引导学习者掌握如何在FPGA平台上管理和运用这些基础外设。 5. VGA驱动显示字符显示测试:VGA(Video Graphics Array)是一种视频传输接口标准,能够支持640x480...
内容概要:本文系统阐述了企业在搭建官方知识库后如何通过“7步锚定法”实现GEO(生成式引擎优化)的落地,重点在于从知识库走向内容矩阵的战略升级。文章指出知识库仅为起点,真正的核心是让大模型“信任并荐”企业内容。为此提出“一个主战场+多个品牌布局”的策略,强调需根据行业特性选择高商业流量的大模型(如豆包、文心一言、通义千问等),而非工具性模型(如ChatGPT、Claude)。通过业务场景画像、大模型流量测绘、采信逻辑拆解、内容架构设计、语义关键词埋点、信源建设效果迭代七步法,构建高质量、高可信度的内容体系,并警惕“全模型覆盖、内容堆砌、一套内容通用、忽视第三方平台”四大误区。最终指出GEO本质是一场认知战,比拼的是对大模型逻辑客户需求的理解深度及长期主义投入。; 适合人群:已完成官方知识库搭建、希望提升AI引用率获客效率的企业市场负责人、品牌运营、数字营销从业者及SEO/GEO优化相关人员。; 使用场景及目标:①指导企业科学选择主攻大模型并制定差异化内容策略;②构建符合大模型采信逻辑的高质量内容矩阵;③避免常见GEO落地误区,提升AI搜索下的品牌曝光转化效果;④建立可持续优化的数据反馈闭环。; 阅读建议:建议结合自身行业特征客户决策路径,逐步实践“7步法”,优先聚焦单一主战场打透,注重内容质量第三方权威信源建设,坚持3-6个月持续投入以观察真实效果。
内容概要:本文针对考虑需求响应的微电网优化调度问题,提出了一种基于改进多目标灰狼算法(GWO)的优化方法,并通过Matlab代码实现了完整的仿真验证。研究在传统灰狼算法基础上引入改进机制,有效提升了算法的收敛速度、全局搜索能力和Pareto前沿分布质量,用于求解包含经济运行成本、碳排放水平、可再生能源利用率等多重目标的微电网调度模型。模型充分融合用户侧需求响应机制,利用分时电价等激励手段引导负荷转移削峰填谷,从而增强系统对光伏、风电等间歇性能源的消纳能力,降低综合运行成本环境影响。文中系统阐述了多目标优化建模过程、算法改进策略、约束处理方法及仿真结果对比分析,验证了该方法在获取高质量非劣解集和辅助决策方面的优越性。; 适合人群:适用于电力系统、能源互联网、自动化控制、智能优化算法等相关领域的硕士/博士研究生、科研人员,以及从事微电网能量管理、综合能源系统优化、低碳调度等工作的工程技术人员。; 使用场景及目标:①应用于微电网能量管理系统(EMS)中实现多目标协同优化调度;②为基于电价激励的需求响应项目提供负荷调控策略量化分析工具;③作为智能计算算法在能源系统优化中应用的教学案例科研参考,支持进一步拓展至多能互补、多微网互联等复杂场景的研究。; 阅读建议:建议读者结合提供的Matlab代码深入理解算法实现细节,重点关注目标函数构造、约束条件处理、多目标适应度评估及决策者偏好选择机制;可尝试将该框架迁移至含氢能储能、电动汽车集群等新型设备的综合能源系统中进行性能测试算法改进。
内容概要:本文深入分析了洞察时空在2026年世界人工智能大会上提出的“数算一体AI星座”项目,该星座由576颗低轨及超低轨卫星构成,旨在实现“一天一次全球扫描”的高频对地观测能力,为AI Agent提供标准化的“地球真值”数据,弥补大模型在物理世界认知中的预测偏差。项目创新性地提出“数算一体”范式,通过天地一体算力协同、星上边缘计算多模态数据融合,构建以“地球状态变量”为核心的智能认知系统,动天基基础设施从数据采集向智能服务跃迁。报告系统梳理了当前研究现状,指出现有遥感系统在时效性、一致性AI适配性上的不足,提出涵盖星座组网、星上AI推理、数据标准化等关键技术路径,并剖析了星上算力限制、数据一致性保障、物理可解释性等核心挑战,给出了芯片研发、开放标准、跨学科协作等未来发展方向。洞察时空作为主导企业,具备航天AI复合背景,已获政策资本支持,计划2030年完成全星座部署。; 适合人群:从事商业航天、人工智能、遥感技术、地球系统科学及相关交叉领域的科研人员、技术研发人员、政策制定者产业投资者。; 使用场景及目标:①理解AI天基系统融合的前沿趋势技术架构;②探索“数算一体”在星地协同计算、多模态数据产品标准化中的实现路径;③评估高频地球观测数据对AI Agent、气候建模、灾害预警等应用的支撑潜力; 阅读建议:本报告兼具战略高度技术深度,建议结合商业航天发展动态AI在科学发现中的应用案例进行延伸阅读,重点关注天地算力调度机制“地球状态变量”的定义演化,以把握下一代天基智能基础设施的发展方向。
内容概要:本文围绕综合能源系统模型预测控制(MPC)滚动优化展开深入研究,重点利用Matlab代码实现对包含光伏、储能、风电等多种能源形式的综合能源系统进行建模多时间尺度优化调度。通过MPC滚动优化方法,结合系统的动态数学模型对未来负荷、可再生能源出力的预测信息,实现对能源生产、存储、转换消费的协同优化控制,旨在提升系统运行的经济性、能源利用效率、低碳水平及供电可靠性。研究详细阐述了MPC的核心原理、预测模型构建、目标函数设计(如运行成本最小化)、系统约束(如功率平衡、设备容量、储能荷电状态)处理以及优化求解过程,并提供了完整的Matlab仿真代码框架,便于读者复现和二次开发。; 适合人群:具备一定电力系统、自动化、能源系统工程控制理论基础,熟悉Matlab编程环境,从事相关领域科研、工程应用的研发人员、高校研究生及高年级本科生。; 使用场景及目标:①掌握模型预测控制(MPC)在综合能源系统、微电网、智慧园区等场景中的优化调度应用方法;②学习如何构建多能互补系统的精细化数学模型并实现滚动优化求解;③为能源互联网、新型电力系统背景下的能量管理决策提供技术参考、算法支持代码实例。; 阅读建议:建议读者结合文中提供的Matlab代码进行动手实践,重点关注MPC控制器的设计逻辑、预测模型优化器的耦合机制,以及约束条件的代码实现方式。同时,鼓励在现有模型基础上,拓展至不同的能源设备配置、负荷场景优化目标(如碳排放最小化),以深化对MPC在能源领域应用的理解。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值