闪迪昨天在投资者会议上扔了个重磅炸弹:HBF(高带宽闪存)2027年出样品,2028年量产。别急着鼓掌,先看看这饼画得有多大——首款产品已经流片了,4块GPU就能干出HBM系统8块GPU的活儿。就问你喜不喜欢吧?
往好听了说,这是AI算力焦虑的一剂猛药。HBM贵得离谱,容量还卡在瓶颈上,闪迪搞出来的HBF直接瞄准“内存墙”开炮:读取带宽对标HBM,容量做到8到16倍,成本还低。往坏了说,2028年量产?那时候AI市场早就变天了,闪迪这步棋走得是不是有点太稳了?
数据倒是挺诱人。跑大模型,4块GPU配HBF就能抵8块GPU配HBM的Token输出量。算下来GPU采购成本直接砍半,服务器电费也能省一大截。瑞穗证券倒是冷静得很,说HBF不可能完全取代HBM,但推理场景搞解耦式架构有戏。谷歌、Meta、SK海力士都在推这个方向,闪迪不是一个人在战斗。
技术底子上,HBF用的是接近NAND闪存的路线,不是DRAM堆叠那套。说白了就是拿闪存的成本优势,去够HBM的带宽门槛,代价是延迟偏高。第一版规格最高512GB,8层或16层堆叠,带宽分三个等级,从0.4TB/s到3.0TB/s。这参数看着像样,但真要到2028年才量产,隔壁HBM4估计都迭代两轮了。
闪迪这波操作,本质上是给AI基建打了个“性价比”的旗号。但问题来了:2028年的AI推理市场,还需要这种折中方案吗?还是说,HBF就是那个“够用就好”的答案?
一句话:饼画得再圆,也得等烤箱热了才敢说香。2028年见分晓。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。