据韩媒 ZDNET Korea 报道,韩国 AI 半导体初创企业 FuriosaAI 于 9 月 21 日公布了其第三代 AI 推理加速器的技术细节。该产品由 FuriosaAI 与博通(Broadcom)合作开发,面向大规模 AI 推理场景。
根据披露的规格,这款加速器采用双计算裸晶加独立 I/O 裸晶的架构,包含 2 颗“光罩极限级”2nm 计算裸晶和 1 颗独立 I/O 裸晶,并配备 12 个 48GB HBM4 (E) 内存堆栈。互连方面,机架内采用 SUE 全连接拓扑,同时支持 PCIe Gen7 接口。
性能参数上,该芯片算力可达 32 PFLOPS,为 FuriosaAI 第二代芯片 RGND 的 32 倍;HBM 内存容量达 576GB,是 RGND 的 12 倍;HBM 内存带宽达 48TB/s,同样为 RGND 的 32 倍。FuriosaAI 表示,新芯片的物理尺寸约为 RGND 的 8 倍。
FuriosaAI 是韩国具有代表性的 AI 芯片设计公司,此前推出的推理芯片主要面向数据中心推理负载。此次与博通合作开发第三代产品,意味着其在先进制程和先进封装上的投入进一步加大。2nm 计算裸晶、HBM4 内存以及 PCIe Gen7 等规格均指向当前 AI 加速器领域的前沿配置。
从行业角度看,AI 推理需求正随着大模型部署规模扩大而快速增长,推理加速器的竞争焦点集中在算力密度、内存容量与带宽的平衡上。FuriosaAI 第三代产品在内存带宽上与算力保持同比例提升,反映出推理场景对高带宽内存的强依赖。该芯片的具体量产时间与客户信息尚未公布。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。