FuriosaAI 公布第三代 AI 推理加速器规格:32 PFLOPS 算力,576GB HBM4 内

该芯片的物理尺寸大约是第二代芯片 (RGND) 的 8 倍;算力可达 32 PFLOPS,是 RGND 的 32 倍;HBM 内存容量达 576GB,是 RGND 的 12 倍;HBM 内存带宽达 48TB/s,是 RGND 的 32 倍。

据韩媒 ZDNET Korea 报道,韩国 AI 半导体初创企业 FuriosaAI 于 9 月 21 日公布了其第三代 AI 推理加速器的技术细节。该产品由 FuriosaAI 与博通(Broadcom)合作开发,面向大规模 AI 推理场景。

根据披露的规格,这款加速器采用双计算裸晶加独立 I/O 裸晶的架构,包含 2 颗“光罩极限级”2nm 计算裸晶和 1 颗独立 I/O 裸晶,并配备 12 个 48GB HBM4 (E) 内存堆栈。互连方面,机架内采用 SUE 全连接拓扑,同时支持 PCIe Gen7 接口。

性能参数上,该芯片算力可达 32 PFLOPS,为 FuriosaAI 第二代芯片 RGND 的 32 倍;HBM 内存容量达 576GB,是 RGND 的 12 倍;HBM 内存带宽达 48TB/s,同样为 RGND 的 32 倍。FuriosaAI 表示,新芯片的物理尺寸约为 RGND 的 8 倍。

FuriosaAI 是韩国具有代表性的 AI 芯片设计公司,此前推出的推理芯片主要面向数据中心推理负载。此次与博通合作开发第三代产品,意味着其在先进制程和先进封装上的投入进一步加大。2nm 计算裸晶、HBM4 内存以及 PCIe Gen7 等规格均指向当前 AI 加速器领域的前沿配置。

从行业角度看,AI 推理需求正随着大模型部署规模扩大而快速增长,推理加速器的竞争焦点集中在算力密度、内存容量与带宽的平衡上。FuriosaAI 第三代产品在内存带宽上与算力保持同比例提升,反映出推理场景对高带宽内存的强依赖。该芯片的具体量产时间与客户信息尚未公布。

该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。

(0)
浪潮信息发布元脑SD200 Ultra超节点,单机承载2.8万亿参数Kimi K3,Token时延降至5.85毫秒
上一篇 3小时前
加拿大不列颠哥伦比亚省就校园枪击案起诉 OpenAI,指控其未及时向警方报告风险信息
下一篇 59分钟前

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部