韩国AI芯片初创企业FuriosaAI于2026年9月21日公布了其第三代AI推理加速器的完整技术规格。这款与博通(Broadcom)合作开发的芯片,采用2颗2nm计算裸晶与1颗独立I/O裸晶的架构设计,搭配12个48GB HBM4(E)内存堆栈,支持PCIe Gen7接口,并采用博通SUE拓扑实现机架内全连接。根据官方披露的数据,该芯片物理尺寸约为上一代产品RNGD的8倍,算力达到32 PFLOPS,内存带宽达48TB/s,两项指标均为RNGD的32倍。
从规格参数来看,第三代加速器的性能提升并非简单的晶体管堆叠。2颗"光罩极限级"2nm计算裸晶意味着FuriosaAI在制程节点上直接跨越了两代——其第二代产品RNGD尚采用台积电5nm工艺。独立I/O裸晶的加入,则表明芯片在设计层面将计算单元与数据吞吐单元解耦,以应对大模型推理场景下日益严峻的内存带宽瓶颈。
内存配置方面,576GB的HBM4(E)容量是RNGD的12倍,而48TB/s的带宽数据则达到了32倍提升。可以推断,这种容量与带宽的非对称性增长,反映出设计团队对Token密度——即单位时间内可处理的Token数量——的极致追求,而非仅仅着眼于单次推理的算力峰值。
值得关注的是,这颗芯片并非以传统PCIe板卡形态独立存在。据财联社2026年5月28日报道,FuriosaAI与博通官宣合作时便明确了机架级系统出货的目标。此次公布的SUE全连接拓扑,正是博通为大规模AI集群提供的互联方案,旨在解决多卡协同时的通信瓶颈。按照计划,该芯片将于2028年上半年出样。
此前,FuriosaAI的第二代产品RNGD(台积电5nm工艺、180W功耗、BF16算力256 TFLOPS、HBM3带宽1.5TB/s、PCIe Gen5)已被三星SDS、LG AI Research部署于风冷数据中心。第三代产品在性能倍数上的夸张跃升,显然指向了更高密度的液冷数据中心场景。
FuriosaAI的背景故事为这次技术发布增添了更多看点。2025年3月,该公司曾拒绝Meta约8亿美元的收购要约,选择独立发展。这家由出身三星、AMD的白准铉(June Paik) 创立、员工约150人的公司,目前客户已覆盖LG AI Research、沙特阿美等机构。
从行业角度来看,FuriosaAI将第三代产品定位为「Token工厂时代」的机架级推理基础设施,主打每瓦性能与Token密度,意图在英伟达主导的AI加速市场中开辟差异化赛道。目前所有规格均系公司官方披露口径,实际量产交付后的真实性能与生态适配情况,仍待时间验证。