韩企Bertha AI推理芯片完成4nm量产
「韩国芯片设计企业SEMIFIVE宣布,HyperAccel设计的数据中心AI推理加速器芯片Bertha已在三星4nm制程实现量产。该芯片面积达500平方毫米,拥有768 TFLOPS FP8算力,配备256MB片上SRAM和LPDDR5X内存,支持多种数据格式,宣称吞吐量、能效等指标远超英伟达H100。」
韩国人工智能芯片初创企业HyperAccel设计的数据中心推理加速器芯片“Bertha”已正式进入量产阶段。这一消息由韩国芯片设计服务企业SEMIFIVE于近日对外宣布,生产采用三星晶圆代工的4nm制程节点。这标志着该款面向人工智能推理场景的高性能芯片已从设计验证走向规模化交付。
根据SEMIFIVE提供的信息,“Bertha”的芯片面积达到500mm²,对应的是HyperAccel官网上公示的Bertha 500型号。该系列另有一款面向边缘端部署的Bertha 100,形成从云端数据中心到终端设备的覆盖产品线。Bertha 500在算力方面提供了768 TFLOPS的FP8性能,并支持FP16、FP8、FP4以及INT8、INT4等多种数据格式,能够灵活适配不同精度的推理工作负载。
在存储配置上,Bertha 500集成了256MB的片上SRAM缓存,用于减少对片外存储的访问延迟。其片外内存接口支持连接128GB或256GB的LPDDR5X内存,带宽达到546GB/s,推测可能采用512-bit位宽及8533MT/s速率配置。该芯片热设计功耗为250W,采用双槽PCIe AIC外形规格,可方便地集成到现有服务器机架中。
HyperAccel对Bertha 500的性能表现给出了积极宣称:该芯片在吞吐量、成本效益和能效方面分别可达到NVIAI H100的2倍、19倍和12倍。尽管这些数据尚未经过第三方独立验证,但如此突出的能效比和成本优势若能在实际部署中得到体现,将对数据中心推理市场产生重要影响。
人工智能推理需求正在快速增长,专用加速芯片的竞争也日趋激烈。HyperAccel通过与SEMIFIVE合作,借助三星4nm制程实现量产,展现了韩国本土AI芯片设计团队在先进工艺落地方面的能力。随着Bertha 500进入量产阶段,其市场表现和应用案例值得持续关注。
来源:Heooo AI工具导航