韩国AI芯片厂商推理芯片产能拟翻倍,第三代用2nm
来源:李智衍发布时间:2026-07-142658浏览
询问 AI据韩国媒体ETnews援引业内消息7月13日报道,韩国人工智能芯片公司Furiosa AI打算提升其第二代大语言模型推理芯片Renegade(RNGD)的生产规模。该企业将2027年的产量目标定为4万到5万片,相较于2026年2万片的计划产能,增长幅度超出一倍。公司方面指出,基于全球人工智能推理计算能力需求迅速增加的市场预期,故而确定了此次产能扩充方案。此外,该公司还透露其第三代芯片Stork将使用2纳米工艺制造,并有望实现行业内领先的推理性能。
作为Furiosa AI针对云数据中心研发的大模型推理专用神经网络处理器(NPU),Renegade芯片基于台积电5纳米制程制造。该芯片运用自主研发的张量收缩处理器架构,配备两组HBM3内存,能够实现1.5TB/s的内存带宽,热设计功耗保持在180W,适合风冷机房环境部署,主要应用于大语言模型及多模态模型的高并发推理工作。此外,该芯片具备多实例虚拟化功能,单颗芯片可划分为多个独立的计算单元,以满足云服务商的多租户业务需求。目前,该产品已在国内外多家政企云及本地私有化智能计算项目中开展验证和小规模商业应用。
在产品升级规划方面,公开资料显示第三代芯片Stork项目正与博通公司合作推进。该芯片主要针对下一代高吞吐量推理场景,计划配备新一代高带宽内存以及先进的芯粒互连技术,预计在2028年左右推出样品。从行业发展态势来看,高端推理芯片正不断向先进制程、更大带宽内存和芯粒化集成方向发展。不过,由于先进制程的研发投入巨大,企业需要借助第二代产品的大规模出货来回收资金,从而为下一代芯片的持续研发提供支持。
在全球计算能力市场中,随着人工智能应用生态的不断拓展,智能体、对话大模型和多模态服务推动了推理计算需求的持续上升。与训练市场相比,推理市场的客户更关注单位功耗下的令牌(token)产出以及数据中心的总拥有成本,这促使专用推理加速器的需求大幅增加。尽管当前数据中心推理市场仍主要由通用图形处理器(GPU)占据主导,但近年来多家亚太地区的初创芯片公司推出了注重能效的专用推理芯片,通过差异化路线加剧了供给端的竞争。在区域发展上,韩国正积极建设本土人工智能计算供应链,依托其存储产业优势扶持芯片设计企业。Furiosa AI等本土企业正加快推理芯片的商业化进程,在深耕韩国本土政企和云服务商市场的同时,积极拓展欧洲和东南亚市场。在欧盟推动计算能力自主化的背景下,许多海外客户正在寻找多元化的硬件方案以减少对单一生态的依赖,这也为亚太地区的芯片企业提供了出海机遇。
新闻来源:李智衍,文中所述为作者独立观点,不代表icspec立场。更多精彩资讯请下载icspec App。如对本稿件有异议,请联系微信客服specltkj。

