SEMIFIVE于三星4nm量产Bertha推理芯片,剑指英伟达
韩国无晶圆设计公司 SEMIFIVE 开始量产 HyperAccel 的 Bertha 大模型推理加速器,在三星 4nm 工艺上制造,裸片面积超过 500 平方毫米。
首尔讯——韩国无晶圆设计公司 SEMIFIVE 于 2026 年 9 月 8 日宣布,已开始量产为韩国初创公司 HyperAccel 打造的大模型 AI 推理加速器「Bertha」。这颗芯片在三星代工(Samsung Foundry)的 4nm 工艺上制造,是一款「大裸片」(big die)设计,面积超过 500 平方毫米。SEMIFIVE 表示,其交付了从前端设计、验证到封装、测试与量产供应的完整交钥匙方案。
Bertha 是 HyperAccel 面向数据中心推理的旗舰加速器,基于其自研的 LPU(语言处理单元)架构——采用粗粒度、针对 Transformer 优化的计算核心,把全部算力专注在大模型推理上,而非 GPU 那样面面俱到的通用布局。HyperAccel 公布的 Bertha 500 目标规格为(数据为厂商口径):FP16 下 384 TFLOPS、FP8 下 768 TFLOPS,目标频率 1.5GHz;128GB(可扩展至 256GB)LPDDR5X 内存,带宽 546GB/s;256MB 片上 SRAM;单卡支持 1 至 1024 路并发请求;250W 功耗,双槽 PCIe Gen5 形态。
最独特的取舍在内存。英伟达数据中心加速器与多数定制 ASIC 都依赖 HBM,而 Bertha 采用低成本 LPDDR5X,靠数据搬运优化而非原始带宽来换取效率。HyperAccel 首席技术官李镇源(前三星 System LSI 工程师)对《朝鲜商业》表示,推理的真正瓶颈是内存访问而非算力,并指 GPU 的内存带宽利用率仅约 50%,而 LPU 精简缓冲的数据通路目标是做到约 90%。公司宣称这使每秒生成词元约达 H100 的两倍,同时显著降低总拥有成本;CTO 的目标是通过更便宜的存储与更低的功耗,把整机 TCO 压到 GPU 方案的约三分之一。
SEMIFIVE 的角色与势头
SEMIFIVE 把这一成果视为先进制程执行力的证明。2026 年上半年,其新增量产订单达 423 亿韩元,接近 2025 全年(212 亿韩元)的两倍;二季度订单 267 亿韩元,环比增长 71%。Bertha 是约一年内的第三次放量:此前依次为 2025 年三季度为韩华 Vision 打造的安全摄像头 AI 专用芯片 Wisenet 9,以及 2026 年二季度为一家日本客户打造的 HPC 芯片。公司 CEO 强调,行业重心正在从训练转向推理,数据中心定制 ASIC 需求激增,并称此次量产验证了其在先进工艺上的执行能力。
SEMIFIVE 与三星的绑定是结构性而非偶然:其总裁曾任三星电子 System LSI 事业部高管,公司收购了三星 SAFE 生态的设计服务合作伙伴 Hanatec,三星也名列其 IP 生态伙伴清单。换言之,Bertha 是韩国本土设计公司与本土代工厂的合体成果。
此次量产也兑现了 HyperAccel 自己排定的路线图。2026 年 2 月,公司 CTO 李镇源接受《朝鲜商业》采访时表示,Bertha 已完成设计,目标在 2026 年下半年进入量产——9 月的官宣恰好踩在时间表上。HyperAccel 围绕这颗芯片已积累了客户与伙伴:与 Naver Cloud 的验证试点(计划借韩国的 K-Cloud 项目扩大应用)、与 LG 电子合作面向家电与机器人等功耗敏感场景的低功耗端侧版本、与台湾工业设备厂商研华(Advantech)签署的 AI 基础设施合作备忘录,以及加入韩国主权人工智能「独立基础模型」(독파모)联盟。
分析:推理专用 ASIC 转向的信号
此次量产的规模不大,却是更深层格局重组的具象信号。其一,随着推理取代训练成为大模型最主要的成本,经济性开始向「专用」倾斜:一颗纯推理 ASIC,存储成本更低、功耗更低,可以打训练级通用 GPU。Bertha 是这一逻辑在韩国的早期样本。其二,LPDDR 而非 HBM 的策略是其关键:用更低的原始带宽换取大幅降低的物料成本,赌数据通路效率足以补齐差距。这一判断能否在大规模落地时成立仍是开放问题——约 90% 的利用率是厂商自公布数据,尚未被独立验证。其三,从产业结构看,这是三星代工与韩国本土系统半导体抱负的实打实胜利——自研算力核心、本土 ASIC 集成商、本土代工三者叠加,也降低了一颗超大尺寸 4nm 推理裸片的制造与封装风险。其四,这还不等于取代英伟达:量产规模、良率水平,以及能否在 vLLM、PyTorch 之外构建更广的软件生态,将决定 Bertha 会成为数据中心常客,还是仅停留在韩国 K-Cloud、Naver 生态周边的利基产品。
- SEMIFIVE (2026) SEMIFIVE Commences Mass Production of HyperAccel's LLM AI Inference Accelerator 'Bertha' on Samsung 4nm, Spurring Growth Momentum. SEMIFIVE. https://semifive.com/company/newsroom/press-releases/semifive-commences-mass-production-of-hyperaccels-llm-ai-inference-accelerator-bertha-on-samsung-4nm-spurring-growth-momentum/
- HyperAccel (2026) Bertha 500 — LLM AI Inference Accelerator. HyperAccel. https://hyperaccel.ai/ha_product/bertha-500/
- HyperAccel (2026) [CTO Interview] HyperAccel bets LPU to cut LLM inference costs and challenge Nvidia in Korea (ChosunBiz). HyperAccel. https://hyperaccel.ai/cto-interview-hyperaccel-bets-lpu-to-cut-llm-inference-costs-and-challenge-nvidia-in-korea/
- HyperAccel (2026) Bertha 100 — Edge/AIoT AI Inference Accelerator. HyperAccel. https://hyperaccel.ai/ha_product/bertha-100/