智能工具库

燧原八年:从单芯片到万卡集群的算力长征

燧原科技八年深耕,从自研芯片到软件栈再到万卡集群,构建完整算力体系。与腾讯深度合作,产品规模化商用,正加速商业化,迎接AI算力系统战新挑战。

2026-09-01 0来源:雷锋网

从单卡到系统:AI芯片竞争升维

过去几年,AI芯片的比拼往往聚焦于单卡参数——峰值算力、显存大小、带宽高低,几组数字似乎就能定高下。然而,随着大模型进入规模化训练与推理阶段,尤其是MoE、Agent等新型负载不断推高算力需求,单卡性能已不再是唯一标尺。真正进入数据中心后,数十张、数百张乃至上万张芯片如何高速互联,软件能否充分释放硬件潜力,集群能否在高负载下稳定运行,这些因素共同决定了算力系统的实际交付能力。

AI芯片的竞争,正从“造一颗更快的芯片”演变为一场涵盖芯片、模组、互联、软件和集群的系统战。这一趋势,让燧原科技自2018年成立以来坚持的技术路线愈发凸显其价值。燧原并未局限于单芯片研发,而是逐步构建起覆盖AI加速卡、编程软件平台、智算系统及大规模算力集群的完整体系,并已迈过实验室阶段,多代产品在大型互联网公司真实业务中规模化部署,千卡、万卡级智算项目也已走向商业化。

自研架构与全栈布局的“硬仗”

国产AI芯片公司技术路线各异。部分厂商选择GPGPU路线,倚仗通用架构和兼容生态切入市场;燧原则另辟蹊径,基于自主指令集和DSA架构,研发自有AI计算体系。这一选择意味着,燧原既未复制英伟达的GPGPU设计,也未将CUDA兼容作为软件生态起点。

这条路的优势在于,针对AI计算专门设计,芯片架构拥有更大自主优化空间;但挑战同样显著——离开成熟的CUDA生态,驱动、编译器、算子库、开发工具等软件栈需从零搭建。燧原将这套体系分为三层:底层是芯片与硬件,基于自研指令集开发GCU-CARE加速计算单元,并借助GCU-LARE片间高速互连技术解决多芯片数据交换;中层是软件,自研的驭算TopsRider覆盖驱动、编译器、算子库等环节,目前已适配近千个AI模型,落地超300个应用场景;上层则是智算系统与算力集群。

这种全栈研发投入巨大。2023至2025年,燧原累计研发投入36.76亿元,截至2025年末,838名员工中研发人员达643名。对于尚未盈利的芯片公司而言,这是绕不开的成本,但技术价值终需在真实业务中验证。

腾讯:从投资方到“产品验证场”

燧原招股书中,腾讯的身影无法回避——既是最大投资方,也是第一大客户。有人调侃“背靠大树好乘凉”,但深入分析,这层关系远非“乘凉”那么简单。芯片行业周期长、资产重,从设计到制造涉及极精细工艺,方向一旦跑偏,沉没成本巨大。因此,AI芯片公司最稀缺的不是采购订单,而是愿意开放真实业务场景、持续共同迭代产品的合作伙伴。

腾讯与燧原自2019年起合作,围绕场景适配、性能调优、软件栈完善持续投入,经历了从单场景验证到多场景规模化部署的过程。目前,燧原产品已在腾讯多个AI业务场景落地。实验室的基准测试只能证明峰值能力,而国民级应用考验的是模型迁移、软件稳定性、集群调度、故障处理等工程问题。腾讯为燧原提供了一个长期存在的“验证场”,许多实验室未暴露的问题在真实业务中被放大,反哺下一代芯片与软件定义。

当然,单一客户占比过高也带来挑战。燧原需回答:腾讯验证过的能力能否复制到更多客户?从收入看,商业化已加速——2023至2025年营收从3.01亿元增至9.90亿元,2026年上半年达11.2亿元,超过2025年全年。但决定下一阶段空间的,或许不是多卖几块卡,而是能否应对AI算力竞争规则的变化。

万卡集群:算力新赛场的入场券

大模型参数规模已迈入万亿级别,尽管DeepSeek等稀疏模型通过架构创新提升算力利用率,但行业算力消耗仍在攀升。在“算力刚需”与“高端买不到”的拉扯中,国产算力需解答:究竟需要怎样的系统?

如今,算力早已不是“买卡插服务器”那么简单,算力、显存带宽、互联带宽、散热、软件栈、集群调度缺一不可。燧原最核心收入来自AI加速卡及模组,占比86.83%,但单卡性能再强,面对千亿、万亿参数模型也只是“单兵作战”。要打赢这场战争,必须通过系统级互联将无数加速卡“拧成一股绳”,打破单机与机柜边界。

燧原押注的正是“超节点”战场。在WAIC上,燧原与中兴通讯联合发布云燧ESL64-O超节点,采用OEX正交无背板架构,实现“零线缆”互联,以空间垂直交叉替代平面线缆绕接,在物理层做减法、性能层做加法,支持万卡级集群组网,被视为国产智算基础设施系统级创新的代表。

回看燧原八年技术路线,芯片是起点,软件决定易用性,互联决定扩展性,集群决定规模化交付能力。如果说过去国产AI芯片公司的第一张门票是造出性能达标的芯片,那么下一张门票则是能否将芯片变成一套可规模化部署的算力系统。燧原搭建的完整计算体系,正迎来检验商业价值的时刻。

本文基于 雷锋网 的公开内容,由 AI 辅助整理改写后发布。

原标题:从一颗芯片到万卡集群,燧原的八年算力长跑

阅读原文