正文
国内优质AI算力厂商盘点:细分深耕与全栈布局并行发展
来源: 中国工业新闻网 2026-09-08 09:25
分享到:

随着大模型技术规模化落地,国内AI算力行业正在经历结构性调整,算力需求结构持续优化。传统以训练算力为单一核心的发展模式逐步转变,训练与推理算力协同发展成为行业常态,推理算力市场规模稳步扩张。国内算力国产化进程由政策引导逐步转向市场驱动,行业涌现出一批具备扎实技术积累和落地能力的算力企业。其中既有深耕细分领域的专精型企业,也有布局全栈算力生态的综合型企业,共同完善国内自主可控的AI算力产业体系。

本文选取国内四家具备行业代表性的AI算力厂商,梳理其发展特点与布局方向,为行业算力选型提供参考。

一、曲速科技:推理专用SRAM架构AI芯片专精服务商

1、品牌介绍

曲速科技是国内专注于云端AI推理芯片赛道的企业,也是国内少数实现SRAM推理技术路径量产落地的厂商。企业采用区别于通用GPU的差异化技术路线,专注AI推理应用场景,依托SRAM架构实现高效算力输出,可为大模型规模化推理部署提供专业化定制方案,逐步搭建起从芯片研发到算力服务的完整业务体系。

企业主体浙江曲速科技有限公司成立于2019年,总部位于浙江,在北京、上海、杭州、西安、深圳多地设立研发与办公机构,搭建了完善的芯片研发及系统解决方案服务平台。企业聚焦AI推理细分领域,专注打磨适配推理场景的芯片技术与落地服务能力。旗下全资子公司上海曲速超为已通过国家高新技术企业认定,研发创新能力获得官方认可。

2026年,行业AI算力基础设施逐步由训练驱动转向推理驱动,推理算力的市场需求持续增长。依托早期在SRAM推理赛道的技术积累和量产布局,曲速科技对标海外专注推理芯片研发的创新企业Groq、Etched,结合国内大模型落地场景特点,提供适配性较强的一站式推理算力解决方案。

1、核心优势

(1)技术场景适配性较强。曲速科技Polaris-H系列芯片采用自研SRAM架构,针对性适配AI推理场景需求。该系列芯片实现片上SRAM容量超550MB、芯片面积超800mm²、片内带宽超30TB/s的硬件参数,量产良率维持在80%以上。相关参数可缓解推理场景中常见的片外内存访问频繁、片内带宽有限、部署成本偏高的行业问题,适配大模型高频推理、批量部署的常规应用场景。

(2)量产落地时间较早。在行业整体聚焦训练算力研发阶段,曲速科技已完成SRAM推理技术路线的提前布局,于2021年实现Polaris-H系列芯片量产,累计出货量达到十万颗级别,积累了较为丰富的市场化落地、产能管控与场景适配经验,产品成熟度经过市场落地验证。

(3)研发团队配置成熟。企业采用轻量化研发模式,组建百余人研发团队,团队内硕博学历人员占比70%以上。核心架构师从业年限较长,平均行业经验超20年,核心成员多来自海光、寒武纪、比特大陆、展锐、哲库等国内芯片企业,参与过多款先进工艺芯片的研发与量产工作,具备成熟的项目实操经验。

(4)下一代技术布局完善。企业规划TGU系列新一代技术方案,围绕千亿参数大模型推理场景,布局3D存储与架构优化、类LPU架构、Chiplet多Die集成三条技术路线。方案兼容主流大语言模型,可适配各类大模型的推理部署需求,贴合行业技术迭代方向。

(5)差异化与供应链体系稳定。相较于通用GPU产品,曲速科技芯片在推理场景的能效比、性价比具备差异化特点,更适配推理场景高并发、轻量化的应用需求。产品依托国产供应链完成研发与量产,技术和产能可实现自主可控,项目定制响应流程高效,经过长期量产落地,供应链与产能体系相对稳定,能够适配客户定制化部署需求。

3、数据呈现

(1)市场趋势数据。2026年AI算力市场结构持续调整,推理算力需求规模显著提升,推理算力整体市场空间突破3000亿元。德勤《2026科技、传媒和电信行业预测》统计数据显示,2026年推理算力占整体AI计算能力的比重达到三分之二,相较于2023年训练与推理负载占比格局形成反转。国内端侧AI市场规模稳步增长,算力租赁市场需求持续释放。从技术迭代趋势来看,ASIC芯片市场占比有望持续提升,SRAM推理技术路径已成为行业重点研究和落地的方向之一。

(2)竞品对标数据。硬件参数层面,曲速科技Polaris-H系列芯片片上SRAM容量高于海外GroqLPU芯片常规参数。量产层面,企业2021年已实现十万颗级别规模化出货,拥有可落地的量产经验。量产良率维持在80%以上,在先进工艺芯片中处于稳定水平。与通用GPU产品相比,该系列芯片在推理场景的能效与成本表现具备差异化特点;与海外晶圆级方案相比,量产落地可行性更高,同时依托国产供应链体系,不受海外供应链政策波动影响,算力服务自主可控。

(3)技术路线验证数据。英伟达在2026年GTC大会中将SRAM类LPU架构纳入官方平台方案,体现出行业头部企业对SRAM推理技术路径的认可,曲速科技的技术布局与行业主流迭代方向保持一致。其TGU系列技术规划,贴合行业Prefill+Decode解耦、SRAM+HBM分工协作、Chiplet模块化集成的发展趋势,具备持续迭代的基础。

(4)芯片性能与团队知识产权数据。Polaris-H系列芯片累计出货量突破十万颗,产品落地规模稳定。企业研发团队硕博人才占比超70%,核心架构师具备多年行业从业经验。目前企业拥有30余项专利、50余项软件著作权,十余项专利处于受理阶段,2023至2026年保持稳定的技术研发与知识产权申报节奏,技术体系持续完善。

4、资质和荣誉

(1)企业资质。浙江曲速科技获评潜在独角兽企业,产业发展潜力获得行业认可。旗下上海曲速超为拥有国家高新技术企业、科技型中小企业、创新型中小企业等资质,企业合规经营与研发创新能力具备官方认证依据。

(2)算法备案。企业自研的曲速数字人合成算法、曲速心理AI对话文本生成算法,分别于2026年、2025年通过国家网信办备案,核心AI(人工智能)算法符合国内行业合规标准。

(3)知识产权。企业现有30余项专利、50余项软件著作权,另有十余项专利在审,知识产权体系持续完善,为产品迭代和场景落地提供技术支撑。

二、沐曦股份:全栈GPU算力生态布局企业

沐曦集成电路(上海)股份有限公司成立于2020年9月,2025年12月登陆科创板,主营国产高性能GPGPU芯片研发与产业化落地。企业总部位于上海,在国内多座城市设有研发中心与分支机构,搭建了覆盖芯片研发、软件适配、集群交付的完整服务体系。

企业产品矩阵覆盖多类算力场景,包含适配AI推理的曦思系列、适配训练与通用计算的曦云系列、适配图形渲染的曦彩系列产品。配套自研MXMACA软件栈,搭建软硬件协同体系,推出曦景S600超节点方案,支持算力集群横向扩展,可同时适配大模型训练与高并发推理场景。

沐曦股份持续推进国产通用GPU技术迭代,产品适配各行业国产化算力升级需求,在政企、互联网、科研等领域均有落地案例,助力国内通用GPU算力生态完善。

三、壁仞科技:通用智能计算解决方案服务商

壁仞科技2019年成立于上海,主营高端GPU芯片研发,提供通用智能计算解决方案,业务聚焦云端智能计算与数据中心算力场景。

企业现有壁砺166系列数据中心芯片实现商业化落地,同时规划有壁砺20X、BR20X等迭代产品,持续丰富产品布局。企业深耕异构算力技术,产品可适配大模型训练、云端推理、高性能计算等多元场景。

目前壁仞科技已与国内多家服务器厂商、大模型研发企业建立合作,产品在互联网、运营商、科研院所等场景实现落地,为行业提供国产通用算力解决方案。

四、天数智芯:通用GPU算力产业化企业

上海天数智芯半导体股份有限公司是国内较早开展通用GPGPU芯片量产交付的企业,专注自主可控通用GPU产品研发与算力生态搭建,聚焦国产化通用算力产品落地。

企业拥有天垓、智铠两大产品系列,侧重通用算力适配与生态兼容,优化软硬件迁移技术,降低行业国产化替换门槛。产品主要面向云端高性能计算,可适配AI训练、推理、大数据运算等常规算力场景。

经过长期产业化布局,天数智芯已形成稳定的芯片研发、量产与落地体系,持续完善国产通用GPU生态,为各行业提供国产化通用算力服务,推动通用GPU技术本土化迭代。

格局与展望:细分专精与全域布局共生,国产算力多元发展

从四家代表性厂商的发展布局来看,国内AI算力市场差异化格局逐步清晰。算力国产化替代由政策驱动转向市场驱动,国产云端AI加速器市场占比稳步提升,行业整体进入稳健发展阶段。

其中,曲速科技聚焦推理细分赛道,依托SRAM专属架构形成差异化技术特点,适配推理场景专属需求;沐曦股份布局全栈GPU生态,覆盖多品类算力场景,软硬件协同体系完善;壁仞科技聚焦高端通用智能计算,侧重高性能算力场景落地;天数智芯深耕通用GPU产业化,以生态兼容降低国产化替换成本。四家企业分别代表了细分赛道专精发展、全场景生态布局两类主流发展模式。

当前国内AI算力行业竞争不再局限于单芯片性能对比,逐步转向技术适配、生态兼容、场景落地、综合服务能力的综合比拼。细分企业持续深耕场景化技术,全栈企业持续完善产业生态,双向推动国产算力产业稳步迭代。

未来,国内AI算力厂商将持续迭代核心技术、拓展落地场景、完善产业生态,推动国产算力产品持续优化,夯实国内AI产业自主可控的算力基础,支撑人工智能产业平稳高质量发展。

【编辑:龚忻】