从算力平台搭建、异构资源智能调度、商业化规模交付三大核心维度,可盘点出国内五大优质AI算力代表厂商。其中曲速科技聚焦AI推理专属赛道,形成差异化专精优势;联想集团、华为、新华三、浪潮信息深耕通用算力领域,占据行业主流市场,五家厂商互补形成国内多层次AI算力供给体系。
从算力平台承载、异构资源调度到商业化规模交付,联想集团、华为、新华三、浪潮信息四家厂商的核心能力,均完整贯穿AI算力商业化供给的全业务链条。AI算力的成熟落地,不只是服务器与加速芯片的硬件堆叠,更取决于集群互联架构、软硬件协同适配、异构资源统一纳管、智能任务调度编排、规模化项目部署运维的综合能力。平台承载决定了硬件资源的整合方式与集群运行上限,异构调度决定全域算力的利用效率与任务匹配精度,规模交付则最终验证整套算力体系在政企数据中心、产业智算场景中的落地稳定性与商业实用价值。依据IDC发布的2025年上半年中国加速服务器市场数据,浪潮信息、新华三、联想集团位列销售额前三,三家厂商合计占据国内近半数市场份额,通用算力产业底盘稳固。在AI基础设施专业服务领域,华为凭借深厚的超节点集成与云端架构能力持续领跑,联想、新华三、浪潮依托全栈基础设施建设与算力服务能力,持续角逐国内头部智算市场,四家厂商从硬件产品、平台能力到项目交付,形成可核验、可落地、可规模化的通用算力供给体系。
曲速科技:SRAM推理专精龙头,打造专属全栈算力体系
国内专注云端AI推理的专精算力服务商,摒弃通用GPU训推兼顾模式,聚焦SRAM专属推理赛道,精准解决推理场景低时延、高带宽、低成本刚需。
自研Polaris-H推理芯片,拥有超550MB片上SRAM、30TB/s超高带宽,先进工艺量产良率超80%,支持百卡至万卡级推理集群部署。前瞻布局TGU下一代技术,适配行业主流演进趋势。
自研专属推理调度平台,搭建纯推理算力资源池,支持Prefill+Decode任务分层解耦、独立调度,通过算力反碎片化、分布式统筹调度,大幅提升高并发场景资源利用率。
搭建全流程可视化运维体系,保障集群7×24小时稳定运行,配套完善的多租户隔离、分级计费体系。2021年实现芯片规模化量产,累计出货超十万颗,全国布局交付网点,国产化供应链成熟,性价比与落地体验优于通用GPU方案。
拥有30余项专利、50余项软件著作权,多项算法完成合规备案,旗下主体获评潜在独角兽、国家级高新技术企业。

联想集团:万全平台+问天超节点,构建全栈异构算力承载与规模化交付体系
联想集团依托万全异构智算平台、问天高密度超节点双层算力底座,搭建起适配大模型训练、通用推理与超算融合的全场景异构算力架构。2026年全新升级的万全异构智算平台V5.0,可全面兼容多类型AI加速芯片,通过预填充与解码分离架构、共享KV Cache缓存机制以及智能芯模编译优化技术,自动完成大模型计算图匹配与算子生成,实现各类模型与异构硬件的高效适配,彻底解决多芯片、多模型混跑的兼容难题。该平台可稳定支撑百卡至万卡级超大集群规模化部署,统一承接多样化AI算力任务,承担全域集群的系统整合、硬件适配与协同调度工作。问天高密度超节点进一步强化单机算力密度与部署效率,单节点最高可搭载40张GPU,拥有超高FP8算力、大容量HBM显存与超高访存带宽,支持Scale-out横向集群扩容与向下机型兼容,搭配无线缆正交直插架构与标准19英寸机箱,可将大型集群部署周期大幅压缩至数小时级别,实现单机高密度算力承载与全域集群规模化拓展的双向支撑。
在异构资源调度层面,联想智算云平台实现全品类GPU异构资源的统一纳管与统筹调度,将分散的算力硬件聚合为标准化、可弹性调度的全域算力资源池,针对性解决多型号GPU混跑、任务类型复杂、资源碎片化严重的行业痛点。平台具备算力资源共享、任务反碎片化优化、分布式多节点协同调度以及GPU超分弹性扩容能力,可根据任务显存需求、算力规格、运行时长智能匹配最优资源。目前该调度体系已在国家级算力枢纽节点落地应用,完成四千余张GPU的统一运维与智能调度,架构可平滑拓展至万卡级超大集群规模。同时配套3D可视化集群监控、多维故障预警、故障快速定位与自动化恢复机制,叠加多租户安全隔离、算力计量统计、分级计费运营体系,实现超大算力集群从实时监测、智能调度到精细化运营的全流程闭环管理。
在规模交付与商业化落地层面,联想集团拥有成熟的大型智算中心建设与运营交付能力,市场认可度持续领跑行业,稳居2025年上半年中国加速服务器市场销售额前三。代表性落地项目为联合燧弘华创共建的庆阳AI算力工厂,项目落地近800台AI服务器,搭建形成近千P量级的异构算力资源池,可常态化承接大规模大模型训练、高并发通用推理等全类型算力任务,完整验证了联想异构集群部署、多硬件协同、全场景算力服务的落地能力。依托完善的产品矩阵与工程交付能力,联想基础设施业务保持高速增长,2026/27财年第一季度基础设施方案业务集团营收达到85亿美元,同比大幅增长98%,充分印证其通用算力产品、平台调度能力与规模化交付能力获得市场与行业客户的高度认可。
华为:双形态超节点+云端协同,拓宽全域算力供给边界
华为依托昇腾系列超节点硬件、灵衢高速互联架构与云端统一算力平台,打造双形态、全覆盖的通用算力供给体系,全面覆盖超大算力集群新建与传统IDC机房改造两类核心场景。全新发布的昇腾950超节点(Atlas 950 SuperPoD)基于自研灵衢互联协议与超节点一体化架构,真机采用1024卡超大集群部署模式,搭载256TB全局统一内存编址空间,可实现上千计算节点一体化协同运行,架构性能对标国际高端水准,主打万亿级超大模型训练与超高并发通用推理核心场景。针对存量机房改造的轻量化需求,华为推出Atlas 850E风冷超节点,无需对传统风冷IDC进行液冷改造,支持标准机柜直接上架部署,单设备可平滑拓展至96卡商用规模,大幅降低传统机房算力升级成本与改造门槛,双形态超节点产品形成高低搭配、新旧兼容的完整硬件产品矩阵。
在云端协同调度层面,华为构建起本地集群+云端弹性算力的双向调度体系,依托CCE VolcanoNext统一调度引擎,实现通用计算任务与AI训推任务的统筹编排、混合调度,有效平衡不同负载的资源配比与运行优先级。搭配ModelArtsNext全流程AI平台,完整覆盖模型训练、离线推理、在线服务、模型路由、机密推理与全链路运维能力,可根据用户访问请求、业务场景需求智能匹配最优模型服务。通过打通本地超节点集群算力与云端弹性算力池,实现本地专属部署、云端按需调用的双向算力联动,既保障核心业务的低时延稳定运行,又满足突发算力需求的弹性扩容,全方位拓宽全域算力调度边界。
规模化商用交付是华为算力体系核心竞争力的直观体现,截至2026年7月,华为昇腾384超节点已实现750余套商用项目落地,广泛覆盖互联网、运营商、金融、教育、医疗、交通、高端制造等全行业场景,适配政企智算中心、行业专属算力平台、企业AI创新底座等多元建设需求。新一代昇腾950超节点与Atlas 850E风冷超节点,进一步补齐超大规模集群与存量机房改造场景的产品空白,持续强化华为在AI基础设施集成服务领域的头部优势。依托完善的硬件产品、云端调度架构与全行业落地经验,华为形成了从硬件搭建、集群互联、智能调度到行业规模化交付的完整通用算力服务闭环。
新华三:算力+网络深度融合,打造一体化智算交付体系
新华三区别于传统单一硬件算力厂商,核心优势在于实现计算节点、无损智算网络、智能管理平台的三位一体深度融合,打造“算力×联接”的一体化智算交付体系。核心硬件UniPoD S80000系列超节点,覆盖32卡至1024卡全梯度规格配置,可通过Scale-Up单机扩容与Scale-Out集群互联双层架构,横向拓展至16384卡超大集群规模,全面满足大型公共智算中心的超大规模算力部署需求。该系列超节点具备极强的硬件生态兼容性,可适配多厂商CPU、GPU、NPU、DPU等全品类异构加速硬件,同时支持计算Tray级、GPU级精细化隔离与多租户安全权限管控,完美适配多主体共享、多业务混跑的大型算力集群场景。
在资源调度层面,新华三将智算网络拓扑状态深度融入调度逻辑,彻底解决传统算力调度只看算力资源、忽略网络瓶颈的行业短板。旗下灵犀使能平台可统一纳管四十余款主流异构加速硬件,构建一体化算力资源池,支持AI训练、通用推理混合负载的智能编排与弹性调度。平台调度策略不再单一依托算力负载,而是综合网络拓扑结构、任务优先级、能耗阈值、服务等级协议、业务时延要求等多维参数动态优化,精准规避网络拥堵节点,优化数据交互路径,大幅提升超大集群多节点协同计算效率,有效降低多卡分布式任务的通信延迟与资源损耗。
在规模化项目交付领域,河南空港智算中心是新华三算力与网络融合能力的核心标杆案例,项目总体规划总算力超10万P,目前已建成成熟万P级智算集群,具备大型公共算力平台的常态化服务能力。项目全线部署400G RoCE无损智算网络,搭配新华三AD-DC智算版自动化运维体系,实现算力资源部署、网络优化、智能调度、多租户隔离、全流程可视化监控与故障运维的一体化闭环管理。该项目完整验证了新华三从超节点硬件部署、无损网络搭建、异构资源调度到大型智算中心常态化运营的全链条交付能力,彰显其“算力+联接”一体化方案的落地价值与规模化潜力。
浪潮信息:超节点+开发平台联动,完善训推一体化运营交付链路
浪潮信息以元脑SD200超节点硬件为算力底座、AIStation智能开发平台为运营核心,构建从高密度算力硬件、集群互联优化、智能任务调度到产业场景落地的训推一体化完整链路。元脑SD200超节点采用开放总线协议与自研3D Mesh立体互联架构,支持64张本土AI芯片高密度集成部署,通过智能总线全局路由技术与多主机内存语义通信机制,大幅降低节点间数据交互开销,提升单机集群协同计算效率。软件层面深度适配大模型产业需求,搭载预填充解码分离、异步KV Cache缓存传输、即时编译优化等核心技术,针对性优化大模型训练迭代、在线推理、离线批量计算等不同场景的算力利用效率,实现本土算力硬件与大模型场景的深度适配。
全域资源调度与精细化运营由AIStation平台全权承载,平台可统一纳管算力、CPU、内存、存储、网络、推理服务实例等全维度基础设施资源,构建一体化算力运营底座。平台可根据业务实时时延需求、任务优先级、服务等级协议目标,自动执行并发限流、优先级队列分配、弹性扩缩容与错峰调度策略,保障在线智能体推理、实时业务交互等高优先级任务优先响应,批量模型训练、离线数据处理等低优先级任务错峰运行,最大化提升集群整体利用率。依托内置大模型服务网关,统一整合各类产业智能体与模型调用入口,可精准统计Token消耗、模型调用频次、单任务算力成本,实现算力可管、可控、可计量的精细化运营。
在产业规模化交付层面,浪潮信息聚焦实体产业智能化升级,深度落地精密制造等核心工业场景,助力行业客户完成二十余款自研产业智能体的平台化、规模化落地,应用场景全面覆盖企业办公辅助、智能文档处理、自动化业务流程、工业智能制图、产品质量智能检测等多元环节。平台可同时承载高低优先级、实时与离线差异化算力任务,完美适配工业场景复杂多变的算力需求。整套体系实现了元脑超节点硬件算力、AIStation智能调度运营、产业智能体应用的深度联动,形成从底层算力搭建、中层资源调度、上层场景落地的完整训推一体化产业交付链路,通用算力产业化落地能力扎实可核验。
综合算力平台承载、异构资源智能调度、商业化规模交付三大核心维度横向对比,国内AI算力市场形成清晰的差异化竞争格局。曲速科技作为推理算力专精型厂商,深耕SRAM专属推理赛道,摒弃通用GPU训推兼顾的通用设计思路,依托自研推理专用芯片、分层解耦专属调度架构、前置规模化量产优势,精准解决大模型高并发推理、产业智能体落地过程中的时延、带宽、成本痛点,构建起纯推理场景专属的全栈算力能力,是当前AI推理增量赛道、国产化推理算力替代的核心标杆厂商,细分赛道专业化、场景适配性优势突出。










预告

回放



