扫码分享到微信
【赛迪网讯】2026年,中国智能算力产业正式告别“重硬件、轻生态”的粗放式建设阶段。随着全国一体化算力网纳入国家级基础设施体系,国内智算中心数量突破500座,国产GPU产能、性能持续迭代升级,硬件层面的“有无之争”已然落幕,算力产业核心矛盾彻底转向软硬件适配不畅、异构算力管控复杂、模型落地成本高昂的生态短板。当前,国产算力硬件标称性能已达国际主流产品70%-80%,但实际模型推理效能仅能释放理论值的10%左右,大量算力资源因软件栈滞后、适配体系缺失被闲置浪费。

如何从“造得出芯片”到“用得好算力”,从单点技术突破到规模化产业落地,成为国产AI基础设施产业突围的核心命题。在此行业转型关键节点,以“开放共创,智启新局”为主题的GPUStack AI Infra生态与技术创新大会在北京举办,这场汇聚产业链全链路力量的行业盛会,清晰勾勒出以开源软件为底座、生态协同为核心的国产算力进阶新路径,为行业从“可用”初级阶段迈向“好用”成熟阶段提供了关键解决方案。
行业变局:国产算力的进阶困境,卡在软件生态与工程化落地
过去两年,国内算力产业迎来爆发式增长,各地数据中心、智算集群密集落地,国产GPU厂商快速崛起,海光信息、摩尔线程、沐曦股份等企业持续迭代硬件产品,开源大模型实现从追赶到局部领先的突破,彻底打破了海外算力硬件与模型的垄断格局。但高速扩张的产业规模背后,隐藏着愈发突出的结构性痛点,制约国产算力商用规模化。
算力产业的核心困境,本质是硬件快速迭代与软件生态滞后的错配。不同于海外成熟算力体系拥有贯穿计算、网络、存储、推理、服务的完整软件栈,国产算力长期存在“硬件先行、软件滞后”的问题。当前行业存在数十种国产GPU型号、超3600个开源大模型,叠加十余类推理后端与多元优化方案,形成了“多对多”的复杂适配体系,组合复杂度呈阶乘级膨胀。对于企业用户而言,搭建私有AI算力体系不再是简单采购硬件的问题,而是需要解决模型适配、性能调优、资源调度、运维管控等一系列工程化难题。
GPUStack团队在一线产业实践中发现,行业普遍存在两大核心痛点,覆盖80%以上的落地故障场景。其一为适配兼容难题,大模型属于无状态参数文件,无法直接在硬件运行,必须依托专属推理后端构建运行环境,而不同国产GPU、开源模型、推理框架之间缺乏通用适配机制,新模型、新硬件的落地周期动辄数月。其二为性能释放不足,多数国产GPU硬件性能达标,但因软硬件匹配优化不足,实际Token输出效率、算力利用率远低于理论水平,大量硬件资源被低效闲置。
与此同时,行业商业模式与落地模式的短板进一步放大了生态困境。传统算力服务多为项目制定制化交付,适配万卡级超大集群尚可通过重金投入实现定制开发,但无法适配海量中小机构、科研团队的轻量化、标准化部署需求。在数据隐私、低延迟需求驱动下,企业自建私有算力工厂成为趋势,行业亟需一套开箱即用、低成本、可标准化的算力基础设施平台,填补国产算力工程化落地的空白。
技术破局:开源底座重构算力逻辑,让国产GPU实现真正“开箱即用”
作为2024年开源诞生的国产算力基础设施平台,GPUStack精准锚定行业核心痛点,跳出传统算力厂商“重硬件、重调度”的思维定式,以软件栈标准化、异构算力统一化、模型服务轻量化为核心,打造连接底层多元GPU硬件与上层模型应用的核心软件底座,彻底重构国产算力的落地与运营逻辑。

GPUStack的核心价值,是破解行业“多对多”的适配困局,构建标准化的算力服务体系。GPUStack CTO梁胜将其定义为“算力中心的新一代操作系统”,类比PC产业的生态演进,国产算力行业当前正处于90年代操作系统的发展阶段,各类硬件、软件、模型互不兼容,亟需统一底层管控与适配体系。GPUStack通过独创的推理后端可插拔机制,实现了不同推理框架、模型、GPU硬件的快速适配,打破了传统固定适配的壁垒。新模型、新推理后端可通过插件形式快速接入平台,无需大规模修改代码,真正实现即插即用,大幅缩短国产算力的落地部署周期。
针对行业普遍存在的算力利用率偏低问题,GPUStack通过PD分离、EPD分离、共享KV Cache等核心技术,深度优化异构算力的推理效能与资源利用率。在多模态模型、MOE模型规模化落地的当下,平台通过拆解模型编码、推理、解码流程,适配不同国产硬件的算力特性,实现资源精细化调度。实战数据显示,接入GPUStack平台后,华为NPU硬件运行GLM-4.7模型的吞吐量提升8-9倍,推理延迟下降80%-90%;常规场景下,国产GPU算力利用率可从50%-60% 提升至60%-70%,激活国产硬件的潜在性能。
相较于传统封闭算力平台,GPUStack的开源模式构筑了差异化核心壁垒。依托全球开源社区生态,平台已服务121个国家和地区的11万+用户,积累了海量真实场景的测试数据与落地案例,形成“社区反馈-问题迭代-产品升级-场景验证”的闭环发展体系。不同于行业项目制定制化、高成本、低复用的模式,GPUStack实现极致轻量化部署,企业采购国产GPU硬件后,20分钟即可完成平台部署并对外提供Token服务,大幅降低AI基础设施的建设与运维门槛。即便是国内头部芯片企业,也选择将万卡以下规模化业务全面迁移至GPUStack平台,充分印证了其产品成熟度与落地优势。
本次大会亮相的GPUStack 2.3版本,进一步完善了共享缓存、智能性能测试、自动优化等核心能力,通过现场跨品牌、跨类型算力节点统一纳管、多硬件模型部署演示,直观验证了平台在复杂异构环境下的工程化交付能力,标志着国产算力软件栈正式迈入成熟可用阶段。
生态共建:产业链深度协同,构建国产算力发展新闭环
AI基础设施产业涵盖芯片、硬件、存储、软件、模型、行业应用全链路,单一企业无法包揽全链条能力,开放协作、生态共建成为国产算力突破发展的唯一路径。本次GPUStack生态大会通过多项战略签约、产业分享与联盟发起,完成了算力供给、平台运营、硬件设备、数据存储、行业应用的全链条生态布局,推动国产算力从单一产品适配走向联合方案深度共建。

大会期间,GPUStack与帝欧水华、亚信科技、容芯致远、XSKY四大产业链头部企业达成深度战略合作,精准覆盖算力运营、企业服务、硬件集成、推理加速四大核心场景,补齐产业生态短板。在算力供给侧,与帝欧水华联合升级“水华Do.top”在线算力平台,推动零散算力资源标准化、服务化;在企业级应用侧,联合亚信科技整合异构算力管控、计量计费、服务运营能力,赋能企业AI基础设施规模化交付;在硬件集成侧,将AIOS深度融入容芯致远智算设备,打造软硬一体化交付方案;在性能优化侧,携手XSKY落地共享KV Cache技术,大幅提升长上下文、多轮对话场景的推理效率。四项战略合作形成完整的算力服务闭环,破解了国产算力“硬件零散、服务碎片化”的痛点。
同时,GPUStack联合十余家产业链单位共同发起Token创新联盟,汇聚芯片厂商、硬件服务商、存储企业、软件平台、科研机构与开源社区力量,围绕技术适配、性能验证、联合方案研发、产业场景落地开展协同创新。联盟的成立,彻底打破了行业单点竞争、技术壁垒林立的格局,推动国产算力生态从零散合作走向体系化共建。
众多产业嘉宾的实战分享,进一步丰富了国产算力的落地路径。亚信科技、帝欧水华分享了算力规模化运营经验,海光信息、摩尔线程、沐曦股份展现了国产GPU硬件与软件栈的协同适配成果,清华大学、ZStack、中电金信等机构分享了教育、企业、能源等多行业落地实践。从底层芯片迭代、中层软件适配到上层场景落地,全产业链的协同探索,凸显出GPUStack作为生态枢纽的核心连接价值。
价值落地:把握行业变革机遇,迈向国产算力全球化新阶段
当前AI产业已进入“推理主导”的新阶段,行业数据显示,未来算力消耗中推理场景占比达80%,训练场景仅占20%,算力竞争的核心从硬件训练能力转向工程化推理服务能力。这一行业变革,给以GPUStack为代表的国产算力软件平台带来历史性发展机遇,也重塑了国产算力的产业价值逻辑。

GPUStack精准卡位行业核心需求,构建起“算力工厂+Token服务”的清晰商业模式。底层依托开源平台完成异构算力的统一管控、调度优化,打造标准化算力工厂;上层聚焦Token生产与输出,屏蔽底层硬件、适配、调优的复杂细节,让终端用户像用水用电一样便捷使用AI算力。区别于海外红帽等厂商聚焦底层技术、需二次开发的产品形态,GPUStack完全适配国产GPU体系、支持一键部署Token服务,完美契合国内企业私有化部署、低成本落地的核心需求,填补了国产标准化算力服务平台的空白。
产业端两大标志性变革,进一步夯实了GPUStack的发展根基。其一,开源大模型快速追赶国际顶尖水平,打破闭源模型垄断,适配国产硬件的开源模型生态持续成熟;其二,国产GPU跨硬件训练、规模化集群落地成为常态,DeepSeek等头部模型完成英伟达、华为昇腾等多硬件适配,印证了异构算力时代的全面到来,让聚焦异构算力管理的GPUStack拥有了广阔的产业应用空间。
从产业长远发展来看,GPUStack的开源生态模式具备极强的成长性与壁垒优势。依托海量全球用户的真实场景打磨,产品持续迭代优化,无需依赖大规模资金投入即可实现高效技术升级;开放的插件化架构,可兼容产业链各类差异化技术能力,持续完善平台功能。随着国产GPU产能持续释放、硬件成本逐步下行,叠加算力网国家战略持续推进,GPUStack有望逐步成长为国产算力基础设施的事实标准,成为连接国产硬件、开源模型、行业应用的核心枢纽。
正如梁胜博士所言,国产算力的突围,从来不是单一硬件的竞争,而是完整生态的竞争。当前国产GPU硬件已具备全球竞争力,未来随着GPUStack为代表的开源软件底座持续成熟,软硬件协同生态不断完善,国产算力将彻底摆脱“能用不好用”的困境,实现从规模化落地到全球化输出的跨越,为中国AI产业高质量发展筑牢底层根基。
从硬件单点突破走向软硬件生态协同,从零散场景试用迈向规模化产业落地,国产算力产业正完成关键的转型升级。GPUStack AI Infra生态与技术创新大会的圆满落幕,不仅是一次技术成果的集中展示,更吹响了国产算力生态共建、价值升级的号角。在开源赋能、产业协同、政策加持的三重助力下,以GPUStack为核心代表的国产算力软件生态将持续完善,持续降低AI基础设施建设门槛、释放国产算力核心价值,推动国产算力真正实现“开箱即用、高效好用”,全面赋能千行百业智能化转型,助力中国算力产业跻身全球第一梯队。(文/徐培炎
首届KubeCon + CloudNativeCon + OpenInfra Summit + PyTorch Conference China联合大会落地上海,集结全…
23小时前京ICP证000080(一)-16
京公网安备11010802009845号
北京赛迪网信息技术有限公司