核心结论

2026年9月18日,华为全连接大会2026在上海开幕,华为云发布Agentic Infra新范式与系列进展:灵衢昇腾950智算集群全球上线,Token吞吐性能较上一代算力提升20%,可保障云上训练任务连续稳定运行40天、故障10分钟内完成修复;CMS记忆存储搭建PB级记忆空间,读取性能较业界同类产品提升50%。企业级智能体平台智果AgentArts已落地服务100余家企业,行业AI梦工厂落地项目超1000个。信号很明确:智能体的竞争重心正从模型能力转向承载它的基础设施。

瓶颈换了位置:从模型能力到Token效率

华为云CEO周跃峰的表述是:智能体时代基础设施的核心不再局限于算力供给,更要实现Token高效利用与通用、智能算力协同调度,保障智能体稳定运行于生产场景。

这一判断对应了智能体工作负载的本质变化。传统AI推理多为一次性请求,智能体却要持续做任务拆解、工具调用与结果反馈,一次任务可能触发数十次模型调用。当调用频次成为主要成本,单位Token的吞吐与成本就取代峰值算力,成为决定项目可行性的关键指标。

四层Agentic Infra:逐层对应一类痛点

+20%
灵衢昇腾950 Token吞吐提升
40天
训练任务可连续稳定运行的时长
+50%
CMS记忆存储读取性能提升
2倍
CMS记忆存储容量(相对同类)

灵衢昇腾950智算集群搭载全链路可观测五级快速恢复机制,故障可在10分钟内完成修复;通过调度、缓存、算法多维度协同优化提升Token吞吐。

CMS记忆存储针对长周期任务,搭建PB级记忆空间并支持TB级高速读取。对需跨会话保持上下文的智能体而言,记忆层读写效率直接决定体验上限。

层级解决的问题关键指标
高效Token调用频次高、单位成本敏感吞吐提升20%
增强记忆长周期任务上下文丢失PB级空间、读取提升50%
通智一体调度通用与智能算力割裂协同调度
安全自治生产环境稳定性与合规连续运行40天、10分钟修复

平台层:用资产复用把开发门槛压下去

基础设施之上是平台。华为云企业级智能体平台开放5000余项通用资产、1000余项行业资产,行业AI梦工厂搭建医疗、具身智能、科学计算、智能制造、智慧金融五大专区,本次新推政务智能与AI硬件专区。平台已服务邮储银行、南方电网、金山办公等100多家企事业单位,智果AgentArts将于12月30日海外商用。

金山办公的实践可资参照:依托该平台打通WPS 365与WPS Comate,搭建多款垂直办公智能体,已在金融、政务领域落地。企业自建智能体的路径正从“从零训练模型”转向“在平台上组装能力”。

开源与生态:openJiuwen Star超5万、下载329万

生态侧,开源社区openJiuwen Star超5万、下载量突破329万,华为云联合中软国际、软通动力、北明软件推出伙伴商用版本。

企业选型的三个判断点

先算长链路调用量,再决定自建还是采购

先按任务类型估算日均调用量与Token消耗,再决定自建集群还是按需采购。未达规模前,按需采购更经济。

把记忆与上下文管理当作独立模块评估

跨会话一致性差的智能体难以承担真实业务流程,选型时应单独测试长任务的上下文保持能力。

行业资产比模型参数更值得关注

在智能制造、金融等场景,1000余项行业资产带来的冷启动优势通常超过更换底座模型,把精力放在流程梳理与场景定义上更现实。

结语:基础设施交给平台,场景留在企业

对多数企业而言,自研基础设施并不经济。依托成熟平台做AI大模型定制与数据挖掘,把资源集中在业务场景上更务实。一道科技在杭州服务企业客户时,常建议以软件外包方式先做单点验证,再扩展到多智能体协作。更多落地方法可查看官网服务方案与行业分析。

常见问题(FAQ)

Agentic Infra与传统AI基础设施有什么不同?+

传统AI基础设施以算力供给为核心,关注峰值算力与训练速度;Agentic Infra面向智能体的持续任务负载,核心是Token高效利用、长期记忆、通用与智能算力协同调度,以及生产环境的安全自治。差异体现在具体指标上:Token吞吐提升20%、记忆读取性能提升50%、训练任务连续稳定运行40天、故障10分钟内完成修复。

什么是智能体的记忆层,为什么重要?+

智能体执行长周期任务时需要跨多次会话保留上下文,记忆层即负责这部分数据的存储与读取。华为云CMS记忆存储搭建PB级记忆空间,容量为同类产品2倍,支持TB级记忆高速读取,读取性能较业界同类产品提升50%。记忆读写效率低会直接导致智能体遗忘前序进展,难以承担跨天、跨周的真实业务流程。

中小企业部署智能体,需要自建基础设施吗?+

通常不需要。基础设施层的高投入更适合有大规模调用量的头部企业;中小企业可依托云厂商的企业级智能体平台与开源底座,直接复用5000余项通用资产与1000余项行业资产,把资源集中在业务流程梳理与场景定义上。内部技术力量有限时,通过AI大模型定制或软件外包方式从单点场景验证起步,风险更低、见效更快。