
智东西
作者 ZeR0
编辑 漠影
智东西9月19日报道,今日,在华为全联接大会2026上,华为分享了鲲鹏/昇腾、华为云、鸿蒙操作系统的最新生态进展和面向Agentic时代的开发者工具布局,并发布AI资产广场,帮开发者快速上架和找到合适的AI资产。
华为计算首席战略官朱照生谈道,Agentic计算发生五个变化:从单服务器到超节点开发,从进程走向思程开发,从SIMD到SIMD+SIMT新同构开发,从HiFloat8走向低精度HiFloat4,从人工算子编程到Agent编程调优。
华为云伙伴与生态部总裁康晓宇介绍了华为云如何通过Agent Infra、Agent工具和开发者实践,来帮助开发者快速获取先进的智能体工具,深入行业,交付结果,持续获取收益。
另据华为终端云服务开发者服务与平台部部长卢鑫刚分享,鸿蒙操作系统HarmonyOS 7面向Agent,升级了Agent亲和系统架构、鸿蒙智能体框架2.0、系统智能体小艺,并提供一系列开发者工具来助力Agent开发及接入。
一、华为计算:昇腾跨越生态拐点,Agentic开发与计算发生五大变化
华为计算首席战略官朱照生首先分享了鲲鹏和昇腾的生态进展。
鲲鹏自2019年推出以来坚定推进开源开放。华为在2019年12月份推出了开源openEuler,迄今openEuler的累计部署量超过2000万套,稳居中国服务器操作系统第一份额,不同产业汇聚全球416万名开发者与7200家伙伴,联合打造了28000个行业解决方案。这些方案已经在金融、互联网、运营商、数字政府、电力、教育、制造等生产系统落地。
昇腾始于华为2016年的一个技术项目,2018年发布其首个推理产品。如今昇腾算力已成为中国AI产业发展的核心力量。
朱照生宣布,昇腾已跨越生态拐点:
- CANN社区从今年6月份起成为中国活跃度最高的开源社区,拥有超过5200个月活开发者,非华为开发者数量已超过华为开发者数量,当前日均新增合入代码超过3万行。
- 基于昇腾预训练模型已超过40个,是国内唯一支持预训练的AI算力平台。
- 昇腾不仅开源了CANN,还深度融入业界主流开源社区,与全球开发者共建共享。值得一提的是,从今年7月28日起,昇腾成为在PyTorch社区官方支持的首个中国算力平台。
他谈道,今天中国日均token约为500万亿,以一张卡2000token/s来推演,100万亿token满打满算需要578,700卡。考虑到实际使用过程中负载的波动,通常需要乘以1.3的系数,也就说日均100万亿token需要752,300卡的支撑,500万亿token大约是375万张卡。
这还只是智算部分,如果是整个Agentic Infra,100万亿token需要7万台通算服务器,也就是说日均500万亿token需要大约375万张AI计算卡和35万台通算服务器。
Agentic时代,算力变化不仅是规模上的变化,还会有互联和分布的变化。“超节点+集群”是Agentic Infra的必然路径,因为算力分布与互联方式决定了体验和企业生产效率。
华为相信未来先进的Agentic Infra是通算和智算在同一个机房,而且通算走向超节点,要满足多Agent交互所需的海量沙箱,而且是能够瞬间提供的海量沙箱。
通算与智算之间的互联协议非常重要。去年,华为发布灵衢互联协议,以避免协议在不同计算实体之间相互握手转换带来的开销。

Infra变化之后,编程与开发方式也会生变。朱照生从5个维度分享Agentic开发和计算的变化:
1、超节点软件通过原子化接口,为开发者提供极致开放自由度。
超节点软件为开发者提供全面同步和异步原子化开发接口。编码会面对两类的数据和计算:一类是离散高频次小块数据通信,通常采用Load/Store接口;另一类是连续的大块数据通信,更合适的方式是URMA异步通信。华为超节点对这些都定义了完备的接口。
华为超节点的内存语义和消息语义的使用,和大家已经熟悉的在单台计算机上使用的内存语义和消息语义是非常接近的,只需要提前做个配置。

朱照生预测,未来每个人拥有的Agent数量大概率会超过其拥有的手机数量。海量Agent爆发伴随着规模、响应时延和通信带宽的挑战,需要通算超节点来构建分布式共享内存池,来缓存所有沙箱镜像,这样才能够在秒级瞬间启动十万甚至上百万沙箱。
不只是Agent沙箱,在智算系统里,KV cache多级存储,包括搜索、推荐,一样可以利用通鲲鹏超节点来提升性能和收益,改善日常使用过程中的体验和生产效率。

2、从“进程”到“思程”,构建Agent思考和执行的基础单元。
过去计算机操作系统使用进程来管理和调度,实现整个系统资源的最佳应用和稳定运行。今天Agent运行是对一个目标不断去探寻最优解的过程,转向开放式“探索”,需要一个新的对象来运行和管理系统,为此,华为提出了思程ThinkProcess。
围绕思程,华为在两个空间提供了完备的状态和资源抽象能力:
(1)User space:在设备层面提供状态管理,通过思程的创建与退出、状态融合和回滚,能够让Agent保持思考状态,有利于回滚、评估和尝试不同路径,在不同分支里去探寻最优解。
(2)Kernel space:以负载感知和全局的资源管理为基础,支持通算与智算融合调度、共享异构内存,
华为把这些设备抽象成原子级接口来支撑Kernel space和User space的调用,让底层资源能围绕Agent的运行来进行协同的工作。无论是状态的管理,还是从CPU、内存、NPO等硬件资源的抽象,思程都提供了原子级API。思程将于今年年底对外开源。

最近半年,内存稀缺度超出想象,Agent爆发正好叠加内存上升周期。用鲲鹏来提升内存使用效率,只需两步,而且不需要修改应用的代码:
(1)精准识别冷热数据。鲲鹏处理器识别冷热数据的准确率超过99%,比其他处理器高出10个点,同时算力开销比其他处理器低10%。
(2)把识别出的冷热数据通过极快的压缩和换出,鲲鹏只需不到5%的算力开销,而业界超过20%。
用同样的内存容量,鲲鹏在沙箱场景内存超分比可提升30%,在数据库里检索性能可提升15%,在大数据场景里的内存需求量只有原来的75%。
右图是在某知名股份制银行里的大数据实践,应用了鲲鹏内存多元感知技术,实现在同样的业务负载下,每台服务器所需要的内存配置从原计划的512GB降到384GB。

3、Ascend C面向新架构持续升级,使能编程灵活性,持续提升产品性能。
Ascend C语言面向新架构全新升级,同时支持SIMD+SIMT混合编程模式,新增Regbase编程。SIMD+SIMT混合编程中,SIMD实现批量连续存储计算,SIMT实现非连续访存计算。Regbase编程将数据搬运和寄存器相关开发过程交给开发者控制,可减少数据搬运次数,提供更多灵活性,释放Vector计算资源。

华为去年宣布CANN开源开放,并提出要构建开放PTO虚拟指令集。从去年提出至今,截至本月,PTO虚拟指令集已形成覆盖基本运算类、通信类等8个分类的120多条虚拟指令,在昇腾CANN社区完全开放。
PTO虚拟指令集是面向Tile的指令,支持上层DSL适配和框架/算子跨代复用,基于Tile的指令类型丰富,提供了编译器自动化和手动模式优化,能更细腻地操控底层芯片硬件资源,简洁易上手,操作习惯、语法定义与开发者既有习惯一致。

4、持续贡献数据格式技术标准,打造低比特量化业界最佳实践。
面向Agentic时代,浮点数据格式非常重要,尤其是低级特征的训练和推理。
去年华为发布HiFloat8浮点数据格式,为开发者提供更大范围的浮点数值表达。HiFloat8过去一年的进展包括三个方面:
- 开发标准进展超预期,不仅已完成团标发布,还在今年8月完成国标立项。
- 已有超过100家的科技企业、高校及科研单位加入了华为HiFloat社区。
- 围绕主流模型的训练和推理,华为与社区成员单位一起完整的实现了从底层芯片、算子、训推框架、模型到应用全流程的开发和验证,所有的精度和性能都超预期。
HiFloat定制算子训练精度相比于BF16平均误差不到0.5%,但性能相比BF16提升了30%;同比同等位宽的MXFP8,同样精度情况下性能收益超过10%。
预计在未来几个月会有基于HiFloat8的模型推向市场。
更进一步,面向模型的创新,华为还提供了4bit浮点数据格式HiFloat4,可采用E6M2全局缩放因子和64个等效E1M2块内元素表示,实现4个点范围内更高精度的元素表达。
HiFloat4相比FP4有更大的动态表征范围,同时相比MXFP4有更高的数值精度,可获得更好的计算效率和计算稳定性,为探索更低比特的量化提供更优的浮点数据格式。

5、开发者旅程全链路Agentic覆盖,加速AI原生应用落地。
华为带来全流程Agent工具:
(1)CANNbot算子生成:自动生成算子,比如生成一个Vector类算子只需3小时,这在以前手写需要数天甚至一周的时间。
(2)Model Agent模型适配:适配链路自动编排,自动适配超10000个模型。
(3)MindStudio Agent精度调优:支持从集群到芯片的多级调优,提供小时级快速调优,帮助开发者可以快速定位和解决精度问题。
(4)Solution Agent行业部署:内置300多个部署方案,能在几分钟内实现最佳参数的寻优。

除了Agent开发,华为还优化了昇腾开源社区Infra的交付与开发体验。
近期华为用Agent实现了CI/CD自动验证,把过去需要人工盯守的构建和测试过程,用Agent实现,自动触发、自动构建,多线并行,把CI/CD时间控制在几分钟内。
过去issue和PR答复需要几天时间,今天用Agent,回答质量和审核质量和人类专家水平基本持平,实现了从代码编写到合入数据仓完整快速的闭环。

华为昇腾开源社区为开发者准备了万卡集群,提供两种使用机制:
1、用户注册后,按任务申请免费100卡时额度,作为基础算力开销。
2、积分换卡计划,每提交一个issue或PR,都能获得积分,然后用积分来换取更多卡时的支持。

面向开发者,鲲鹏/昇腾的生态资源投入,完整覆盖了能力筑基、持续创新、产业协同三个阶段。
未来三年,华为将投入50亿元来建设开源开放的算力新生态,与伙伴和开发者共同成长。

二、华为云:提出Agentic开发新范式,帮开发者快速构建先进智能体
华为云伙伴与生态部总裁康晓宇分享说,智能体降低了AI创新门槛,但距离生产级交付与行业纵深落地仍有差距。要解决开发者生产级交付难、业务结果落地难的困境,需要更强的智能体工具、更稳定的智能体运行平台和可用的行业资源。

对此,华为云提出针对Agentic时代的开发新范式:创新生产力 x 开放生态力。
创新生产力帮助开发者用好智能体工具,开发应用,构建智能体,并让它们稳定运行;开放生态力可连接行业知识、数据资产和市场机会,让智能体能够解决具体的行业难题。

华为云提供创新生产力,从“资源供给者”升级为“任务完成平台”,以稳健的创新底座Agentic Infra支撑智能体运行,以开放的工具作为创新引擎提升结果质量,再通过最佳实践的指引帮助创新加速,让开发成果真正可落地。

创新底座方面,华为云通过AgentArts开放Agent底层能力,减少重复搭建等基础工程的投入,让开发者能更稳健地上云用云。
AgentArts提供智能体开发能力、原子能力、部署和发布能力,可以帮助开发者将代码部署上云,这些能力既能被直接使用,又能融入开发者作业流程,通过华为云的智能体技术创新,提升任务成果的质量。

创新引擎方面,华为云Agent为开发者提供多种Agent生产力工具。
(1)华为云码道代码智能体:在鸿蒙开发场景升级,深度适配鸿蒙语法与开发范式,让开发更全面、稳定、准确和省力。
(2)华为云DocZip:开放多维文档能力, 包括基础文档能力、智能文档能力、生态能力,支持多种接入方式。开发者既可以选择集成完整的产品,又可选择按需调用模块化的能力,将其嵌入自有系统。
(3)华为云AI Shell:可帮助开发者自动完成部署发布智能体的工作,让代码一键安全部署上云。
创新加速方面,Hands-on最佳实践中心围绕AI云原生、鸿蒙、AI办公等方向,把开发、部署、测试、运维等一系列流程提炼成简易上手的实践路径,来支持开发者0门槛上手。
AI降低了开发门槛,但没有自动降低进入行业门槛。
华为云通过行业AI梦工厂、AI资产广场、云商店等平台,助力开发者用AI解决行业难题。

行业AI梦工厂已发布了7大专区、500多个价值资产,与头部伙伴共同识别价值场景,开放共创,共享行业模型及数据集,让大家率先走进行业。
AI资产广场今天正式发布。这是一个华为为开发者打造的一站式AI资产汇聚、分发、增值平台,大家既是资产贡献者,可在广场上快速上架AI资产,也是资产使用者,能快速找到合适的资产,免费试用后即刻投入开发创新。
好的行业应用需要一个好的分发和交易平台。云商店是华为云官方生态应用交易平台,已上架1200多款AI场景化应用,覆盖十几个垂直行业,让从上架、推广到交易全流程都更加省心和安全。

面向广大的伙伴和开发者,华为云以构建AI解决方案为核心,围绕加入成长、构建方案、上市增长等全流程,开放了50多项权益资源,涵盖培训、技术、市场、业务四大维度,助力其伙伴构建企业级AI创新解决方案。
三、鸿蒙OS:向Agent架构演进,实现三大升级
华为终端云服务开发者服务与平台部部长卢鑫刚分享了鸿蒙生态发展的最新进展。
鸿蒙已成为世界第三大手机操作系统,中国主流互联网应用、政务和民生应用已实现鸿蒙化,已有超过40万个可获取应用和服务、日均应用下载量超过2亿个、注册开发者超过1100万人、开发者关键API调用量达到3000亿次/天。

今年9月7日,华为发布HarmonyOS 7商用版本。该操作系统实现三大升级:一是Agent亲和系统架构,底层采用端云协同大模型架构,可实现灵活的算力调度;二是鸿蒙智能体框架2.0,以Skill方式开放更多系统能力,支持更丰富的接入方式;三是系统智能体小艺,要实现更聪明更懂用户,把小艺的能力与操作系统深度融合,成为系统智能中枢。

华为开放了更多场景化的地图Skill集,提供更丰富的图层能力、更智能的体验、更便捷的接入。

为了让设备实现更好的互联互通,HarmonyOS 7升级了鸿蒙星河互联技术,使多路并发聚合速率达到250MB/s,设备间建立连接的时间缩短至几百毫秒,并支持与iOS等第三方操作系统的互联互通。

基于空间计算,用户可获得更佳沉浸式的体验。

卢鑫刚还介绍了几款重要的开发者工具:
(1)小艺开放平台:一站式极简开发Skill和Agent,一键发布真机测试。
(2)DevEco Code和DevEco CLI:前者是鸿蒙编程智能体,实现开箱即用,从0到1开发更轻松;后者针对已有编程智能体,可一键把华为在鸿蒙上的一些底层命令行工具一键式接入。
(3)HarmonyOS开发助手:围绕开发者全生命周期旅程,提供场景化AI开发辅助测试工具。

在故障定位领域,华为正在构建故障模式库,以及基于AI的故障定位定界能力。

结语:让算力可供,让工具易用,让应用增值
今年随着Agent爆发,从算力基础设施、云计算到终端操作系统,都在被Agentic AI开发新范式重新定义。
底层算力基座需将通算与智算下成一盘棋,华为用超节点、统一互联协议、分布式共享内存、低精度推理等创新策略来为新一代智算中心打样。
在云计算领域,华为则深入企业级AI刚需,考虑到Agent实际落地需要兼顾的全流程环节,并用Agent接管一些过去依赖人类工程师的耗时环节,帮开发者不止降低开发门槛,也降低在行业中落地的门槛。
在终端软件生态中,Agent和Skill都变成了可上架、可试用、可分成的数字资产。
所有这些优化升级,最终都指向智能体在真实场景里交付结果的能力。







