撰文 | 李信马
题图 | DoNews摄
“今天,机器思考的总量,大概不到人类的3%。”
2026云栖大会的主论坛上,阿里巴巴集团CEO吴泳铭给出了一个推算:未来机器供给的思考总量,将是人类思考总量的1000倍以上。按此推算,机器思考至少还有几万倍的增长空间,若按他的算法,这几乎就是 AI 行业未来的市场增长空间。
“无论后来出现多少新发明,第一步都要建足够多的发电站、铺足够广的电网。1900年前后,很多电器已经开始进入家庭生活,但当时全世界一整年的发电量,放到今天,只够用两个小时。”由此,吴泳铭把AI模型、AI芯片和AI云称为机器智能时代的三大基石,称其是机器思考能够规模化供给的前提,也是阿里巴巴的长期战略选择。
过去三天,阿里在这三件事上分别公布了自己的答案。
01、模型:Qwen要做得更大更全
在吴泳铭的表述里,模型负责的是“造顶级聪明、可自进化的大脑”,而通往超级智能的具体路径是递归式自我改进,简称RSI。模型从真实反馈中发现自己的短板,自己设计实验、构建数据、评价结果,循环推动模型自身的进化。
Qwen3.8-Max就是在人类完全“零参与”的情况下,通过自主搭建训练流程、构造训练数据,并自主设计实验、定位缺陷,持续迭代超过1个月,完成33轮有效迭代。基于RSI、后训练等系列技术的联合优化,新版本在Artificial Analysis上的得分从40分涨至45分,与Claude、GPT最强模型同处第一阵营,领先于GLM5.3、Kimi-K3等所有国产模型。
更值得注意的是,这套自我改进能力已经溢出到训练之外。在推理优化上,Qwen3.8-Max在一款从未见过的平头哥新款GPU上,自主适配并优化了下代架构Qwen3.8-Flash新模型的推理框架,实现单实例推理吞吐量提升96%。
在芯片模型协同设计上,它仅基于一份真实的总线模块规范,自主展开前端、验证、后端的全链路自迭代,在自主运行超60小时、调用EDA工具超万次之后,完成了减少42%面积的物理实现优化。
参数规模上,阿里巴巴给出的答案是继续放大。基于新一代架构的Qwen4已投入训练,Qwen4.5、Qwen5等后续版本计划扩展至5-10T参数规模,“目标是能够完成更复杂、更长程的任务,向ASI迈进”。
而Qwen3.8-Flash已经提前开源了下一代千问大模型的架构,通过注意力机制和模型内信息传递机制等核心技术创新,在实现前沿模型性能的同时,把训练成本骤降近90%;同时依托极少的参数激活,将推理计算效率推至全新的帕累托前沿。
另一条线是多模态。吴泳铭认为“一个足够聪明的大脑还不够”,AI还需要掌握感知和交互能力,像人一样理解声音、图像、表情和动作,对齐人类的文化、审美和价值观。本届大会上,全模态模型Qwen3.8-Omni正式亮相,语音模型家族Qwen-Audio-3.1在语音转写、语音合成和实时语音交互三条线上全面升级,同声传译模型Qwen3.8-LiveTranslate把字均延迟从2.8秒压到2.3秒,而人类同传的平均时延在4秒以上。
视觉侧,图像生成模型Qwen-Image-3.1把原本数小时的视觉设计压缩至秒级交付,音乐模型Happy Shrimp 1.1支持百余种曲风与十余种主流语言,世界模型HappyOyster 2.0 Preview提升了智能实时交互、记忆能力、实时响应与物理规律遵循,视频生成模型Wan3.0拿下Artificial Analysis文生视频与视频编辑双榜第一,全新的下一代视频模型将于11月发布。
开放是另一条主线。截至目前,阿里已开源460余个Qwen大模型,下载量突破30亿次,衍生模型超30万个,是全球第一开源模型家族。9月16日,在全球最大的AI开源社区Hugging Face的最受欢迎开源大模型榜单上,Qwen3.8-27B超越DeepSeek-R1、Meta-Llama3.1等热门模型,成为该平台历史上最受欢迎的开源大模型。
02、芯片:真武V900带来三倍算力
“如果说Token是AI时代的电,芯片就是发电机。”
吴泳铭的这句话,解释了芯片在三大基石里的位置,未来机器智能时代对Token的需求几乎没有上限,芯片要不断提高性能、扩大供给。截至目前,平头哥已经推出了真武系列AI芯片、倚天系列服务器CPU、磐脉系列智能网卡、ICN Switch互联芯片和镇岳系列存储主控芯片,组建超大规模AI集群所需的核心芯片已全面覆盖,实现算力、网力和存力的全栈自研。
本届云栖大会上发布的新一代训推一体AI芯片真武V900,是目前算力性能最强的中国自研AI芯片,单芯片性能是真武M890的3倍,搭载216GB显存,片间互联带宽达1200GB/s,原生支持FP8、FP4低精度计算,可满足万亿级参数大模型的训练与推理需求,计划于2027年第一季度量产,并在阿里云数据中心规模化部署。
而真武V900通过自研ICN Switch互联芯片连接后的超节点,具备原生内存语义和内存统一编址能力,可实现千卡全带宽高速互联,上千颗真武V900能像一颗“超级芯片”一样协同工作。据了解,现场发布的全新升级超节点服务器,单一集群可扩展至50万卡规模。此前,阿里自研的M890 AI超节点已成功支撑超过2万亿参数大模型的高效推理,本季度起阿里云已经开始规模化上架。
吴泳铭也表示:“由于平头哥芯片产品线的成熟和客户的广泛应用,平头哥AI芯片的年出货量将大幅提升。”
平头哥还首次公布倚天服务器CPU的规划:2027年推出倚天720和倚天730两代产品,其中倚天730将首次基于平头哥全自研CPU微架构设计,单核SPECint2017/GHz性能最高提升至倚天710的1.4倍;2029年将推出采用第二代自研核的倚天750,支持通过自研ICN总线与真武AI芯片直接互联,进一步提升CPU与AI芯片的协同效率。
03、AI云:一张更大的网
在三大基石里,云的角色被吴泳铭定义为就像电网一样“把Token送到每一个需要它的地方”。模型需要持续训练和推理,Agent需要长时间执行任务,AI开发的软件也会越来越多,“它们都会成为云上的‘居民’,持续调用算力”。
所以,云这张大网,要变得更大,才能满足全世界对算力旺盛的需求。作为首个国产十万卡云上超节点集群,阿里云灵骏真武M890超节点继乌兰察布首批开服后,今年第四季度将在宁夏中卫地域新增灵骏真武M890超节点服务。明年,阿里云还将推出的灵骏真武V900超节点,性能提升三倍,搭载业界首发的200Pbps通信带宽和6us时延集群架构,自研SNPO支持全光互联,支持千卡Scale-Up互连,单集群可扩展至50万卡规模,向广域超节点演进。
全球范围内,阿里云还宣布了新一轮基础设施扩建计划:未来12个月,将在土耳其、芬兰和荷兰首次设立云计算地域节点,并扩建马来西亚、德国、阿联酋、法国和中国香港的数据中心,进一步提升全球算力供给和本地化云与AI服务能力。
目前,阿里云已在全球31个地域运营107个可用区,拥有3200多个边缘节点;新一代AI数据中心最快可实现100天交付,单机柜计算密度达到传统数据中心的5-10倍。按照计划,到2032年,阿里云运营的全球数据中心规模超过20GW。
“阿里巴巴将与所有合作伙伴一起,全力投入AI基础设施建设,打造一朵面向‘机器智能’时代的AI云。”吴泳铭说。








