阿里巴巴CEO吴泳铭在云栖大会上宣布,公司计划训练参数规模达5万亿至10万亿的AI模型,并发布专为满足该算力需求设计的全新AI加速器。

该模型预计归属于通义千问(Qwen)系列。目前Qwen 4正在训练中,后续的Qwen 4.5及Qwen 5系列参数规模将达5万亿至10万亿,约为当前旗舰模型Qwen 3.8 Max(2.4万亿参数)的两到四倍。吴泳铭指出,团队正优化模型架构与数据,以支持更复杂、长周期的任务,并在递归自我改进方面取得进展,使模型能识别自身局限、设计实验并生成数据以提升性能。

自研芯片与算力基建

阿里巴巴平头哥半导体部门同步推出下一代AI芯片玄铁V900。该芯片性能是前代M890的三倍,可部署于多达50万颗芯片的集群中,用于前沿模型的训练与推理,计划于2027年第一季度量产商用。此举是阿里构建本土AI计算栈战略的一部分,旨在应对获取先进英伟达处理器的限制。

基础设施方面,阿里云计划到2032年将全球数据中心容量提升至超过20GW。吴泳铭表示,基于M890的AI超节点已能执行超过2万亿参数模型的推理任务,全球仅有少数企业具备此项能力。此前演示显示,运行在M890上的Qwen3.7-Max曾持续工作35小时并完成超1000次工具调用,M890云端部署也已用于运行Qwen3.8-Max和Kimi K3等超2万亿参数模型。