当前位置: 首页 » 资讯 » 科技头条 » 正文

阿里全球数据中心规模将超过20GW,阿里公布大模型、芯片、云最新计划

IP属地 中国·北京 编辑:顾雨柔 时间:2026-09-22 16:04:03

出品/未来科技界

编辑/薛向

吴泳铭:未来机器思考的总量将达到人类的1000倍以上

吴泳铭认为机器正在成为思考的主力,智能正在成为一种规模化的商品,未来机器思考总量将达到人类的1000倍以上。上一次这样的变化,是工业革命把“动力”变成了规模化的商品。人类先后发明蒸汽机、内燃机和电,并建立起现代产业。

但是,机器智能时代的代表性产品还没有出现。今天的AI Coding就像1882年的电灯,替代的是现有工作,还不足以创造一个新的时代。帮人编程、写报告,只是机器智能的初级阶段。当机器智能的供给变得无限充沛,它对人类社会的意义,将远远超出对现有脑力劳动的替代。这种变化将比工业革命更加深刻。

像电气时代一样,后续还会出现空调、洗衣机、冰箱等各类新产品和新发明。但无论后来出现多少新发明,第一步都要建足够多的发电站、铺足够广的电网。1900年前后,很多电器已经开始进入家庭生活,但当时全世界一整年的发电量,放到今天,只够用两个小时。

机器智能时代同样需要强大的基础设施。吴泳铭表示,机器智能时代的三大基石是AI模型、AI芯片和AI云,这是机器思考能够规模化供给的前提。

围绕三大基石,阿里公布了AI模型、AI芯片、AI云三个方面的最新进展与目标。

第一,AI模型:Qwen团队在递归式自我改进RSI方面取得进展,未来模型将扩展至5-10T参数规模,目标是能够完成更复杂、更长程的任务,向ASI迈进。

第二,AI芯片:平头哥发布最强国产AI芯片真武V900。

第三,AI云:当目标是到2032年阿里云运营的全球数据中心规模超过20GW。

Qwen4.5、Qwen5均在稳步推进中

大会现场,阿里系统展示了千问大模型自我进化的最新探索成果。

在模型自我训练上,Qwen3.8-Max通过自主搭建训练流程、构造训练数据,并自主设计实验、定位缺陷,在人类完全“零参与”的情况下持续迭代超1个月,完成33轮有效迭代。基于RSI、后训练等系列技术联合优化,Qwen3.8-Max新版本在Artificial Analysis上的得分从40涨至45分,与Claude、GPT最强模型同处第一阵营,领先于GLM5.3、Kimi-K3等所有国产模型。

在推理优化上,Qwen3.8-Max在从未见过的平头哥新款GPU上,自主适配优化了下代架构的Qwen3.8-Flash新模型的推理框架,实现单实例推理吞吐量提升 96%。

在芯片模型协同设计上,Qwen3.8-Max仅基于一份真实的总线模块规范,自主展开前端、验证、后端的全链路自迭代,在自主运行超60小时、调用EDA工具超万次后,完成了减少42%面积的物理实现优化。

在架构优化方面,Qwen3.8-Flash提前开源下一代千问大模型架构,通过注意力机制和模型内信息传递机制等核心技术创新,在实现前沿模型性能的同时,训练成本骤降近90%;同时依托于极少的参数激活,将推理计算效率推至全新的帕累托前沿,成为行业性价比“斩杀线”模型。

在模态扩充方面,全模态模型Qwen3.8-Omni正式亮相,将音视频等不同模态高效纳入统一理解框架中,为大模型开辟全新的思考分区。

在参数扩展方面,参数越大依然能带来更强的性能,未来千问大模型总参数量将扩展至5万亿甚至10万亿的规模。这些技术创新将成为新一代千问大模型的基石,据介绍,Qwen4模型正采用全新架构展开训练,Qwen4.5、Qwen5均在稳步推进中。

全新视频生成模型拟11月发布

在最富创意的视觉生成领域,图像生成模型Qwen-Image-3.1亮相,它面向电商、创意、设计等真实商用场景全新优化升级,将原本数小时的视觉设计压缩至秒级交付,水准堪比专业设计师,还支持图像精准编辑。

音乐生成模型Happy Shrimp 1.1 版本发布,在音乐表现、人声质量、多语种演唱及指令理解四个专业维度进一步提升,支持百余种曲风与十余种主流语言,覆盖人声歌曲与纯音乐两大生成场景。

世界模型最新版本HappyOyster 2.0 Preview亮相,通过对模型架构、训练方法和数据体系的全面升级,显著提升了智能实时交互、记忆能力、实时响应、物理规律遵循等核心能力,让世界模型真正从实验室走向真实可用。

全新的下一代视频生成模型也将于11月发布,朝着更长、更可控、更完整、更智能的方向演进:在更长的时间里,新模型仍然能保持一致性,创作者可精准掌控人物、场景与镜头;同时,模型能具备导演级的创作思维,从生成单个镜头迈向理解完整叙事。

Qwen模型也在手机、AI眼镜、桌面机器人等硬件领域落地。

语音模型家族Qwen-Audio-3.1全新升级,包含语音转写(ASR)、语音合成(TTS)和实时语音交互(Realtime)三大系列。

未来科技界了解到,Qwen-Audio-3.1-ASR-Next能够理解人物情绪、音乐、环境声与机械声,完成声音描述、事件定位、音频问答与推理,让“这段录音中人的情绪怎样”这样的问题能够被理解和准确回答。同时可根据一段脚本,直接生成融合对白和环境声的完整音频,极大提高有声书、影视剧和播客等专业创作的效率。

Qwen-Audio-3.1-Realtime实时交互能力再提升,能够边听、边想、边说,并进一步增强多语言交互、角色扮演和共情能力。目前,该系列模型已应用于千问办公和Qoder,并接入QwenNote A2随身助理、QwenNote Eva桌面机器人和千问AI眼镜等硬件产品。

此外,同声传译模型Qwen3.8-LiveTranslate首次登场,人类同传平均时延在4秒以上,但该模型可将时延压缩至不到2.5秒。据了解,新模型已接入千问AI眼镜、QwenNote A2、钉钉耳机等AI硬件。

另外,阿里大模型也在加速走向终端。AI手机全栈解决方案Qwen Intelligence发布,专为手机场景深度优化,为合作伙伴提供基于千问大模型的 Agent 技术平台,让手机能够更可靠地完成跨应用的复杂任务。

真武V900芯片发布

平头哥发布新一代训推一体AI芯片真武V900,性能是真武M890的三倍,这是目前算力性能最强的中国自研AI芯片,可满足万亿级参数大模型的训练和推理需求。该芯片将于2027年第一季度量产售卖。

真武V900基于自研并行计算架构设计,搭载216GB大容量显存,片间互联带宽达1200GB/s,单芯片性能是真武M890的3倍。该芯片原生支持FP8、FP4低精度计算,在大幅提升算力密度的同时显著降低推理成本,可应用于高精度训练、低精度和超低精度推理的全场景。

免责声明:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其内容真实性、完整性不作任何保证或承诺。如若本网有任何内容侵犯您的权益,请及时联系我们,本站将会在24小时内处理完毕。