
(作者/于雷)8月3日,阿里云千问团队正式发布Qwen 3.8-Max大模型,其参数规模达到2.4万亿(激活参数95B),主打编程、办公、科研及长程任务的端到端交付能力,并宣布将于下周开源权重。作为目前Qwen家族中最为强大的模型,Qwen 3.8-Max基于Qwen 3.5架构打造,目前已在千问AI平台上线并提供API服务,同时这也是Qwen-Max级别模型首次面向社会开放开源权重。

在实际应用与性能表现上,Qwen 3.8-Max展现了多项突破性的长程任务与复杂工程能力。在自动化编程测试中,模型在无人工干预的情况下独立运行16天,完成了oh-my-cli项目的自动建构与自进化 harness 搭建,并在GitHub上产出了265次代码提交(commits)。在科研与竞赛场景中,该模型连续自主工作约125小时,成功复现了AI Reasoning相关论文并进行了四轮自我进化探索,使其在AIME24基准测试中的得分再提升2.7分;此外,模型还在阿里云天池平台举办的WWW2025多模态对话意图识别挑战赛中,于24小时内击败了458支人类参赛队伍。

面向企业办公与产业落地,Qwen 3.8-Max通过扩展强化学习系统,实现了跨领域通用能力的提升。在针对法律、UI设计、餐饮、结构工程及体育数据分析等数百种职业场景的实测中,模型展现出显著的提效能力:例如在法务审查中一小时内完成数百份文档1,284条条款的标出,以及在量化投资领域调度约330个子智能体完成约6,000次因子回测。在长周期复杂系统任务中,模型在芯片设计沙箱内历经约500轮交互将硬件门数由8,298门精简至678门,并在365天长周期电商经营模拟基准E-Commerce Bench中以416,252元(4.16倍回报)的总资金成绩取得第一。同时,模型还融合了多模态视觉反馈与GUI交互能力,推出了针对多模态Agent的扩展库Qwen-MM-Plugins,推动多模态智能体向复杂任务的端到端执行迈进。





京公网安备 11011402013531号