阿里开源最强旗舰:Qwen3.8-Max发布,2.4万亿参数下周开放权重
8月5日,据报道,近日阿里巴巴正式发布新一代基座大模型Qwen3.8-Max。该模型总参数量达2.4万亿,采用稀疏混合专家(MoE)架构,单次仅激活约950亿参数,在保持旗舰级“脑容量”的同时兼顾极低推理延迟。模型支持最长100万Token上下文窗口,原生具备多模态视觉能力,官方宣称其综合表现已进入全球大模型第一梯队。
此次发布的最大突破并非仅在于技术指标,而是阿里的商业策略出现了根本性转向——Qwen3.8-Max是Qwen-Max级别旗舰模型的首次对外开源,预计下周正式公布权重。此前阿里Qwen Max系列始终定位为闭源旗舰,仅支持API调用,用户无法下载权重。这一调整背后,是以DeepSeek为代表的国产开源模型证明了开源与低成本足以独立切开市场空间。
阿里Qwen系列自2023年推出以来,多款模型相继开源,但Max系列始终保留为闭源产品。DeepSeek V4 Flash以性能与低价优势引发大规模调用后,业界开始重新评估开源模式的商业价值:开源虽会稀释API收入,但能降低采用门槛、扩大海外覆盖、促进跨多云和异构硬件部署,而有能力的开源替代方案会让闭源模型提供商很难维持高API定价。
阿里巴巴集团主席蔡崇信此前将AI开源企业划分为两类:一类是纯模型开发企业,面临直接从开源模型变现的挑战;另一类是阿里及Google等全栈科技企业,涵盖云基础设施、基础模型到应用层,可通过销售云计算服务在其他技术层捕捉价值。开源让阿里不必将所有利润压力压在API定价上。
Qwen3.8-Max在定价上展现出明显竞争力。每百万输出Token成本约6美元,而此前业内标杆模型(如Fable 5)成本高达50美元。在单次对话中,几美元差距或许可以忽略;但在反复调用工具、输出长程代码、接收反馈并不断试错的Agent作业中,这种数倍的边际成本差将直接决定商业模型能否持续。
阿里实现成本降低的路径不仅依赖MoE架构等模型层优化,还具备软硬件协同的算力生态基础——旗下芯片公司平头哥自研AI芯片、CPU、网卡等全栈组件。7月,阿里云宣布灵骏真武M890超节点已成功适配Qwen3.8并上线百炼平台,这是国内首个成功运行超2万亿参数大模型的超节点。
业界分析认为,Qwen3.8-Max的发布与DeepSeek等国产力量形成战略互补。前者提供高可控、强视觉、长上下文的多模态Agent基座,后者以极低算力消耗与高性价比占据推理层。值得注意的是,海外开源社区OpenCode同日发文称DeepSeek V4 Flash因访问量空前出现容量不足问题。这暴露了算力生态短板——而这正是阿里云作为全栈厂商的优势所在。
中国开源模型在推理效率与架构优化上的突破,正引导全球中小型企业将底层AI基建全面转向开源生态。Qwen3.8-Max的开源,标志着国产旗舰模型正在以两种路径并行突围:算法极致优化与全栈算力生态。