阿里开放Qwen3.8-2.4T-A95B模型权重:2.4T MoE旗舰首次开源,原生256K上下文

2026-08-13 15:31:08   |   文白不白   |   3847

8月13日,阿里云“魔搭 ModelScope 社区”昨日深夜宣布,阿里 Qwen 团队正式开放 Qwen3.8-2.4T-A95B 模型权重。这是 Qwen-Max 级别模型首次开源,开发者可免费下载并进行二次开发。

该模型总参数达 2.4T(2.4万亿),采用 MoE 稀疏架构,每个 Token 仅激活 95B 参数,在保证模型容量的同时显著降低推理成本。模型每层包含 512 个专家,每个 Token 选择 10 个路由专家并同时激活 1 个共享专家。上下文方面,原生支持 262,144 Token,可扩展至 1,010,000 Token,并进行了多步 MTP(Multi-Token Prediction)训练。经 Unsloth AI 量化压缩后,模型可压缩至约 397GB,在总 RAM+VRAM 超 410GB 的设备上即可本地运行。

Qwen3.8 延续 Qwen3.5 的混合架构,重点提升编程、办公、科研和长周期 Agent 任务的端到端完成能力。官方公布的评测覆盖编程 Agent、通用 Agent、专业工作和长上下文等方向,与 Opus 4.8、Fable 5、GPT 5.6 Sol 等模型相比互有高低。值得注意的是,Qwen3.8-Max 默认运行在思考模式(thinking mode)下,在生成最终回复前会先输出思考内容,且开源版本不支持关闭此模式。

此次开源是阿里大模型开源战略的重大升级——从中小模型延伸至旗舰级模型。开发者可基于该模型进行微调、二次开发和本地部署,云端版 Qwen3.8-Max 则在开放权重基础上增加了更多生产环境能力。模型已在ModelScope和Hugging Face同步上线,开发者可通过 SGLang、vLLM 等推理引擎部署使用。

特别提醒:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其原创性以及文中陈述文字和内容未经本站证实,对本文以及其中全部或者部分内容、文字、图片等内容的真实性、完整性、及时性本站不作任何保证或承诺,请自行核实相关内容。本站不承担此类作品侵权行为的直接责任及连带责任。如若本网有任何内容侵犯您的权益,请及时发送相关信息至bireading@163.com,本站将会在48小时内处理完毕。

阿里开放Qwen3.8-2.4T-A95B模型权重:2.4T MoE旗舰首次开源,原生256K上下文

2026-08-13 15:31:08 浏览量: 3847 作者: 文白不白

8月13日,阿里云“魔搭 ModelScope 社区”昨日深夜宣布,阿里 Qwen 团队正式开放 Qwen3.8-2.4T-A95B 模型权重。这是 Qwen-Max 级别模型首次开源,开发者可免费下载并进行二次开发。

该模型总参数达 2.4T(2.4万亿),采用 MoE 稀疏架构,每个 Token 仅激活 95B 参数,在保证模型容量的同时显著降低推理成本。模型每层包含 512 个专家,每个 Token 选择 10 个路由专家并同时激活 1 个共享专家。上下文方面,原生支持 262,144 Token,可扩展至 1,010,000 Token,并进行了多步 MTP(Multi-Token Prediction)训练。经 Unsloth AI 量化压缩后,模型可压缩至约 397GB,在总 RAM+VRAM 超 410GB 的设备上即可本地运行。

Qwen3.8 延续 Qwen3.5 的混合架构,重点提升编程、办公、科研和长周期 Agent 任务的端到端完成能力。官方公布的评测覆盖编程 Agent、通用 Agent、专业工作和长上下文等方向,与 Opus 4.8、Fable 5、GPT 5.6 Sol 等模型相比互有高低。值得注意的是,Qwen3.8-Max 默认运行在思考模式(thinking mode)下,在生成最终回复前会先输出思考内容,且开源版本不支持关闭此模式。

此次开源是阿里大模型开源战略的重大升级——从中小模型延伸至旗舰级模型。开发者可基于该模型进行微调、二次开发和本地部署,云端版 Qwen3.8-Max 则在开放权重基础上增加了更多生产环境能力。模型已在ModelScope和Hugging Face同步上线,开发者可通过 SGLang、vLLM 等推理引擎部署使用。

,

Copyright ©2018 铋读网 All Rights Reserved.

京ICP备18051707号

京公网安备 11011302001633号