阿里开源2.4万亿参数模型Qwen3.8-2.4T-A95B:Max级权重首次开放,激活参数仅95B

· 科技资讯

今天发生了什么

8 月 12 日深夜,阿里云魔搭 ModelScope 公众号宣布:Qwen 团队正式开放 Qwen3.8-2.4T-A95B 模型权重。这是阿里第一次把 Qwen-Max 级别的”压箱底”模型开源——总参数 2.4 万亿(2.4T),每个 Token 只激活 95B 参数,原生支持 262,144 Token 上下文,还能扩展到 101 万 Token。消息一出,HN 热榜和开发者群立刻刷屏。

阿里开源2.4万亿参数模型Qwen3.8-2.4T-A95B:Max级权重首次开放,激活参数仅95B封面

为什么这是行业地震

过去一年,开源大模型的主力是 30B~100B 级别,头部闭源模型(如 Opus 4.8、GPT 5.6 Sol、Fable 5)才敢做到万亿参数。阿里这次直接把 2.4T 权重扔出来,等于说:“你们卷的开源上限,是我 Max 级的起点。” 官方评测显示,Qwen3.8 在编程 Agent、通用 Agent、专业工作、长上下文四个方向与顶级闭源模型互有高低,在 PaperBench、IFBench 等榜单还拿到了较高分——开源与闭源的性能差距,被一家中国厂商再次压缩。

技术细节:怎么做到”又大又省”

Qwen3.8-2.4T-A95B 是混合专家(MoE)架构:每个 MoE 层有 512 个专家,每个 Token 只激活 10 个路由专家加 1 个共享专家,所以总参数量吓人、实际算力消耗可控。模型还做了多步预测(MTP)训练,支持推理引擎一次预测多个后续 Token,生成速度更快。官方称 Qwen3.8 延续 Qwen3.5 的混合架构,重点提升编程、办公、科研和长周期 Agent 任务的端到端完成能力;云端版 Qwen3.8-Max 就基于这份开放权重,再加生产环境能力。

谁该关注,谁可以忽略

开发者和研究者:这是第一份可自由微调的 Max 级权重,做 Agent 工作流、长上下文应用的团队可以认真研究。下载走 ModelScope(`modelscope.cn/models/Qwen/Qwen3.8-2.4T-A95B`),配套博客在 qwen.ai。

想自己部署的普通用户:先冷静——2.4T 总参数、激活 95B 意味着推理显存至少要 200GB 量级(FP8 下),个人电脑跑不动。想体验直接用 Qwen Studio 或 API。

企业用户:私有化部署大型模型有了新选项,但要先算清 GPU 成本,别被”开源免费”误导。

开源为什么是”地震”不是”发布”

开源权重和开放 API 是两回事:API 是”租算力”,权重是”送资产”。拿到 2.4T 权重,意味着企业可以在私有环境微调、蒸馏、做专属 Agent,数据不出门;研究者可以复现训练细节,把模型当研究样本拆解。对阿里来说,这是一次豪赌——把 Max 级的核心资产公开,短期让竞争对手也能”站在同一地基上”,长期换来的是生态话语权和行业标准定义权。历史上 Llama 开源引爆了整个开源社区,Qwen 这次的动作,很可能就是中国版 Llama 时刻。

三个值得盯的信号

第一,生态适配:vLLM、SGLang 等推理引擎多快支持 2.4T MoE,决定落地速度。第二,阿里云定价:Qwen3.8-Max API 怎么定价,直接冲击国产 API 市场。第三,其他厂商反应:字节、百度、腾讯会不会跟进开源更大模型——开源军备竞赛正式进入”万亿参数”阶段。

一句话结论

阿里开源的不只是一个模型,而是给”开源上限”重新画了一条线:万亿参数、超大上下文、Max 级能力,现在都在社区手上了。至于跑不跑得动,那是另一回事——先收藏,再慢慢研究。

🔥 关注LC智趣厅,AI 行业大事第一时间解读

👇 点赞转发,让更多关注 AI 的朋友看到


— END —
LC 智趣厅 · 科技与生活的交点
ihygg.cn

Scroll to Top
微信公众号:LC智趣厅

扫码关注微信公众号
LC智趣厅