阿里巴巴发布 Qwen3.8-Max 大模型,2.4 万亿参数对标月之暗面
阿里巴巴推出迄今最强 AI 模型 Qwen3.8-Max,拥有 2.4 万亿参数,采用混合专家架构(MoE)降低推理成本。该模型在 Arena.AI 平台成为中国排名最高的文本模型,在多模态视觉任务中全球排名第二,仅次于 Anthropic 的 Claude。模型支持百万 token 上下文窗口,将于下周通过阿里云模型工作室平台发布。

阿里巴巴发布史上最强模型,参数规模直追月之暗面
阿里巴巴于本周一发布了其迄今为止规模最大、能力最强的人工智能模型 Qwen3.8-Max。这款模型拥有 2.4 万亿参数,与国内竞争对手月之暗面(Moonshot AI)上月发布的 Kimi K3(2.8 万亿参数)规模相当接近。
参数是模型从数据中学习的数值设置,用于识别模式、生成答案和执行任务。虽然更高的参数量不一定直接等同于更好的性能,但它已成为衡量先进 AI 系统背后计算和数据规模的关键指标。中国科技公司通常热衷于公开参数量,以帮助其模型在开发者社区中获得关注——这与 OpenAI、Anthropic 和 Google 等不公开闭源模型参数的做法形成鲜明对比。
技术亮点:混合专家架构降低成本
Qwen3.8-Max 采用了 "混合专家"(Mixture-of-Experts, MoE) 架构设计。这种设计将工作分配给系统中的专业化部分,而不是为每个请求激活整个模型。据阿里巴巴介绍,该模型每次实际仅使用 950 亿参数,这大幅降低了运行成本和响应延迟。
在实际应用测试中,该模型在 16 天内完成了一个软件工程项目,展示了其在复杂任务中的实用性。
多模态能力与超长上下文支持
Qwen3.8-Max 和月之暗面的 Kimi K3 均支持 文本、图像和视频 处理,并能一次处理多达 100 万个 token。Token 是数据块(通常是单词的一部分或短单词),如此大的上下文窗口意味着模型可以一次性处理大量材料,例如长篇法律文件、大型软件代码库或数百页文档。
第三方平台排名表现亮眼
Qwen3.8-Max 在众包模型比较平台 Arena.AI 上首次亮相,立即成为 中国排名最高的文本模型。不过在全球排名中,它仍落后于 Anthropic 的 Claude Sonnet 5(原文为 Fable 5,疑为 Sonnet 5 误译)和三个 Opus 变体。
但在 Arena.AI 的 视觉材料分析模型排行榜 上,Qwen3.8-Max 排名 全球第二,仅次于 Claude Sonnet 5 的一个变体。这一成绩显示阿里在多模态能力上已具备国际竞争力。
中国大模型的开源策略
中国科技公司在全球开放权重(open-weight)AI 模型领域是一支重要力量。开放权重意味着允许开发者下载模型的底层学习设置,以便运行或调整系统。这与 OpenAI、Anthropic 等公司的闭源策略形成鲜明对比。
业内普遍认为,中国厂商通过开放权重模型争夺开发者生态,试图在激烈且快速变化的竞争中构建更强大的系统,同时避免运行成本过高的问题。
发布计划
Qwen3.8-Max 计划于 下周 通过阿里云的 Model Studio 平台 正式发布。届时开发者和企业用户将能够通过该平台访问和部署这一模型。
适合谁关注? 对大模型技术架构、中国 AI 竞争格局、多模态能力发展感兴趣的从业者和研究人员;需要处理超长文档或复杂视觉任务的企业开发者。
本文基于 GNews:Devdiscourse 报道, 由 AiDuo123 AI 编辑翻译改写。原文链接: https://www.devdiscourse.com/article/technology/3958630-alibaba-unveils-its-most-capable-ai-model-to-date-not-far-behind-moonshots-in-size
常见问题
- Qwen3.8-Max 的 2.4 万亿参数是什么意思?实际使用时真的需要这么多吗?
- 参数是模型从训练数据中学习的数值设置,用于识别模式和生成答案。2.4 万亿是模型的总参数规模,但 Qwen3.8-Max 采用混合专家(MoE)架构,实际推理时仅激活 950 亿参数,这样既保持了大模型的能力,又大幅降低了运行成本和响应延迟。这是目前大模型降本增效的主流技术路线之一。
- Qwen3.8-Max 与月之暗面 Kimi K3 相比有什么区别?
- 从原文披露的信息看,Kimi K3 参数量为 2.8 万亿,略高于 Qwen3.8-Max 的 2.4 万亿。两者都支持文本、图像、视频处理,并具备 100 万 token 的上下文窗口。但 Qwen3.8-Max 在 Arena.AI 平台的视觉任务排名上表现更突出(全球第二),具体性能差异需要等待更详细的技术报告或实测对比。
- 这个模型什么时候能用?普通开发者可以免费使用吗?
- 根据原文,Qwen3.8-Max 将于下周通过阿里云的 Model Studio 平台发布。至于是否免费,原文未提及具体定价策略。通常阿里云模型平台会提供免费试用额度,但大规模商业使用可能需要付费。建议关注阿里云官方发布的详细定价和使用条款。
- 开放权重模型和闭源模型对开发者有什么实际影响?
- 开放权重(open-weight)模型允许开发者下载模型参数并在本地或私有云环境中运行、微调和定制,适合对数据隐私、成本控制或深度定制有需求的场景。闭源模型(如 OpenAI GPT 系列)通常只能通过 API 调用,但往往在性能和易用性上有优势。中国厂商倾向于开放权重策略来吸引开发者生态,而美国头部公司更多采用闭源商业化路线。
相关 AI 工具
文中提到或相关的 AI 工具 — 点进去看适合谁、怎么用、值不值得折腾
Midjourney
精选AI 绘图
顶级 AI 图像生成工具,以画面质感、艺术风格、构图理解著称。V7 模型在写实和创意两个方向均领先。需 Discord 或网页版使用。
Cursor
精选AI 开发工具
AI-first 代码编辑器,基于 VS Code 构建,深度集成 Claude / GPT-4o 等模型。Composer 多文件编辑、Tab 自动补全、Agent 模式三大杀手锏。
Claude
精选大模型应用
Anthropic 推出的 AI 助手,以长上下文(200K tokens)、对复杂任务的细腻理解、Artifacts 可视化输出闻名。Claude Sonnet 4.5 / Opus 4.7 在编程、写作、推理多项基准上领先。
相关推荐
同类资讯 — 由发布时间排序

Anthropic工程师警告AI或致人类灭绝 为何仍加速开发
Anthropic研究员Jacob Coxon因担忧递归自我改进AI系统的风险而辞职,该公司安全主管随后表示确信AI可能导致人类灭绝概率超10%。尽管以安全为使命,Anthropic仍在推进自主智能体开发并筹备估值2万亿美元IPO,其"谨慎推进反而更危险"的逻辑引发争议。

Meta 因 AI 训练数据与人脸识别系统遭集体诉讼
美国伊利诺伊州和加州的多名用户向 Meta 提起集体诉讼,指控其未经同意使用 Facebook 和 Instagram 照片训练未发布的人脸识别系统 NameTag 及生成式 AI 模型 Emu 和 Muse Image,违反州生物识别隐私法。诉讼索赔金额可能达数十亿美元,这是 Meta 继 2020 年和 2024 年生物识别数据和解案后再次面临重大隐私诉讼。

Anthropic 研究员离职警告超级智能风险,恰逢公司筹备 IPO
Anthropic 一名研究员本周辞职并公开警告,称公司正"直奔自我改进的超级智能,拿我们的生命冒险"。该公司对齐团队负责人甚至联署了这一声明。这一"末日警告"出现的时机敏感——据报道 Anthropic 正在筹备 IPO。TechCrunch 播客深入讨论了这一事件对 AI 安全和行业竞赛的影响。

Zerodha 创始人警示 AI 工具或削弱学生基础能力
印度 Zerodha 交易平台创始人 Nithin Kamath 结合 PISA 测评数据和个人经历,提出 AI 工具在教育场景的广泛使用可能正在削弱青少年的写作、思考等基础能力。他坦言自己依赖 ChatGPT 和 Claude 后写作能力退化,并质疑当 AI 让"捷径"触手可及时,如何确保学生仍能培养独立思考能力。