当前位置:首页>AI资讯>阿里发布 Qwen3.8-Max:2.4T 参数旗舰模型,Max 级别首次开源权重

阿里发布 Qwen3.8-Max:2.4T 参数旗舰模型,Max 级别首次开源权重

2026年8月3日,阿里巴巴 Qwen 团队今日正式发布 Qwen3.8-Max,这是 Qwen 家族目前规模最大的基础模型。与历代 Max 级模型仅通过 API 提供服务不同,官方明确表示这一级别的权重将首次开源,预计下周在 Hugging Face 与 ModelScope 上线。模型现已通过千问AI平台开放调用,模型 ID 为 qwen3.8-max

技术规格上,Qwen3.8-Max 基于 Qwen3.5 架构构建,总参数量 2.4 万亿,单 token 激活 950 亿,上下文窗口达 1,000,000 tokens。模型正式支持 reasoning_effort 参数,提供 xhighmediumlow 三档推理深度调节,默认为 xhigh。接口层面同时兼容 OpenAI 的 chat completions 与 responses 协议以及 Anthropic 协议,输入模态支持文本与图像。

这一代模型的能力重心明显向长周期自主任务倾斜。例如,软件工程团队可以将其用于从空目录出发的仓库级开发;法务岗位可以借助百万级上下文一次性处理数百份文档规模的语料;研究团队可以让模型自行搭建训练与评测流水线并推进方法探索;Agent 开发者则可以通过标准协议将其接入既有的智能体编排系统。

官方在发布中着重展示了长时程表现。一项自动编程测试中,模型从零创建项目并在完全自主运行约 16 天后,留下 265 次 commit 与 127 个 PR;另一项科研复现任务中,模型连续工作约 125 小时、编写约 7,600 行代码、完成 33 轮 GPU 训练,先复现目标论文结论,再经四轮探索取得高于原方法 2.71 分的结果。基准测试方面,Qwen3.8-Max 在 PaperBench、IFBench、OSWorld-Verified 等项目上取得对比集最高分,但偏工程实现的编程基准并未全面领先——Terminal Bench 2.1 为 86.6,低于 GPT-5.6 Sol 的 88.8;SWE-bench Pro 为 67.7,低于 Claude Fable 5 的 80.0。上述数据均为官方自测,部分为内部基准,且各项目所用评测框架并不完全统一。

可用性方面,模型支持北京、新加坡与美国弗吉尼亚三个区域的接入端点,官方同时给出了 Claude Code、Codex、Qoder CLI、Qwen Code 与 OpenClaw 的接入配置。

整体来看,本次发布的重点不在单轮对话质量,而在于把模型的可用时长从分钟级推向天级。真正的分水岭或许在下周:如果 2.4 万亿参数的权重如期开放,它将成为参数规模最大的开放权重模型之一,对位对象也将从闭源旗舰转向开放权重阵营。在权重与许可证文件实际落地之前,"首次开源"仍是一项承诺。

豆包AI助手
©版权声明:如无特殊说明,本站所有内容均为AIHub.cn原创发布和所有。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。否则,我站将依法保留追究相关法律责任的权利。