Qwen3.8-Max 预览版解读:2.4 万亿参数、Token Plan 与正式开放前要核验什么
编辑标准与来源政策: 编辑标准, 团队. 内容均链至原始来源,见 方法论.
Last checked: 2026-07-20.
Qwen3.8-Max 在 2026 年 7 月 19 日以预览形态进入公开讨论,核心看点是 2.4 万亿参数规模、面向编码工作流的 Token Plan 入口,以及正式版和开源材料尚未完全落地。当前应分别记录可体验入口、可调用 API、可下载权重和可复现评测四种状态,避免复述缺少边界的“最强”宣传。
直接访问
- Qwen 官方发布帖:发布原文、2.4T 与
going open-weight soon。 - Qwen Token Plan:预览版当前公开入口之一。
- Qoder 与 QoderWork:官方帖点名的编码与任务产品入口。
- Alibaba Cloud Model Studio 模型列表:核对正式 API model ID、上下文和计费。
- QwenLM GitHub 与 Qwen Hugging Face:核对代码、模型卡、权重和许可证。
实测边界:RadarAI 已核对以上公开页面均可访问,但没有登录 Token Plan、Qoder 或 QoderWork 账户,也没有获得 Qwen3.8-Max 的独立 API Key。因此本文没有自称完成生成质量、速度或成本实测;能力效果仅记录官方公开材料和可验证的缺口。
能力、效果与证据到哪一步
| 能力问题 | 目前可确认 | 效果证据 | 仍不能下的结论 |
|---|---|---|---|
| 编码与任务执行 | Preview 已进入 Token Plan、Qoder、QoderWork | 能确认产品入口,不能确认相同工具权限与模型版本 | 不能写成服务器 API 已全面开放 |
| 模型规模 | 官方发布图与帖文给出 2.4T 总参数 | 说明旗舰规模,不说明每 token 激活计算量 | 不能由总参数推导速度、显存或单次价格 |
| 开放权重 | 官方原文为 going open-weight soon |
能确认开放意图 | 访问日没有权重、许可证和模型卡就不能写“已开源” |
| 上下文、视觉、工具调用 | 正式统一规格尚未公开 | 暂无可复现的 RadarAI 结果 | 不沿用旧 Qwen 型号字段 |
| Benchmark | 官方帖没有给出可复现完整榜单 | 本文不制作二手排行榜 | 不用总参数替代任务效果 |

证据类型:官方发布图。来源:Qwen 官方发布帖,访问日期 2026-07-20。它证明发布口径,不是 RadarAI 能力实测。
先把发布状态说清楚
| 项目 | 2026-07-20 可确认状态 | 阅读时要保留的边界 |
|---|---|---|
| 模型身份 | 公开报道使用 Qwen3.8-Max 预览版名称 | 预览版不等于正式 API 型号或长期 SLA |
| 参数规模 | 公开口径为 2.4T 总参数 | 总参数不能直接推导推理成本、激活参数或显存 |
| 访问入口 | Preview 首发于 Token Plan、Qoder、QoderWork | 三种产品入口不等于正式 API |
| 开源状态 | 官方预告正式版将发布并开源 | 截至访问日不能把未来开源写成已可下载 |
| 比较对象 | 媒体常与 Kimi K3、Fable 5 并列 | 不同产品形态和评测设置不能直接排位 |
截至 7 月 20 日,能确认的是一个已经进入产品入口的 Preview,而不是一个资料齐全的正式模型:名称和 2.4T 规模已有官方原文,Token Plan、Qoder、QoderWork 可以体验;API 型号、价格、上下文、激活参数、许可证和权重下载仍没有在同一份正式材料中落定。这条边界决定了现在能做体验评估,不能写成全面商用或已经开源。
一次发布,三个入口
Qwen 官方 7 月 19 日发布帖做了三件事:公布 Qwen3.8-Max-Preview 名称与 2.4T 总参数口径;把预览入口放进 Alibaba Token Plan、Qoder 和 QoderWork;同时用 going open-weight soon 预告后续开放权重。阿里选择先把旗舰预览版放进编码与任务产品,让用户产生真实使用记录,正式模型资料则留待后续补齐。
“即将开源”也要拆成权重、推理代码、tokenizer、许可证和模型卡五项。只有新闻稿或产品入口,没有权重文件和许可证,不能算部署条件完整。团队可以先保存 20 个固定任务和旧模型结果,等正式材料出现后再复跑,而不是用一段漂亮演示决定迁移。
2.4T 到底说明了什么
2.4 万亿是总参数口径,不是每个 token 都调用 2.4 万亿参数。若正式技术报告披露 MoE 的激活参数,成本分析应以激活规模、KV cache、上下文长度、并行策略和服务定价共同计算。没有这些字段时,用参数量估算单次请求价格会产生数量级误差。
Token Plan 更接近开发者订阅或额度产品,和按百万 token 计费的 API 不是同一种采购单位。团队要记录月费、可用模型、请求或 token 额度、并发、超额规则、取消政策和是否允许自动化调用。个人套餐适合交互式编码,不代表能作为服务器后端。
评测同样需要分层:产品页面里的主观对比可以帮助发现任务,但采用决策至少要有自己的仓库任务、公开基准原始配置和失败样本。特别是编码模型,应同时计算测试通过率、无关 diff、命令失败、人工 review 分钟和回滚次数。
| 判断维度 | 应该记录什么 | 不能怎样下结论 |
|---|---|---|
| 可用性 | 实际模型 ID、入口、地区、账户资格 | 看到截图就写成全面开放 |
| 成本 | 套餐月费、额度、API 单价和超额规则 | 用总参数推导价格 |
| 开放性 | 权重 URL、许可证、推理代码和模型卡 | 把“将开源”写成“已开源” |
| 编码质量 | 同一仓库补丁、测试、diff 和人工复核 | 只比较网页 demo |
| 稳定性 | 连续 7 天的超时、限流和输出漂移 | 一次成功就替换生产模型 |
Qwen 为什么先把预览版放进编码工作流
Qwen 旧页面已经承担版本追踪,但 Qwen3.8 的搜索任务更具体:用户要知道现在能不能用、2.4T 表示什么、Token Plan 和 API 有何区别,以及何时适合迁移。因此需要独立页面,而不是把几段快讯塞回 broad hub。它还提供一个时间锚点:正式模型卡和开源权重出现后,可在同一 URL 增量更新,避免再造近义页面。
正式版上线当天,开发团队该核对什么(案例)
让一名维护 Python 服务的工程师准备 10 个真实 issue、5 个失败测试和 5 个跨文件重构任务。旧模型与 Qwen3.8-Max 使用相同仓库快照、相同提示和相同网络权限,各跑一次;涉及写操作时只在临时分支进行。
| 环节 | 发布日核对动作 | 通过标准 |
|---|---|---|
| 准备 | 20 个任务、固定 commit、现有测试基线 | 每项都有预期文件和验收命令 |
| 执行 | 记录计划、命令、diff、token/额度和时长 | 日志完整且没有人工暗中补丁 |
| 质量 | 运行目标测试与相关回归测试 | 至少 16/20 达到任务验收 |
| 审查 | 统计无关文件、危险命令和 review 分钟 | 无越权写入,平均复核不超过 12 分钟 |
| 暂停 | 连续超时、模型 ID 变化或套餐规则不明 | 不进入生产替换 |
这组案例给正式版留下可比较的基线。20 个任务必须绑定固定 commit、验收命令和旧模型结果;正式型号出现后按原样复跑。只要模型 ID、套餐规则或工具权限发生变化,就把前后结果分开记录,不能把 Preview 的成绩直接继承给正式版。
五种信号出现时,不要迁移
- 身份失败:产品界面呈现的模型名与文档/API 模型 ID 对不上。
- 开放性失败:找不到权重、许可证或可复现推理说明,却宣称可自托管。
- 成本失败:Token Plan 额度无法解释,20 个任务消耗不可复算。
- 工程失败:补丁能运行但修改无关文件,或没有真的执行测试。
- 稳定性失败:同一任务多次输出差异过大,无法形成 review 预期。
最关键的两条红线都与能力分数无关:第一,产品界面的 Preview 名称无法映射到稳定 API model ID;第二,官方只说“即将开放权重”,但下载仓库、许可证或模型卡仍缺席。任何一条存在,都意味着团队无法建立长期可复现的依赖关系,迁移决定应继续冻结。
下一批决定性信息会从哪里出现
- 正式模型卡:确认架构、激活参数、上下文、评测配置与已知限制。
- 开放权重:核对 Hugging Face/GitHub 官方组织、许可证和校验值。
- Model Studio API:确认正式 model ID、价格、速率和区域。
- Token Plan 条款:记录个人/团队使用边界、额度和自动续费。
- 第三方复现:只采纳公开提示、数据集版本和运行参数的结果。
下一次更新不应再追逐参数传闻,而应核对四个可落地对象:Model Studio 里的正式 model ID 与价格、QwenLM/Hugging Face 的权重文件、明确的许可证、可复现的模型卡。四者任何一个上线,都要在本文现有时间线上补日期;匿名截图和未公开配置的排行榜不能改变当前结论。
官方原文确认了什么,又刻意没有确认什么
Qwen 官方账号 7 月 19 日的发布帖给出了当前最关键的原文证据:Qwen3.8 is launching and going open-weight soon,参数规模为 2.4T;可提前体验的型号名是 Qwen3.8-Max-Preview,首发入口包括 Alibaba Token Plan、Qoder 和 QoderWork。帖文还给出了 Token Plan 国际入口。这组原文支持“预览已可试”和“开放权重即将到来”,但不支持“权重已经发布”。
官方帖没有同时给出激活参数、上下文窗口、API model ID、每百万 token 价格、许可证和可下载文件。媒体将 2.4T 与其他旗舰模型横向比较时,往往跨过了这些空白。本文因此不制作 benchmark 排名,也不把 Qoder 内的交互体验写成 Model Studio API 的正式能力。到 Model Studio 模型列表 能查到稳定型号之前,服务器集成仍处于观察状态。
三个入口的产品含义也不同。Token Plan 是订阅或额度式开发者产品;Qoder 是编码环境;QoderWork 面向更完整的工作任务。它们能证明模型进入真实产品界面,却不能自动证明相同额度、工具权限、数据保留和并发限制会出现在 API。企业评估时应分别截图账户内的模型名、套餐页和请求日志,避免把三个入口合并成一个不存在的产品。
这也解释了为什么 20 个仓库任务比通用 benchmark 更适合当前阶段。预览版最可能变化的是工具调用、长任务状态、限流和输出风格;固定仓库能在正式版到来后直接做差分。如果正式版模型 ID 变化、权重许可证限制商业用途,或同一任务的无关 diff 明显增加,团队应保留旧模型,不因为参数规模升级。正式版上线当天至少再保存一次官方帖、模型列表和权重仓库快照,三者日期对不上时,以各自描述的产品层为准。

证据类型:官方页面图片。来源:Qwen Hugging Face,访问日期 2026-07-20。该组织页可用于核对权重是否真正出现;图片本身不证明 Qwen3.8-Max 已发布权重。
常见问题
Qwen3.8-Max 已经正式发布了吗?
截至本文快照,公开入口和报道明确使用“预览版”,正式版与完整开源材料仍应等待官方落地。
2.4T 参数是不是意味着一定更贵?
不能。MoE 激活参数、服务优化、上下文和定价共同决定成本,总参数只描述模型规模的一部分。
Token Plan 能替代 API 吗?
通常不能直接等同。订阅式编码入口与服务器 API 的并发、额度、条款和 SLA 不同。
现在最值得测什么?
先测真实仓库的补丁正确率、测试执行、无关 diff、工具调用和人工复核成本。
什么时候可以考虑迁移?
正式模型 ID、价格和限制稳定,并在固定回归集上连续通过后,再小流量灰度。
官方与一手来源
- Qwen 官方发布帖:2.4T、Preview 入口与 going open-weight soon 原文
- Qwen Token Plan:官方国际套餐入口
- Alibaba Cloud Model Studio 模型列表:API 型号、上下文与计费真源
- QwenLM GitHub:官方代码、模型仓库与许可证
- Qwen Hugging Face:官方权重和模型卡组织页
访问日期均为 2026-07-20。新闻媒体用于确认事件时间与公开说法;涉及版本、参数、使用入口、公司身份和活动安排时,优先回到官方页面。页面无法提供的细节会明确标注为待核验,不从搜索摘要自行补齐。