通义千问3.8承诺开放权重,但预览版仍锁在阿里内部
阿里称其2.4万亿参数的Qwen3.8将很快开放权重,但今天的预览版仅通过阿里产品提供,缺乏评估该承诺所需的发布细节。
AI 驱动 · 每小时限 20 次请求

通义千问7月19日发布公告,说Qwen3.8要开放权重,参数规模2.4万亿。紧接着又说,Qwen3.8-Max-Preview已经可以通过阿里的Token Plan、Qoder和QoderWork使用。比起那个参数数字,我觉得这两段话之间的落差更有意思。
阿里等于让读者先接受两个说法,却还没拿出能核验的材料。一边说Qwen3.8是当下最强模型之一,仅次于Fable 5,却不附基准测试表,也不说明评估方法;一边承诺“很快”开放权重,但日期、许可证、模型卡、架构、上下文长度、部署指南一概没有。这件事有可能发展成一次有分量的发布,但到今天为止,它只是阿里产品里的一个预览版,加上一句关于未来的承诺。
速览
| 问题 | 我的判断 |
|---|---|
| 公告说了什么? | 阿里称Qwen3.8参数规模2.4万亿,即将开放权重,目前已可通过三个阿里服务试用Qwen3.8-Max-Preview。 |
| 现在能拿到什么? | 通过Token Plan、Qoder和QoderWork提供的托管预览版。公告里没有可下载的权重,也没有公开的Qwen3.8模型卡。 |
| 谁会从中受益? | 模型托管商、研究人员、工具开发者,以及那些想要比封闭API更多控制权的团队。 |
| 还缺什么? | 发布日期、许可证、架构细节、独立评测结果、部署要求,以及这个预览版本身的公开API定价。 |
| 我的核心观点 | 开放权重的承诺很重要,但最终交出来的发布包才会决定Qwen3.8是真正多了一个选项,还是只是多了一个超大下载文件。 |
参数规模不等于部署方案
2.4万亿参数是个漂亮的标题数字。但它没有告诉我:每个token实际激活多少参数、阿里会用什么数值精度发布、模型怎么路由、合理的推理配置长什么样。没有这些信息,我没法把这个数字换算成存储、显存、吞吐或成本——除非靠猜。
所以我对这个数字既不急着夸,也不急着黑。单凭参数量,既不能说明Qwen3.8浪费,也不能说明它实用。如果是混合专家架构,推理成本的故事可能完全不一样,但公告里没有提架构细节。老实说,2.4万亿告诉我们的是这个声明有多大,而不是这台机器长什么样。
最可能从中受益的,不是想在笔记本上随便跑个前沿模型的开发者,而是推理服务商、研究团队、有重型基础设施的企业,以及等着小型变体或量化版本的下游用户。这是从公布的规模倒推出来的判断,不是阿里给的硬件规格。

开放权重本身仍然有价值
我不想让那些缺失的细节盖住这条新闻里真正有用的部分。如果阿里在合理条件下放出权重,模型托管商就能提供有竞争力的推理服务,研究人员可以更细致地分析模型行为,开发者也能在不依赖单一厂商接口的前提下做微调或量化。这跟永远只给API访问是完全不同的事。
而且Qwen不是没有过完整的发布先例。官方Qwen3.6仓库里挂着模型文件和部署方案,README也写明Qwen的开放权重模型采用Apache 2.0许可证。Qwen3.6-27B模型页上能看到文件、模型卡、许可证信息和集成说明。我不是说Qwen3.8一定会照搬这些细节,只是想拿老版本做个对照:承诺落地成实物时,证据应该长什么样。
用词上也值得留意。开源倡议组织区分了"开放权重"和"开源AI",认为光有权重还不够,缺少训练代码和数据信息,就无法真正自由地研究和修改系统。Qwen自己也选了更窄的那个说法,我觉得这样更诚实。最终许可证和配套代码才会告诉我们,这次发布到底给了多少实际自由。
预览版是产品上线,不是开放发布
这一点在阿里自己的页面上就能看出来。Qwen云Token Plan页面已经列上了Qwen3.8-Max-Preview,按个人或团队订阅收费。页面上说,这个计划兼容支持OpenAI和Anthropic协议的工具。作为托管访问确实方便,但本质上还是在阿里的规则下使用。
Qoder产品页介绍了一个编程桌面端、一个叫QoderWork的本地优先工作助手、一个命令行agent,以及云端agent。把预览版放在这些产品里,比单纯挂一个聊天demo能更快收到真实编程和办公场景的反馈。但这也意味着,早期的反馈会把模型本身的质量和Qoder的prompt设计、工具调用、上下文管理、agent循环混在一起。效果好了不全是模型的功劳,效果差了也未必全是模型的问题。
阿里的公开目录还没完全跟上这次公告。写这篇文章的时候,我能查到的Qwen云详细页面还是旧版qwen3-max-preview的,不是qwen3.8-max-preview。Qwen的GitHub组织页上,置顶的通用模型仓库还是Qwen3.6,也没有Qwen3.8的仓库。我不会把旧模型的价格、上下文窗口或功能直接套到新预览版上。

排名说法需要拿出证据
公告里最大胆的一句话是:Qwen3.8与顶级前沿模型相当,仅次于Fable 5。但阿里没有给出任务清单、评判标准、评分方式、采样策略、工具配置或对比条件,我没法从公告本身去验证这个说法。
这不是抠字眼。同一个模型,换一套agent框架,编码排名可能天差地别。长上下文分数可以藏住检索失败的问题。通用偏好评测可能奖励一种"讨喜"但做不好实事的语气。就算真的是第二名,也看不出在某个团队的代码库、文档或工具调用上到底会翻车多少次。
目前最早的公开讨论,反映的是信息空白而不是共识。在Reddit的相关帖子里,第一个问题就是定价,其他评论则在搬运阿里面向国内市场的临时方案和预览条款。另一个新帖在评论区活跃之前就质疑了2.4万亿参数和性能声明的真实性。大家的反应更多是好奇,离下结论还早得很——独立测试还远远不够。
如果让我来测,我会挑那些失败条件一目了然的任务:必须跑过测试的代码改动、有标准答案的信息抽取、schema严格的工具调用,以及塞了矛盾细节的长文档。我会记录完成率、修复轮次、延迟和人工审查时间。这些数字比一个排名有用得多。

什么能让我改观
我质疑的是这次发布的包装方式,不是Qwen3.8本身可能很优秀这件事。阿里靠常规的发布动作就能把可信度缺口补上大半:放出模型卡,明确许可证,讲清架构,把权重放到独立托管商能部署的地方,给出别人可以复跑的评测,然后让外部用户去翻那些难看的边角案例。
如果这些东西到位了,回过头看订阅预览期反而像一段合理的过渡:阿里一边积累早期真实负载数据,一边准备一个别人能审查、能自己跑的模型。可如果权重放出来了却没有实用文档,或者许可证卡得很死,那2.4万亿参数的宣传口径听起来就没那么开放了。
到目前为止,我的态度是感兴趣,但刻意不下结论。Qwen3.8有可能成为今年最重要的开放权重发布之一——但还没有。公告给了我们一个规模数字、一个托管预览版、一个方向。我在等的是开发者能下载、能算账、能测试、能留下来的那部分。
许可
新闻文本 © 2026 Mark Huang。 新闻文本可在非商业场景下分享或翻译,但需署名并链接到 https://markhuang.ai/zh/news/qwen38-open-weight-preview-gap.
建议署名: 基于「通义千问3.8承诺开放权重,但预览版仍锁在阿里内部」(作者:Mark Huang),原文发布于 https://markhuang.ai/zh/news/qwen38-open-weight-preview-gap。
