OpenRouter 在 9 月 28 日发了一篇说明,问 Qwen 3.8 是什么。文章写明,Qwen 3.8 是阿里巴巴 2026 年 8 月放出的一代模型,四个模型共用这个名字。能下载的和能调用的不是同一件东西。
可以下载的是 Qwen3.8 27B,许可证为 Apache 2.0;以及 Qwen3.8 2.4T A95B,许可证为 Qwen3.8-Max License。Qwen3.8 Flash 没有自己的仓库,它基于可下载的 Qwen3.8-Flash-Next,后者使用 Qwen Community License 1.0。Qwen3.8 Max 没有公开权重。
发布说明记录,2.4T-A95B 的权重在 2026 年 8 月 12 日放到 Hugging Face,27B 的权重是 8 月 14 日。这篇 9 月 28 日的文字是在拆这四套东西,不是在宣布当天有新模型上线。
[1]
阿里巴巴的模型卡把 Qwen3.8-Max 写成 Qwen3.8-2.4T-A95B 的托管版本,并加上视觉输入、非思考模式、默认 100 万 token 的上下文,以及内置工具。Flash 是同一种关系:Qwen3.8-Flash 是 Qwen3.8-Flash-Next 的托管版,同样有默认 100 万 token 的上下文和内置工具。
模型 ID qwen/qwen3.8-max 是别名,目前指向 qwen/qwen3.8-max-0902,也就是 2026 年 9 月 2 日的快照。说明建议,如果希望请求继续打到同一份快照,就使用带日期的 ID。
价格是每百万 token 的美元,先输入、后输出,取自 OpenRouter 目录在 2026 年 9 月 11 日的记录。Max 是 2 美元对 6 美元。七家提供 2.4T 的服务商里,六家是 2 美元对 6 美元,Venice 是 2.50 美元对 7.50 美元。27B 有 14 家服务商,输入从 0.15 美元到 0.45 美元,输出从 2.00 美元到 3.20 美元。Flash 是 0.15 美元对 0.47 美元。
开放权重的原生上下文是 262,144。目录里 2.4T 最大的托管窗口写到 1,048,576;Max、27B 和 Flash 的最大托管窗口写到 1,000,000。Max 的原生上下文没有公布。27B 的模型卡写,可以用 YaRN 把窗口扩到 1,000,000,并注明静态 YaRN 可能让较短输入的表现变差。窗口是否延长、怎样延长,取决于把请求送到哪一家。
[1]2.4T 是指令微调模型,总参数 2.4 万亿,每个 token 激活 950 亿,不用 Apache 2.0。许可证允许使用、复制、修改、分发、再许可、销售、部署、托管、微调和做衍生作品,但有两个条件。用该模型做的商业产品或服务,月活用户超过 1 亿,或月收入超过 2000 万美元,就要在界面上显著展示模型名。若本人或关联方经营「模型即服务」或「AI 工作助手」,任意连续 12 个月的合计收入超过 5000 万美元,商业使用前要另向 Qwen 取得许可证。不把模型、输出或能力提供给第三方的内部使用,不受这一条约束。
Flash 对应的 Flash-Next,被写成将支撑 Qwen4 的那套架构的实验性预览。它的署名条件和 Qwen3.8-Max License 相同。任何「模型即服务」或「AI 工作助手」业务在商业使用前都要另拿许可证,这里没有收入门槛。因此三套开放权重里,有两套用的是 Qwen 自己写的、不在 OSI 批准名单上的许可证。开放权重表示可以下载并检查检查点,不等于这份许可证是开源许可证。
Qwen 3 是 2025 年 4 月的更早一代,中间还有 3.5、3.6 和 3.7。Qwen 3 上的许可条款不能拿来解释这四套模型。27B 是 270 亿参数的稠密模型,bf16 下权重大约占 54 GB。2.4T 每次只激活 950 亿参数,但全部 2.4 万亿参数都要载入。仓库 README 只给出 27B 的服务命令。2.4T 的开放权重只读文本。2026 年 9 月 11 日,向 qwen/qwen3.8-2.4t-a95b 发送图像时,请求以 HTTP 404 失败,消息是没有找到支持图像输入的端点。同一请求发给 27B 和 Flash 则成功。本篇没有另测价格,也没有打开排行榜。
[1]要点
- Qwen 3.8 这个名字底下有四套模型,只有 27B 使用 Apache 2.0。
- Max 没有公开权重;Flash 没有自己的仓库,对应的是 Flash-Next。
- 目录价格的日期是 2026 年 9 月 11 日,不是 9 月 28 日。
- 2.4T 的额外许可证有收入门槛,Flash-Next 的商业限制没有收入门槛。