Qwen 3.8 Max 模型定价、上下文窗口及 API 接入

发布时间:2026/8/4 0:04:31
Qwen 3.8 Max 模型定价、上下文窗口及 API 接入 Qwen 3.8 Max 发布了。 阿里在 2026 年 8 月 3 日正式推出距离预览版两周。这一版之后所有数字都不再是传闻。发布时间2026-08-03预览版 2026-07-19 公布价格QwenCloud 上每百万输入 $2.00、输出 $6.00上下文1M 窗口最大输入 991K最大输出 131K规模2.4 万亿参数激活 950 亿开源权重宣布下周放出license 和确切日期都没给今天能用的路径QwenCloud API、Qwen Studio、QwenWorkofox 上架情况已上架bailian/qwen3.8-maxOpenAI 与 Anthropic 双协议摘要新旗舰比上一代便宜$2/$6 对 Qwen 3.7 Max 的 $2.50/$7.50。最大输出翻倍到 131K token1M 上下文窗口保持不变。阿里将首次开源 Max 级别模型的权重同批还有 Qwen 3.8-27B时间是「下周」已宣布未定日期。官方 benchmark 表里它在多数 agent 类项目上领先 Claude Opus 4.8在SWE-bench Pro 和 HLE 上落后 Fable 5。这是一张厂商自测表。表里没有 Kimi K3 这一列而那恰好是多数人最想看的对比。ofox 已经上架模型 IDbailian/qwen3.8-maxOpenAI 与 Anthropic 两种协议都能调所以不用等阿里开 Claude 形状的端点就能塞进 Claude Code。Qwen 3.8 Max 是什么Qwen 3.8 Max 是阿里的闭源顶配模型2.4 万亿参数的多模态系统每 token 激活 950 亿参数。它建在 Qwen 3.5 架构上而不是一套全新架构阿里给它的定位是长周期自主工作而不是单轮对话。输入输出支持情况输入模态文本、图片、视频QwenCloudofox 上是文本和图片未列视频输出模态文本API 能力Function calling、结构化输出、上下文缓存、前缀续写速率限制QwenCloud2M tokens/分钟15K 请求/分钟发布博客的重心压在多天自主执行上。头号案例是一次无人值守的编码运行在一个公开仓库里 16 天左右产出了 265 个 commit、127 个 PR 和 151 个 issue。这套能力能不能迁移到你自己的代码库恰恰是发布博客回答不了的那件事。Qwen 3.8 Max 什么时候发布的2026 年 8 月 3 日。预览版在前两个日期在报道里经常被混为一谈2026-07-19Qwen3.8-Max-Preview 在上海 WAIC 公布。只能通过阿里的 Token Plan 订阅、Qoder 和 QoderWork 访问。没有按量付费 API没有 model card没有 benchmark 表。2026-08-03正式可用。QwenCloud API 开放价格公布完整 benchmark 表公布开源权重时间宣布。日期落在这两者之间的报道其「未公布价格」「没有 benchmark」的说法现在都已过期也包括那些引用「预览期按标价 10% 计费」的内容——那个折扣只适用于 Token Plan 预览窗口。Qwen 3.8 Max 开源吗今天还没有。阿里说权重下周放也就是 2026 年 8 月 10 日那一周。实际宣布的内容Qwen 3.8 Max 的权重会放出措辞是首次有 Qwen-Max 级别的模型开放权重。Qwen 3.8-27B在同一批开放权重这个才是多数人真跑得起来的那个。没有指明license。没有确切日期。开源版本也没有model card或激活参数拆解。在权重真正落地前有三件事别当定论。厂商口中的「下周」是计划不是发货日。对商用来说 license 比时间更要紧——Qwen 的开源版本历来用 Apache 2.0Qwen3-235B-A22B 在 Hugging Face 上现在仍标着apache-2.0但那是先例不是对 Max 级别发布的承诺。再有2.4T 总参数、950 亿激活的模型不是工作站自部署的量级27B 才是硬件账算得过来的那个。Qwen 3.8 Max 多少钱QwenCloud 上每百万输入 token $2.00、每百万输出 token $6.002026-08-03 快照。新旗舰比它替代的那一代便宜 20%。Qwen 3.8 MaxQwenCloudQwen 3.7 Max百炼新加坡输入 / 每百万$2.00$2.50输出 / 每百万$6.00$7.50隐式缓存读 / 每百万$0.25未单独列出显式缓存写 / 每百万$2.50未单独列出显式缓存读 / 每百万$0.17未单独列出这张表有两处要说明。缓存那几行来自不同的价目表不能直接横向比ofox 的 Qwen 3.7 Max 页面标的是缓存读 $0.50/M、缓存写 $3.125/M那是网关的报价而不是阿里的。另外核实当天百炼新加坡价目表上 3.7 Max 挂着限时五折所以实际差距可能比标价对标价看起来更小。这张表两边的价格都会动。要拿它建成本模型之前先自己拉一次当前值。上下文窗口和最大输出是多少总共 1M token拆成最大输入 991K、最大输出 131K另有单独的 262K 推理上限。上下文窗口1M最大输入991K最大输出131K最大推理 token262K输出上限才是真正的变化。ofox 上 Qwen 3.7 Max 在同样的 1M 窗口下最大输出只有 64K3.8 Max 把单次能吐出的量翻了一倍。这对阿里瞄准的那类负载很关键一个能在 262K 推理 token 里做规划、却只有 64K 用来写产出物的模型是一个会被截断的模型。官方 benchmark 怎么说阿里在发布时给出了完整对比表结果是互有胜负而不是横扫。下面每个数字都是厂商自测。节选几行Qwen 3.8 Max 对第一梯队BenchmarkQwen 3.8 MaxOpus 4.8Fable 5GPT-5.6 Sol (max)Qwen 3.7 MaxTerminal Bench 2.186.684.684.688.874.5SWE-bench Pro67.769.280.064.660.6PaperBench93.080.388.890.564.8GPQA Diamond92.692.092.694.192.4HLE43.645.753.347.241.4IFBench82.862.263.572.779.1OSWorld-Verified86.183.485.083.273.3MMMU-Pro82.375.681.283.079.0按惯例打个折看。竞品的 Terminal Bench 分数是从 Artificial Analysis 和 OpenAI 自己的帖子里引来的不是 Qwen 重跑的SWE-bench Pro 那一行用的是 Claude Code harness、temp 1.0、top_p 0.95、256K 上下文这套配置是 Qwen 自己选的。表里还有几行是 Qwen 自家的 benchmarkQwenSWEBench、QwenQoderBench、QwenReactBench被测的正是与之同名的那个模型。这张表的缺口比表里任何一个数字都响没有 Kimi K3 这一列。Moonshot 的开源权重旗舰在 Qwen 3.8 预览前几天才发布也是大家问 Qwen 3.8 Max 时最常拿来比的那个。阿里选择对标的是三个西方闭源模型加上自家上一代。怎么接入 Qwen 3.8 Max今天走 QwenCloud。官方路径有三条另有一条被广泛报道的第四条需要自己核 开发者可以通过阿里云 DashScope 官方 API 直接调用 Qwen 3.8 Max也可以借助 OpenRouter 或 ofox.io 等聚合网关以标准 OpenAI 兼容格式发起请求后者通常支持通过同一端点路由至多个主流模型。QwenCloud API。模型 IDqwen3.8-max开发者路径。key 在home.qwencloud.com/api-keys申请。Qwen Studio。chat.qwen.ai对话界面。QwenWork。面向非开发者的职场 agent 平台。阿里云百炼。SCMP 在 8 月 3 日报道全球 API 已开放。但核实当天百炼的英文模型列表和价目页仍然只到qwen3.7-max说明目录页滞后于公告尽管底层端点是同一个。最后这条值得展开因为品牌名把它藏住了。QwenCloud 自己的开发者文档调用的 OpenAI 兼容端点是https://dashscope-intl.aliyuncs.com/compatible-mode/v1key 从DASHSCOPE_API_KEY读——和百炼用的是同一个 DashScope 国际站主机。QwenCloud 是建在那套基础设施上的前端不是另一套 API。调用是 OpenAI 形状的import os from openai import OpenAI client OpenAI( api_keyos.getenv(DASHSCOPE_API_KEY), base_urlhttps://dashscope-intl.aliyuncs.com/compatible-mode/v1, ) resp client.chat.completions.create( modelqwen3.8-max, messages[{role: user, content: 总结这个仓库的测试策略。}], max_tokens4096, ) print(resp.choices[0].message.content)阿里没提供的那条路Anthropic 协议Qwen 官方只有 OpenAI 形状的 API所以 Claude Code 调不了qwen3.8-max。Claude Code 说的是 Anthropic Messages 协议而且不会退让。网关在发布当天就把这个缺口补上了。bailian/qwen3.8-max在发布同一天上架 ofox。2026-08-03 一次目录调用返回 123 个模型新 ID 已在其中模型页标的是输入 $2/M、输出 $6/M、缓存读 $0.25/M、缓存写 $2.50/M上下文长度 1,131,072、单次补全上限 131,072。四条价格与 QwenCloud 官方标价一致。有一点值得点出来因为它差点把我们坑了。目录里的supported_endpoints字段只列了/v1/chat/completions和/v1/responses读起来像是 Anthropic 这条路不通。实际是通的2026-08-03 一次真实的 Messages 调用返回了格式完整的响应stop_reason: end_turn。在按这个字段做规划之前先发一个真请求。两行 shell 就能把它塞进 Claude Codeexport ANTHROPIC_BASE_URLhttps://api.ofox.io/anthropic export ANTHROPIC_MODELbailian/qwen3.8-max或者沿用上面那段 Python改两个参数client OpenAI( api_keyos.getenv(OFOX_API_KEY), base_urlhttps://api.ofox.io/v1, ) resp client.chat.completions.create(modelbailian/qwen3.8-max, ...)两条路怎么选你要的是直接对接 QwenCloud走网关最低的单价是这就是标价这里与标价一致但要逐个模型核Qwen 独有新功能的第零日访问是滞后取决于网关多久跟上Claude Code 等 Anthropic 协议工具今天做不到可以一把 key 打通 Qwen、Claude、GPT、Gemini不行可以某家限流时的自动故障转移自己搭内置诚实的代价网关多了一跳你控制不了的链路而且它的价目表可能滞后于厂商的中途调价。看模型页别看营销页——这句话对我们自己同样适用。Qwen 3.8 Max 对比 Qwen 3.7 Max更便宜、输出上限翻倍、agent 类 benchmark 大幅提升。Qwen 3.8 MaxQwen 3.7 Max发布时间2026-08-032026-05-19参数2.4T激活 95B未公布上下文 / 最大输出1M / 131K1M / 64Kofox 标注输入 / 输出每百万$2.00 / $6.00$2.50 / $7.50Terminal Bench 2.186.674.5SWE-bench Pro67.760.6ofox 上架是bailian/qwen3.8-max是bailian/qwen3.7-max没有特别理由就选 3.8 Max。它更便宜、单次能写的量翻倍而且两者用同一把 key 就能调所以迁移只是换一个 model ID不是重做一次接入。只有两种情况留在 3.7 Max你为了可复现性锁了版本或者你的评测集是按它校准的。价格差是 20% 不是一个数量级光靠成本推不动这次迁移。想看更便宜的同系列可以读 3.7 Plus 与 3.7 Max 的实测对比。这次发布重新抛出的跨厂商问题可以看 Kimi K3 对比 GPT-5.5 与 Opus 4.8开源权重那一侧和 Kimi K3 接入指南。两者今天都在 ofox 上K3 是moonshotai/kimi-k3这个是bailian/qwen3.8-max所以把它们放在一起比只是换个 model ID不是一次采购决策。常见问题Qwen 3.8 Max 什么时候上市的2026 年 8 月 3 日正式可用版本价格和 benchmark 一并公布。预览版在 2026 年 7 月 19 日公布仅限阿里的 Token Plan、Qoder 和 QoderWork。Qwen 3.8 Max 免费吗不免费。QwenCloud 上按 token 计费$2/$6 每百万。7 月的预览期据报道对 Token Plan 订阅用户按标价 10% 计费那个窗口已经结束。能下载 Qwen 3.8 Max 的权重吗还不能。阿里宣布开源权重在 2026 年 8 月 10 日那一周放出没有 license 也没有确切日期。Qwen 3.8-27B 在同一批宣布里是现实中真正能自部署的那个目标。Qwen 3.8 Max 支持视觉吗图片支持视频要打个问号。QwenCloud 模型页列的输入模态是文本、图片、视频阿里的多模态表报告 MMMU-Pro 82.3、OSWorld-Verified 86.1。通过 ofox2026-08-03 发出的一张图片被正确描述prompt token 从 60 升到 90说明图片输入是通的。但视频不在 ofox 的目录条目里别默认它可用。Qwen 3.8 Max 能配 Claude Code 用吗直接对接 QwenCloud 不行因为 Claude Code 说的是 Anthropic Messages 协议而 QwenCloud 是 OpenAI 形状的。通过同时支持两种协议的网关发布当天就能用2026-08-03 已实测把ANTHROPIC_BASE_URL指向https://api.ofox.io/anthropic设置ANTHROPIC_MODELbailian/qwen3.8-max。Qwen 3.8 Max 和 Qwen 3.8-27B 有什么区别Max 是 2.4T 的闭源旗舰现在通过 API 可用。27B 是小得多的模型在下周的开源权重批次里宣布。两者同代不同量级。Qwen 3.8 Max 比 Kimi K3 强吗阿里没有公布这个对比它的 benchmark 表里没有 K3 那一列。两者在可获得性上也不对等K3 今天已有开源权重和广泛的网关支持3.8 Max 还没有。本次核实的来源Qwenhttps://x.com/Alibaba_Qwen/status/2084100707423289643Qwen3.8-Max - QwenCloudFunction Calling - QwenCloudAlibaba Cloud Model Studio model pricing - Alibaba Cloud Model Studio - Alibaba Cloud Documentation CenterSupported Models and Capabilities Overview - Model Studio - Alibaba Cloud - Alibaba Cloud Model Studio - Alibaba Cloud Documentation Centerhttps://www.scmp.com/tech/article/3362738/alibabas-ai-model-qwen38-max-made-widely-accessible-ahead-open-weights-releasehttps://huggingface.co/Qwen/Qwen3-235B-A22BQwen3.8 Max API - 价格、上下文与接入 | OfoxAIhttps://ofox.io/zh/models/bailian/qwen3.7-maxGET https://api.ofox.io/v1/models2026-08-03 实调07:30 是 122 个模型08:20 是 123 个且bailian/qwen3.8-max已在其中针对bailian/qwen3.8-max的真实请求实测2026-08-03POST /anthropic/v1/messages200Anthropic 形状正文、POST /v1/chat/completions200以及一次图片输入调用200描述正确prompt token 90同一 prompt 不带图是 60