Qwen3.8-Max 是阿里 2026 年 8 月 3 日正式发布的通义千问新旗舰:2.4T 总参数、95B 激活的 MoE 模型,100 万 token 上下文,原生多模态,官方称在编程(Coding)和专业办公(Cowork)两个方向全面升级(来源)。用它的价格也要分两条路:千问 AI Token Plan 会员订阅(个人版 ¥39/月起、团队版 ¥150/席位/月起)和通义千问 API 按量计费(Qwen3.8-Max 输入 ¥12、输出 ¥36 每百万 tokens)——两套体系的价格逻辑完全不同,不能直接比数字(会员价格、API 价格)。以下价格以官方 2026-08-18 页面为准。
Qwen3.8-Max 发布概览:2.4T 新旗舰正式上线
Qwen3.8-Max 于 2026 年 8 月 3 日正式发布,是通义千问史上参数规模最大的模型,权重将于下周开源(含 Qwen3.8-27B)(来源)。它 2026 年 7 月 19 日以 Preview 形式亮相,8 月 3 日转正并开放 API,定位「编程 + 办公」双核旗舰,主打长程自主任务——官方演示中它自主运行 10 天以上完成一个开源项目从空目录到交付的全流程。
核心规格如下:
| 参数 | 数值 |
|---|---|
| 总参数量 | 2.4T(MoE 稀疏激活) |
| 激活参数 | 约 95B |
| 上下文窗口 | 100 万 tokens |
| 输入模态 | 文本、图像、视频、文档 |
| 上线时间 | Preview 2026-07-19 → 正式 2026-08-03 |
| 开源计划 | 权重下周开源,同步开源 Qwen3.8-27B |
对用户来说,Qwen3.8-Max 意味着可以在 千问 AI Token Plan 里用旗舰模型,也可以在通义千问 API 按量调用——两条路的入口、充值方式、额度和限速规则都不一样,下面逐项对比。
Qwen3.8-Max 价格对比:会员订阅和 API 按量是两套体系
Qwen3.8-Max 的价格不能只查一个数字——千问 AI Token Plan 会员和通义千问 API 是两套完全独立的计费体系,会员 Credits 不等于 API 余额。 Token Plan 在 platform.qianwenai.com 订阅,按月/年付换 Credits 额度池;API 在阿里云百炼按实际消耗的 token 扣费。两套体系整体对比如下:
| 维度 | 千问 AI Token Plan | 通义千问 API |
|---|---|---|
| 计价方式 | 订阅制,月/季/年付换 Credits | 按量,按 token 扣余额 |
| 官网入口 | platform.qianwenai.com/pricing/token-plan | help.aliyun.com/zh/model-studio/model-pricing |
| 充值方式 | 订阅即扣款,支持多周期 | 百炼控制台预充值 |
| Qwen3.8-Max 获取 | 首发尝鲜模型,付费档可用 | 选择 qwen3.8-max 模型 |
| 单价起点 | ¥39/月(个人版 Lite) | 输入 ¥12 / 输出 ¥36(每百万 tokens) |
| 限速方式 | Credits 双限额 + Agent 并发数 | 按模型/账号限速,以控制台为准 |
| 适合场景 | 兼容工具内交互式使用 | 自建应用、后端服务、产品集成 |
会员是「额度池」逻辑:个人版 10 款模型(Qwen3.8-Max、Qwen3.7-Max、Qwen3.7-Plus、Qwen3.6-Flash、DeepSeek-V4-Pro、DeepSeek-V4-Flash、GLM-5.2、Wan2.7-Image、Wan2.7-Image-Pro、HappyHorse1.1)共享同一 Credits 池,联网搜索、文搜图、网页抓取、代码解释器等 Harness 工具也在额度内统一抵扣;API 是「余额」逻辑:钱先充进控制台,每次调用按 token 数量、是否命中缓存结算。最直观的区别:会员按月重置额度、价格固定;API 用多少扣多少、成本随用量线性增长。
千问 Token Plan 会员价格对比:三档个人版怎么用 Qwen3.8-Max
千问 AI Token Plan 个人版三档(Lite / Standard / Pro)都能调用 Qwen3.8-Max,¥39/月起,按 Credits 配额和 Agent 并发数区分,多周期订阅更优惠;团队版按席位购买,标准席位 ¥150/席位/月起。 各档价格与额度如下(来源):
| 档位 | 月付(原价) | 季付 | 年付 | Credits/7天 | Agent 并发 |
|---|---|---|---|---|---|
| Lite | ¥39(¥60) | ¥110/季 | ¥420/年 | 2,500 + 700/5小时 | 1-2 |
| Standard | ¥139(¥180) | ¥396/季 | ¥1,510/年 | 10,000 + 3,000/5小时 | 3-4 |
| Pro | ¥499(¥600) | ¥1,420/季 | ¥5,600/年 | 40,000 + 12,000/5小时 | 6-8 |
| 团队·标准席位 | ¥150(¥198) | — | ¥1,800/席位/年 | 25,000/席位/月 | — |
| 团队·高级席位 | ¥550(¥698) | — | ¥6,600/席位/年 | 100,000/席位/月 | — |
| 团队·尊享席位 | ¥1,398 | — | ¥16,776/席位/年 | 250,000/席位/月 | — |
怎么选档位:个人轻度体验 Qwen3.8-Max 用 Lite ¥39/月即可;日常编码、多文件重构和中等 Agent 任务上 Standard ¥139/月(4 倍 Credits);重度专业、需要大量多模态产出和多 Agent 并发选 Pro ¥499/月(16 倍 Credits)。团队场景按席位规模和用量选标准/高级/尊享,团队版承诺数据不用于模型优化。所有档位夜间(0:00-8:00)调用享受更低 Credits 消耗,适合把非紧急任务安排在夜间执行以延长额度。
通义千问 API 按量价格对比:Qwen3.8-Max 与其他模型怎么选
通义千问 API 的 Qwen3.8-Max 是输入 ¥12、输出 ¥36(每百万 tokens,0<Token≤1M 档),与 Qwen3.7-Max 原价相同;Qwen3.7-Max 主 ID 当前限时 5 折(¥6/¥18),是控成本的旗舰备选。 常用模型价格如下(来源):
| 模型 | 输入价(每百万 tokens) | 输出价 | 说明 |
|---|---|---|---|
| Qwen3.8-Max | ¥12 | ¥36 | 新旗舰,100 万上下文,编程/办公双核 |
| Qwen3.7-Max | ¥12(限时 ¥6) | ¥36(限时 ¥18) | 上一代旗舰,主 ID 限时 5 折 |
| Qwen3.7-Plus | ¥2(限时 ¥1.6) | ¥8(限时 ¥6.4) | 生产主力,支持推理/视觉/文本 |
| Qwen3.6-Flash | 约 ¥1.2 | 约 ¥7.2 | 偏速度与成本 |
| Qwen-Turbo | ¥0.3 | ¥0.6 | 高性价比入口(非思考模式) |
Qwen3.8-Max 在 API 侧定位是「关键路径模型」:复杂推理、长上下文分析、多步 Agent 和编程工作流交给它,轻量高频流量走 Turbo / Flash / Plus 更省钱。API 侧最值得关注的是阶梯计费、Batch 半价和上下文缓存:部分模型按单次请求输入 token 总量所在区间定价(如 0<Token≤256K 与 256K<Token≤1M 不同价);Batch 调用输入输出均按实时价 50% 计费;上下文缓存只给输入 token 折扣,且 Batch 与缓存不能同时生效。新用户通常有免费额度但带有效期,且不一定跨模型共享,正式上线前请在控制台确认余额与免费包明细。
额度、用量与限速:两套体系各怎么算
会员看「Credits 配额 + 双重限额」,API 看「余额 + 模型/账号限速」,这是两套完全不同的消耗模型。 会员侧:个人版是 7 天总 Credits 上限 + 5 小时连续使用上限的双重限额机制,任一限额触及即暂停服务、周期重置后自动恢复;团队版按席位独立计 Credits。API 侧:额度就是账户余额加各模型免费/资源包,限速通常按模型和账号区分,具体 RPM/TPM 数值以百炼控制台展示为准。
上线前别只看单价:API 高并发场景要先确认账号限速阈值能否承载目标流量;会员场景要评估 Credits 是否够用——Pro 的 40,000 Credits/7天 可以支撑全天多 Agent 任务,Lite 的 2,500 Credits 更接近轻度体验。另外会员仅限兼容工具内交互式使用,不可用于自动化脚本或应用后端,接后端服务必须走 API。
API key 与接入配置:会员工具链 vs 开放 API
会员不需要开放平台 API key:千问 AI Token Plan 用专属 sk-sp- 开头的 API Key 搭配专用 Base URL,接入 Qwen Code、Claude Code、Cursor、Cline、OpenCode、Codex、Kilo CLI、OpenClaw 等兼容工具,在 Credits 额度内交互式使用;自建应用或产品集成才需要在阿里云百炼控制台申请通义千问 API key,按 OpenAI 兼容方式接入后端。 两套 Key 完全独立、互不通用,这是最容易误解的地方。
接入配置按场景分:编程工具用户装好 Qwen Code / Claude Code / Cline 后选择千问 Token Plan 通道,填入 sk-sp- Key 和 Base URL 即可;后端开发者在百炼控制台创建 API key,按 OpenAI 兼容格式配置 base URL 和模型名(如 qwen3.8-max),再按需开启 Batch 或上下文缓存;Qwen3.8-Max 支持原生工具调用(code_interpreter、web_search 等),适合做复杂 Agent 链路。
优惠与值不值得:怎么用 Qwen3.8-Max 最划算
一句话结论:在千问 AI Token Plan 产品内用 → 订阅会员,轻度 Lite ¥39/月、高频重编码上 Standard/Pro,多周期和夜间折扣帮你摊薄成本;要自建应用 → 只能走通义千问 API,Qwen3.8-Max 按量单价虽与 3.7-Max 原价持平,但 Batch 半价、缓存折扣和 Qwen3.7-Max 限时 5 折可以帮你控制成本。 会员优惠主要是多周期折扣(年付最省)和夜间 Credits 低消耗;API 优惠主要是 Batch 半价、上下文缓存折扣与新用户免费额度。
| 你的情况 | 建议 |
|---|---|
| 轻度体验 Qwen3.8-Max、先尝鲜 | 千问 Token Plan 个人版 Lite ¥39/月 |
| 日常编码 + Agent + 办公混合 | Standard ¥139/月(年付 ¥1,510) |
| 重度多 Agent、大量多模态产出 | Pro ¥499/月(年付 ¥5,600) |
| 团队多人共用、数据不用于训练 | 团队版标准 ¥150/席位/月起 |
| 自建应用、产品集成、后端服务 | 通义千问 API,Qwen3.8-Max 按量 ¥12/¥36 |
想横向对比其他模型的价格,可以看看 DeepSeek API 和智谱 GLM 的对比页。Qwen3.8-Max 值不值得,取决于你走哪条路:会员是按月预算换固定能力池,API 是按量付费换灵活性——先选对入口,再算价格,这笔账才算得清。