
千问 Qwen3.8 Max 正式发布:功能、1M 上下文与 API 状态
qwen3.8-max。QwenCloud 模型目录确认了 1M 上下文、Thinking、Function Calling、内置工具和 Structured Output;发布日志将其定义为 2.4 万亿参数的原生视觉语言 MoE 旗舰模型。qwen3.8-max。请求文档 URL 仍保留历史 Preview slug,因此开发者应从产品页确认可调用 ID 与实时价格,并在发送生产流量前完成账户级真实冒烟测试。2026 年 8 月 3 日的发布状态
| 问题 | 已核实状态 | 对开发者的含义 |
|---|---|---|
| 正式上游 ID | qwen3.8-max | 它是 QwenCloud ID,不能自动当作 EvoLink 最终 ID |
| 核心功能 | 1M、Thinking、Function Calling、内置工具、Structured Output | 要在实际路由上逐项验证 |
| Preview 与正式版 | Token Plan Preview 转为 QwenCloud 正式旗舰 | 新文案不应再把模型本身写成未发布 |
| 架构 | 2.4T 总参数、MoE、原生视觉语言 | 激活参数和完整技术报告仍未公布 |
| Open Weights / License | 已宣布将发布,但尚未核实仓库、权重和许可证 | 不要提前写成可下载或可商用自托管 |
| EvoLink | qwen3.8-max 正式路由已提供 | 文档 URL 保留 Preview 历史 slug;以成功请求、返回 ID、usage 和实时价格为准 |
**Preview 历史说明:**本文后续的 Token Plan、缓存与 Preview 限制仍保留作为迁移背景;当其与上表冲突时,以 8 月 3 日的正式发布状态为准。
Token Plan 不等于标准 Qwen API
在正式版发布前,Qwen 曾通过 Token Plan 提供 Qwen3.8 Preview。这是一种拥有独立 Key、Base URL、Credits、配额和兼容交互式工具的订阅产品;它仍可作为迁移背景,但不能代表正式版或 EvoLink 路由的价格与使用条款。
| 接入问题 | 当前 Token Plan | 标准生产 API |
|---|---|---|
| 购买方式 | 个人版或团队版月度订阅 | 发布后按 Token 计费 |
| 适用场景 | 交互式编程与 Agent 工具 | 自动化应用、服务和批处理 |
| 计费单位 | 套餐 Credits 与临时倍率 | 输入、缓存输入和输出 Token |
| Qwen3.8 状态 | 可用 qwen3.8-max-preview | 尚无代表性的按量价格 |
| EvoLink 路由 | 不适用 | 尚未激活 |
不要把 Token Plan Key 放进 SaaS 后端或定时脚本。Qwen 表示违规可能导致订阅暂停或 Key 被撤销。生产规划应等待明确允许目标工作负载、并公开价格、限制与生命周期的正式路由。
已确认的 Qwen3.8 Max Preview 功能
目前最可靠的公开证据来自 Qwen 的 Token Plan 与 Chat API 官方文档。这些来源支持四类实用能力。
支持显式推理强度控制
low、medium 和 xhigh 三档 reasoning effort。如果同时未设置 reasoning_effort 和 thinking_budget,文档会把请求映射到 xhigh,默认思考预算为 131,072 Token。qwen3.8-max-preview,preserve_thinking 默认是 true。历史 reasoning_content 必须原样放回独立字段,并且这些历史推理 Token 会计入输入并收费。因此,长会话中的推理状态既是可靠性问题,也是成本问题。面向复杂工作的文本生成
官方模型列表包含文本生成能力,Qwen 的发布定位则聚焦高难推理、编程、数据分析和生产力工作流。这些是合理的测试类别,但不是已经得到验证的生产结果。
团队应该把四种结果分开衡量:
- 答案是否正确;
- 是否遵守指定格式和任务范围;
- 是否在不循环、不产生多余输出的情况下完成任务;
- 把重试和审查计入后,最终通过验收的结果是否成本更低。
视觉理解
Qwen Token Plan 模型列表标明该 Preview 支持视觉理解。因此,截图、文档、图表、数据图和图文混合任务都适合作为评测目标。
但这不等于所有输入格式、文件大小上限、媒体时长、区域行为或 EvoLink 路由能力都已确定。这些都属于端点级事实,必须在团队计划实际发布的准确接入渠道上验证。
Token Plan 的内置 Harness 工具
Qwen 为 Token Plan Preview 记录了联网搜索、代码解释器、网页提取、以图搜图和文搜图等工具。这有利于 Agent 工作流评测,但也带来归因问题:出色结果可能来自模型本身、检索层、代码解释器或外围 Harness。
模型推理与工具辅助工作流应该分开评测。否则,团队可能把依赖某个渠道专属工具的结果错误归功于 Qwen3.8,而该工具在生产环境中未必能复现。

Qwen 已宣布但尚未完整披露的信息
Qwen 的发布帖将 Qwen3.8 描述为 2.4 万亿参数模型,表示计划开放权重,并将其定位在前沿模型市场的头部。这些都是重要的发布信号,但不能替代完整技术模型卡。
| 已宣布事项 | 对开发者说明了什么 | 仍然缺少什么 |
|---|---|---|
| 2.4 万亿总参数 | Qwen 在传达一次明显的规模提升 | 激活参数、专家布局、训练细节和推理效率 |
| 开放权重计划 | 未来可能出现自部署或独立服务路径 | 仓库、文件、许可证、日期、硬件要求和较小规格版本 |
| 前沿模型定位 | Qwen 预期能力有明显跃升 | 完整跑分表、方法、独立复现、延迟和成本 |
总参数量本身不能决定通过验收的任务质量,也不能回答模型服务成本、输出 Token 数、工具失败恢复能力或 Preview 稳定性。
Preview 在生产中真正重要的限制
即使模型质量很强,Preview 状态仍然会制造运营不确定性。
模型标识可能变化
qwen3.8-max-preview 是 Token Plan 的历史 ID;正式上游 ID 已变为 qwen3.8-max。EvoLink 最终 ID 仍应配置化,而不是散落到应用逻辑、分析事件、Prompt 和客户合同里。不能从订阅 Credits 推算 API 价格
Preview 阶段使用 Token Plan Credits 衡量订阅消耗,并可能包含临时倍率。正式版已经有上游按 Token 价格,但 EvoLink 生产预算仍必须等待自身路由价格。
不要用 Qwen3.7 的假定价格乘以 Preview 折扣来制作生产预算。应等待准确路由价格,再以“通过验收的任务成本”衡量,而不是只看标价。
1M 上下文不等于 1M Token 都能可靠检索
Qwen 当前模型列表为 Token Plan 预览版记录了 1M 上下文。这是已确认的渠道限制,但不能证明任意位置的信息都能被稳定检索,也不能保证未来 EvoLink 路由采用完全相同的限制。仍应按产品实际 Prompt 长度验证检索效果。
个人 Token Plan 不是通用后端 API 路由
个人 Token Plan 明确只允许用于交互式编程与智能体工具,并禁止把订阅 API Key 用于自动化脚本、自定义应用后端或非交互批处理。因此,该渠道适合人工参与的早期评测,但不能证明面向 SaaS 产品的生产集成已经在商业和运维层面可用。
结构化输出与路由行为仍需谨慎
当前 Qwen 模型列表为 Qwen3.8 标记了 Function Calling 和内置工具,但没有标记结构化输出。速率限制、区域可用性、流式响应、批处理、工具行为和失败请求计费也可能因渠道而异,不能从 Qwen3.7 或其他供应商直接复制。
Qwen3.8 提供三种缓存模式
qwen3.8-max-preview 列出了全部三种模式。以下是 Qwen 渠道规则,不是 EvoLink 价格,也不是 EvoLink 实测结果。| 缓存模式 | 创建成本 | 命中成本 | 最低长度 | 使用方式 | 保留时间 |
|---|---|---|---|---|---|
| 显式缓存 | 标准输入价的 125% | 10% | 1,024 Token | 添加 cache_control,单次请求最多四个标记 | 5 分钟,命中后重置 |
| 隐式缓存 | 100% | 20% | 256 Token | 自动匹配公共前缀,无需配置 | 不确定;系统会清理长期未使用内容 |
| 会话缓存 | 125% | 10% | 1,024 Token | Responses API、previous_response_id 与会话缓存 Header | 5 分钟,命中后重置 |
reasoning_content 仍属于计费输入。真正的生产问题不是“有没有缓存”,而是公共前缀是否足够长且稳定、五分钟窗口是否符合工作负载,以及缓存创建溢价能否被后续命中摊薄。
哪些团队应该现在为 Qwen3.8 做准备?
如果团队具备以下条件,可以现在准备评测:
- 处理高难仓库级编程或长时间 Agent 任务;
- 能在稳定基线上执行多次对照测试;
- 有自动化测试或清晰的人工审查标准;
- 希望同时衡量视觉理解与文本推理;
- 能承受 Preview 变化,并保留回退路由;
- 正在探索未来开放权重部署,但不依赖明确发布日期。
如果团队存在以下情况,应等待生产可用路由再投入测试预算:
- 需要稳定、带版本的模型 ID;
- 需要可预测的按 Token 价格和预算提醒;
- 依赖明确的区域或速率限制保障;
- 无法发现静默任务失败;
- 无法保留另一个模型作为回滚路径;
- 必须向客户承诺该 Preview 已经适合生产。
生产 API 出现前应该准备什么
现在有价值的是与路由无关的准备:
- 把模型 ID 与推理档位放进配置;
- 保留已支持的生产回退模型;
- 记录哪些任务确实需要前沿推理;
- 在看到 Qwen3.8 输出前定义验收条件;
- 等按量价格和账单字段公布后再下成本结论。
EvoLink 用户应该如何准备
- 先在 Qwen3.8 Max 产品页确认当前路由、
qwen3.8-max模型 ID 与实时价格。 - 判断长上下文推理、大型代码仓库或多工具 Agent 是否值得使用旗舰路由。
- 使用 Kimi K3 等现有路由建立固定评测集,保存 Prompt、工具 Schema、验收标准和测试产物。
- 按 API 接入教程先完成一次最小冒烟请求,再重放相同任务。
- 对比通过验收的质量、延迟、重试、人工修正时间与成功任务成本,并保留回退。
正式发布后仍需要保留的 Preview 关键词与技术问题
正式发布不会让旧搜索词立即消失。历史集成、搜索结果、客户端配置和评测记录中仍可能出现这些名称,因此需要保留解释,而不是简单删除。
正式版、Preview 与旧模型必须消歧
| 名称或入口 | 现在代表什么 | 不能推导什么 |
|---|---|---|
qwen3.8-max | QwenCloud 正式模型 ID | EvoLink 必然使用相同 ID |
qwen3.8-max-preview | 历史 Token Plan ID 与当前 EvoLink 草案文档标识 | 上游模型仍只是 Preview |
| Qwen3.8 Token Plan | 面向受支持交互式编程与 Agent 工具的订阅入口 | 通用应用后端或 EvoLink 计费合同 |
| Qwen3-8B | 较早的 80 亿参数 Qwen3 Checkpoint | Qwen3.8 的另一种写法或评测证据 |
| Qwen3.8 Open Weights | Qwen 已预告的未来产物 | 当前已有可下载权重、License 或部署配置 |
这些词对应的用户问题仍然有效,包括“Qwen3.8 和 Qwen3-8B 有什么区别”“Token Plan 能否用于后端”“开放权重何时发布”和“Qwen3.8 Cache 如何计费”。
Cache 仍然影响长上下文成本
隐式缓存、显式 Context Cache 和会话复用解决的问题不同。应测试公共 Prefix 是否足够稳定、缓存有效期是否覆盖真实请求间隔、创建成本能否被后续命中摊薄,以及多轮 Thinking 历史是否增加下一轮计费输入。
| 检查项 | 实际验证方法 |
|---|---|
| Prefix 稳定性 | 固定 System Prompt 与 Tool Schema,只改变尾部请求 |
| 命中与账单 | 对照 Usage 字段记录写入、命中和未命中 |
| Thinking 历史 | 比较多轮前后的计费输入与延迟 |
| 1M Context | 分别在 32K、128K、256K 和真实上限测试召回 |
| EvoLink 一致性 | 路由上线后核验字段、Usage 和价格,而不是套用上游假设 |
生产可用性最终属于具体路由,而不是模型名称。Thinking、Function Calling、Built-in Tools、Structured Output 和原生视觉语言是上游能力;端点、媒体格式、Schema 行为、Rate Limit、区域、错误语义、延迟和生命周期仍要通过 EvoLink 真实请求验证。
从发布消息走到一次有依据的 API 测试
不要因为一条发布消息就直接注册。先完成以下判断;只有路由确实适合你的工作负载时,再创建 API Key。
- 01
发布了吗?
已发布。Qwen3.8 Max 是正式模型,Preview 仅作为历史渠道背景保留。
- 02
能用吗?
已在 EvoLink 上线。请在产品页确认实时路由与模型 ID。
- 03
适合我吗?
更适合长上下文推理、大型代码仓库和多工具 Agent;轻量任务应继续使用更小的路由。
- 04
多少钱?
以产品页实时价格模块为准,不要套用上游价格或 Preview 套餐价格。
- 05
怎么调用?
从 Chat Completions、Responses 或 Messages 中选择协议,再查看接入指南和参数文档。
五项判断都完成了? 创建 API Key.
常见问题
Qwen3.8 正式发布了吗?
qwen3.8-max 加入正式发布日志和生产模型目录;EvoLink 也已提供正式路由,并与历史 Preview 文档分开管理。Qwen3.8 Max Preview 的模型 ID 是什么?
qwen3.8-max;qwen3.8-max-preview 是历史 Token Plan 与旧文档标识。模型 ID 仍应配置化,方便审计与回滚。Qwen3.8 和 Qwen3-8B 是同一个模型吗?
不是。Qwen3.8 是 2026 年的版本化模型家族;Qwen3-8B 是较早的 80 亿参数 Qwen3 模型。搜索结果中的 Qwen3-8B 下载、本地部署和价格都不能回答 Qwen3.8 Max Preview 的问题。
Qwen3.8 Token Plan 和 API 接入有什么区别?
Token Plan 是面向兼容交互式编程和 Agent 工具的订阅产品,其 Key 不能用于自动化脚本或应用后端。标准生产 API 还需要独立的按量价格、使用条款、限制和稳定路由。
EvoLink 已经支持 Qwen3.8 吗?
qwen3.8-max;发送生产流量前,仍应在自己的账户中完成一次最小冒烟测试,并以产品页实时价格为准。Qwen3.8 支持图片吗?
Qwen 将正式版描述为原生视觉语言模型。具体图片格式、大小、媒体限制和 EvoLink 路由行为仍需上线后验证。
Qwen3.8 是开源还是开放权重?
Qwen 已预告开放权重,但截至 8 月 3 日核验时,正式仓库、Checkpoint、License 和部署指南尚未发布或确认。
Qwen3.8 价格是多少?
应区分 QwenCloud 上游价格和 EvoLink 路由价格。生产预算应以实际调用渠道的实时价格与成功任务成本为准,不能再用 Token Plan Credits 代替。
Qwen3.8 比 Qwen3.7 Max 更好吗?
Qwen 公布了明显提升和新的厂商 Benchmark,但团队仍应执行同任务重放,比较质量、延迟、重试、兼容性与成功任务成本,再决定是否替换 Qwen3.7 Max。
开发者应该等 Qwen3.8 再发布产品吗?
不需要。先使用已支持模型构建,保留回退,并准备可重放评测。只有 Qwen3.8 的路由、价格、限制和真实工作负载结果满足要求后,再迁移生产流量。
来源
- QwenCloud 模型发布日志
- Qwen3.8 Max 技术发布与 Benchmark
- Qwen Token Plan 概览
- Qwen 文本生成模型列表
- Qwen OpenAI 兼容 Chat API 参考
- Qwen 上下文缓存指南
- Qwen Token Plan FAQ
- Qwen Token Plan 购买页
- Qwen3.8 发布帖


