Kimi K3 现已上线查看 Kimi K3
用于评估 Qwen3.8 Max Preview 编程、视觉理解和 Agent 工作流的抽象环境
model-release

Qwen3.8 Max Preview:功能、Token Plan 与发布状态

Jacey
Jacey
创始人
2026年7月21日
20 分钟阅读
快速结论:Qwen3.8 Max Preview 确实存在,并已进入 Qwen Token Plan。官方文档列出了 qwen3.8-max-preview、1M 上下文、推理、视觉理解、Function Calling、内置工具和三种缓存模式。但它还不是通用生产后端 API:标准按量价格、最终模型 ID、公开权重和 EvoLink 路由都尚未提供。
对开发者来说,正确做法是准备一套受控评测,而不是围绕仍在变化的 Preview 建立生产依赖。Qwen3.8 Max 模型页会持续更新 EvoLink 可用状态;本文则区分目前可以当作事实的信息,以及必须等待确认的决策。
**名称辨析:**Qwen3.8 不是 Qwen3-8B。Qwen3.8 中的点号表示 2026 年模型家族版本;Qwen3-8B 中的“8B”表示旧版 Qwen3 模型拥有 80 亿参数。Qwen3-8B 的下载、本地部署和价格都不适用于 qwen3.8-max-preview

截至 2026 年 7 月 21 日的 Qwen3.8 发布状态

Qwen3.8 当前处在产品预览与完整模型发布之间。用户可以通过 Token Plan 支持的工具测试 Preview,但生产 API 团队通常需要的多项信息仍然缺失。

问题当前答案安全解读
是否有官方预览版?Qwen Token Plan 文档已列出 qwen3.8-max-preview
是否已经 GA?没有Qwen 表示 Preview 可能继续变化,之后也可能被移除或替代。
是否有公开的预览模型 ID?该 ID 只对已记录的 Qwen Token Plan 渠道有效,不能假定它就是最终 EvoLink ID。
上下文窗口是否已记录?已记录Qwen 当前模型列表为 Token Plan 预览版标注 1M;未来路由仍需确认实际限制。
个人 Token Plan Key 能否用于应用后端?不能Qwen 将个人版限定于交互式编程和智能体工具,禁止自动化脚本、自定义后端和非交互批量调用。
是否公布标准 Token 价格?当前代表性价格表中没有Token Plan Credits 是订阅消耗单位,不是通用的按 Token API 价格。
开放权重是否可用?尚不可用Qwen 已宣布开放权重方向,但仓库、许可证、架构和日期仍待确认。
EvoLink 是否已经支持 Qwen3.8?尚未支持EvoLink 正在追踪模型,并验证受支持路由所需的事实。

这一区别非常重要:“在某个预览渠道可以使用”与“适合接入生产应用后端”是两个不同结论。模型可以在编程客户端里表现很好,但稳定 ID、计费方式、区域行为、限制和生命周期保障仍可能没有定论。

Token Plan 不等于标准 Qwen API

Qwen 当前通过 Token Plan 提供 Qwen3.8。这是一种拥有独立 Key、Base URL、Credits、配额和兼容交互式工具的订阅产品。官方购买页目前列出的个人版限时价格为每月 6、18 和 68 美元,但促销价格与 Credits 倍率随时可能调整。
接入问题当前 Token Plan标准生产 API
购买方式个人版或团队版月度订阅发布后按 Token 计费
适用场景交互式编程与 Agent 工具自动化应用、服务和批处理
计费单位套餐 Credits 与临时倍率输入、缓存输入和输出 Token
Qwen3.8 状态可用 qwen3.8-max-preview尚无代表性的按量价格
EvoLink 路由不适用尚未激活

不要把 Token Plan Key 放进 SaaS 后端或定时脚本。Qwen 表示违规可能导致订阅暂停或 Key 被撤销。生产规划应等待明确允许目标工作负载、并公开价格、限制与生命周期的正式路由。

已确认的 Qwen3.8 Max Preview 功能

目前最可靠的公开证据来自 Qwen 的 Token Plan 与 Chat API 官方文档。这些来源支持四类实用能力。

支持显式推理强度控制

Qwen 将该 Preview 归类为推理模型。Chat API 文档记录了 lowmediumxhigh 三档 reasoning effort。如果同时未设置 reasoning_effortthinking_budget,文档会把请求映射到 xhigh,默认思考预算为 131,072 Token。
qwen3.8-max-previewpreserve_thinking 默认是 true。历史 reasoning_content 必须原样放回独立字段,并且这些历史推理 Token 会计入输入并收费。因此,长会话中的推理状态既是可靠性问题,也是成本问题。

面向复杂工作的文本生成

官方模型列表包含文本生成能力,Qwen 的发布定位则聚焦高难推理、编程、数据分析和生产力工作流。这些是合理的测试类别,但不是已经得到验证的生产结果。

团队应该把四种结果分开衡量:

  • 答案是否正确;
  • 是否遵守指定格式和任务范围;
  • 是否在不循环、不产生多余输出的情况下完成任务;
  • 把重试和审查计入后,最终通过验收的结果是否成本更低。

视觉理解

Qwen Token Plan 模型列表标明该 Preview 支持视觉理解。因此,截图、文档、图表、数据图和图文混合任务都适合作为评测目标。

但这不等于所有输入格式、文件大小上限、媒体时长、区域行为或 EvoLink 路由能力都已确定。这些都属于端点级事实,必须在团队计划实际发布的准确接入渠道上验证。

Token Plan 的内置 Harness 工具

Qwen 为 Token Plan Preview 记录了联网搜索、代码解释器、网页提取、以图搜图和文搜图等工具。这有利于 Agent 工作流评测,但也带来归因问题:出色结果可能来自模型本身、检索层、代码解释器或外围 Harness。

模型推理与工具辅助工作流应该分开评测。否则,团队可能把依赖某个渠道专属工具的结果错误归功于 Qwen3.8,而该工具在生产环境中未必能复现。

由琥珀色与青绿色层次组成的 Qwen3.8 预览模型、工具与路由抽象系统
由琥珀色与青绿色层次组成的 Qwen3.8 预览模型、工具与路由抽象系统

Qwen 已宣布但尚未完整披露的信息

Qwen 的发布帖将 Qwen3.8 描述为 2.4 万亿参数模型,表示计划开放权重,并将其定位在前沿模型市场的头部。这些都是重要的发布信号,但不能替代完整技术模型卡。

已宣布事项对开发者说明了什么仍然缺少什么
2.4 万亿总参数Qwen 在传达一次明显的规模提升激活参数、专家布局、训练细节和推理效率
开放权重计划未来可能出现自部署或独立服务路径仓库、文件、许可证、日期、硬件要求和较小规格版本
前沿模型定位Qwen 预期能力有明显跃升完整跑分表、方法、独立复现、延迟和成本

总参数量本身不能决定通过验收的任务质量,也不能回答模型服务成本、输出 Token 数、工具失败恢复能力或 Preview 稳定性。

Preview 在生产中真正重要的限制

即使模型质量很强,Preview 状态仍然会制造运营不确定性。

模型标识可能变化

当前 qwen3.8-max-preview 是 Qwen Token Plan 的官方 ID。正式模型可能改用新的稳定别名或日期快照。应把模型选择放在配置中,而不是散落到应用逻辑、分析事件、Prompt 和客户合同里。

不能从订阅 Credits 推算 API 价格

Qwen 当前通过 Token Plan Credits 推广 Preview。Credits 衡量订阅消耗,并可能包含临时倍率;它不等于公开的每百万输入/输出 Token 价格。

不要用 Qwen3.7 的假定价格乘以 Preview 折扣来制作生产预算。应等待准确路由价格,再以“通过验收的任务成本”衡量,而不是只看标价。

1M 上下文不等于 1M Token 都能可靠检索

Qwen 当前模型列表为 Token Plan 预览版记录了 1M 上下文。这是已确认的渠道限制,但不能证明任意位置的信息都能被稳定检索,也不能保证未来 EvoLink 路由采用完全相同的限制。仍应按产品实际 Prompt 长度验证检索效果。

个人 Token Plan 不是通用后端 API 路由

个人 Token Plan 明确只允许用于交互式编程与智能体工具,并禁止把订阅 API Key 用于自动化脚本、自定义应用后端或非交互批处理。因此,该渠道适合人工参与的早期评测,但不能证明面向 SaaS 产品的生产集成已经在商业和运维层面可用。

产品团队应把两个里程碑分开:获得模型评测入口,以及获得获准用于生产的 API 路由。后者仍需要独立确认模型 ID、使用政策、价格、限制、数据条款和支持承诺。

结构化输出与路由行为仍需谨慎

当前 Qwen 模型列表为 Qwen3.8 标记了 Function Calling 和内置工具,但没有标记结构化输出。速率限制、区域可用性、流式响应、批处理、工具行为和失败请求计费也可能因渠道而异,不能从 Qwen3.7 或其他供应商直接复制。

Qwen3.8 提供三种缓存模式

Qwen 的缓存指南目前为 qwen3.8-max-preview 列出了全部三种模式。以下是 Qwen 渠道规则,不是 EvoLink 价格,也不是 EvoLink 实测结果。
缓存模式创建成本命中成本最低长度使用方式保留时间
显式缓存标准输入价的 125%10%1,024 Token添加 cache_control,单次请求最多四个标记5 分钟,命中后重置
隐式缓存100%20%256 Token自动匹配公共前缀,无需配置不确定;系统会清理长期未使用内容
会话缓存125%10%1,024 TokenResponses API、previous_response_id 与会话缓存 Header5 分钟,命中后重置
在 Chat Completions、DashScope 和 Anthropic 兼容调用中,显式缓存与隐式缓存互斥。Responses API 未启用会话缓存时,会使用模型支持的隐式缓存。缓存折扣也不会消除历史推理成本:保留的 reasoning_content 仍属于计费输入。

真正的生产问题不是“有没有缓存”,而是公共前缀是否足够长且稳定、五分钟窗口是否符合工作负载,以及缓存创建溢价能否被后续命中摊薄。

哪些团队应该现在为 Qwen3.8 做准备?

如果团队具备以下条件,可以现在准备评测:

  • 处理高难仓库级编程或长时间 Agent 任务;
  • 能在稳定基线上执行多次对照测试;
  • 有自动化测试或清晰的人工审查标准;
  • 希望同时衡量视觉理解与文本推理;
  • 能承受 Preview 变化,并保留回退路由;
  • 正在探索未来开放权重部署,但不依赖明确发布日期。

如果团队存在以下情况,应等待生产可用路由再投入测试预算:

  • 需要稳定、带版本的模型 ID;
  • 需要可预测的按 Token 价格和预算提醒;
  • 依赖明确的区域或速率限制保障;
  • 无法发现静默任务失败;
  • 无法保留另一个模型作为回滚路径;
  • 必须向客户承诺该 Preview 已经适合生产。

生产 API 出现前应该准备什么

目前不要为大型 Benchmark 套件投入预算。先冻结少量代表性 Prompt、预期输出、工具 Schema 与验收规则,等标准 API 或 EvoLink 路由出现后再重放。完整方法由独立的 Qwen3.8 Benchmark 证据指南负责。

现在有价值的是与路由无关的准备:

  • 把模型 ID 与推理档位放进配置;
  • 保留已支持的生产回退模型;
  • 记录哪些任务确实需要前沿推理;
  • 在看到 Qwen3.8 输出前定义验收条件;
  • 等按量价格和账单字段公布后再下成本结论。

EvoLink 尚未发布 Qwen3.8 路由,因此当前产品动作是准备,而不是集成。

  1. 加入 Qwen3.8 抢先体验页面,获取经过验证的 EvoLink 可用性和价格更新。
  2. 使用 Kimi K3 等已上线路由建立固定评测集。
  3. 独立保存 Prompt、工具 Schema、验收标准和测试产物,不与某个供应商强耦合。
  4. 在任务边界让模型选择保持可配置。
  5. Qwen3.8 上线后,重放相同任务,对比通过验收的质量、延迟、可靠性和成本。
要看同期最直接的选择,请阅读 Qwen3.8 vs Kimi K3;要判断是否替换旧版本,请阅读 Qwen3.8 vs Qwen3.7 MaxQwen3.8 Benchmark 指南则解释新跑分出现后应该如何解读。

常见问题

Qwen3.8 正式发布了吗?

截至 2026 年 7 月 21 日,Qwen3.8 Max Preview 已正式进入 Qwen Token Plan,但它仍是可能变化、移除或由正式模型替代的预览版。

Qwen3.8 Max Preview 的模型 ID 是什么?

Qwen Token Plan 文档列出 qwen3.8-max-preview。它是特定渠道的 Preview ID,不能视为有保证的最终 ID 或 EvoLink 请求 ID。

Qwen3.8 和 Qwen3-8B 是同一个模型吗?

不是。Qwen3.8 是 2026 年的版本化模型家族;Qwen3-8B 是较早的 80 亿参数 Qwen3 模型。搜索结果中的 Qwen3-8B 下载、本地部署和价格都不能回答 Qwen3.8 Max Preview 的问题。

Qwen3.8 Token Plan 和 API 接入有什么区别?

Token Plan 是面向兼容交互式编程和 Agent 工具的订阅产品,其 Key 不能用于自动化脚本或应用后端。标准生产 API 还需要独立的按量价格、使用条款、限制和稳定路由。

尚未支持。EvoLink 正在追踪该模型,但还没有发布受支持的 Qwen3.8 路由、价格或请求模型 ID。

Qwen3.8 支持图片吗?

官方 Token Plan 模型列表包含视觉理解能力。准确格式、大小限制和路由行为仍需按端点验证。

Qwen3.8 是开源还是开放权重?

Qwen 已宣布开放权重计划。截至 2026 年 7 月 21 日,最终仓库、文件、许可证、架构披露和发布时间仍未确认。

Qwen3.8 价格是多少?

Token Plan 订阅价格和 Credits 已公开,但 Qwen3.8 标准按 Token 价格与 EvoLink 路由价格尚未公布。不要把促销 Credits 换算成假定 Token 价格。

应该选择哪一种 Qwen3.8 缓存模式?

不想配置时使用隐式缓存;稳定公共前缀不少于 1,024 Token、且会在五分钟内复用时考虑显式缓存;通过 previous_response_id 串联的 Responses API 多轮会话可使用会话缓存。生产使用前仍应在准确路由上核算实际命中率与成本。

Qwen3.8 比 Qwen3.7 Max 更好吗?

Qwen 将 Preview 定位为能力升级,但团队应该等待完整证据,并执行同任务对照测试。Qwen3.7 Max 仍是文档更完整的生产基线。

开发者应该等 Qwen3.8 再发布产品吗?

不需要。先使用已支持模型构建,保留回退,并准备可重放评测。只有 Qwen3.8 的路由、价格、限制和真实工作负载结果满足要求后,再迁移生产流量。

来源

准备好把 AI 成本降低 89% 吗?

现在就开始使用 EvoLink,体验智能 API 路由的强大能力。