Kimi K3 现已上线查看 Kimi K3

Qwen3.8 Max Preview API

Qwen / 阿里巴巴-文本与视觉理解-核验于 2026-07-21 · 官方预览 · EvoLink 路由待开放

Qwen3.8 Max Preview 是 2026 年的版本化预览模型,并不是旧版 Qwen3-8B。目前只能通过 Qwen Token Plan 进行交互式评估,EvoLink 生产 API 路由和价格仍待公布。

官方状态
已通过 Qwen Token Plan 提供预览
官方预览模型 ID
qwen3.8-max-preview
EvoLink API 价格
尚未公布
EvoLink 抢先体验

获取 Qwen3.8 Max 上线 EvoLink 的最新消息

当 EvoLink 确认 Qwen3.8 路由、请求模型 ID、价格及受支持的 API 行为后,第一时间收到通知。

我们只会发送 Qwen3.8 可用性相关邮件,不会发送垃圾信息。

想更快获得更新? 加入 Discord 获取最新消息

为什么通过 EvoLink 关注 Qwen3.8?

区分官方预览入口和生产 API 路由,在不围绕不稳定模型 ID 重建集成的前提下完成横向比较。

路由验证后及时获知

EvoLink 确认可用性、请求模型 ID、价格和通过验证的 API 行为后即可收到更新。

保持统一接入面

准备通过一个 EvoLink 账户和统一网关,将 Qwen3.8 与已支持的 Qwen、Kimi、Claude、GPT 等模型进行比较。

先比较,再迁移

在向预览模型分配生产流量前,重放你自己的编程、Agent、视觉理解和长上下文任务。

目前已确认的 Qwen3.8 Max Preview 功能

以下事实来自 Qwen 官方 Token Plan 和 API 文档,描述的是特定渠道预览版,而非最终正式模型或 EvoLink 路由。

官方预览信息

预览模型标识

Qwen Token Plan 文档将 qwen3.8-max-preview 列为准确模型 ID,并说明预览版仍可能继续演进,之后可能被移除或由正式版替代。

官方预览信息

推理与文本生成

Qwen 将该预览版归类为推理和文本生成模型。OpenAI 兼容 Chat API 文档为该模型提供 low、medium 和 xhigh 三档推理强度。

官方预览信息

视觉理解

官方 Token Plan 模型列表标明 qwen3.8-max-preview 支持视觉理解;具体端点的媒体格式与限制仍需在生产使用前验证。

官方预览信息

1M 上下文与三种缓存模式

Qwen 当前模型列表记录了 1M 上下文;缓存指南则为该 Token Plan 预览模型列出显式缓存、隐式缓存与 Responses API 会话缓存。这些是 Qwen 渠道规则,并非 EvoLink 路由条款。

官方预览信息

内置评测工具

Qwen 为 Token Plan 预览渠道记录了联网搜索、代码解释器、网页提取、以图搜图和文搜图等工具。

官方预览信息

个人版仅限评测用途

Qwen 将个人 Token Plan 限定于交互式编程和智能体工具;订阅 Key 不能用于自动化脚本、自定义应用后端或非交互批量调用。

阅读带来源的 Qwen3.8 功能与发布指南

团队应该优先评测哪些 Qwen3.8 工作负载

这些是基于预览版官方定位提出的评测优先级,并不表示 Qwen3.8 已被证明优于现有生产级替代模型。

1

仓库级编程

测试多文件修改、依赖追踪、实现质量,以及结果能否通过 lint、构建和自动化测试。

2

长时间 Agent 任务

衡量长会话中的工具选择、失败恢复、指令保持、循环行为和人工介入次数。

3

视觉与文档理解

按照任务级验收标准评测截图、图表、密集文档和图文混合输入。

4

研究与生产力流程

测试证据综合、数据分析、报告生成和办公流程,同时区分模型推理与内置工具产出。

接入生产流量前必须验证什么

只有预览列表还不足以支撑生产迁移。EvoLink 只会在确认并测试后发布具体路由事实。

仍待验证

最终模型 ID 与生命周期

Qwen3.8 扩大发布后,预览 ID 会继续有效、重定向到稳定别名,还是被正式模型取代?

仍待验证

EvoLink 可用性与价格

EvoLink 请求 ID、输入/输出价格、缓存计费和账单行为尚未公布。

仍待验证

速率限制与区域可用性

生产团队需要确认实际路由的并发、RPM/TPM、区域、配额和可用性表现。

仍待验证

工具与结构化输出可靠性

函数参数、Schema 遵循、工具恢复、流式输出和多轮推理历史都需要按路由测试。

仍待验证

延迟与成功任务成本

预览积分优惠不等于按 Token API 价格,应衡量端到端延迟、重试、输出长度和人工修正时间。

仍待验证

开放权重发布细节

Qwen 已宣布开放权重方向,但最终仓库、许可证、架构细节和发布时间仍待确认。

Qwen3.8 Max Preview 的核心特点是什么?

Qwen 官方文档记录了 1M 上下文、视觉理解、扩展推理控制、三种缓存模式和 Token Plan 工具。这让它值得关注仓库级编程与长时间 Agent,但 Token Plan 入口并不等于生产后端 API 路由。

无需暂停开发,也能为 Qwen3.8 做准备

关注经过验证的发布事实,比较最接近的替代方案,并准备可重放的生产评测。

Qwen3.8 Max API 常见问题

Qwen3.8 Max 正式发布了吗?

截至 2026 年 7 月 21 日,Qwen3.8 Max Preview 已正式进入 Qwen Token Plan,但仍是可能变化、移除或被正式版替代的预览模型。

现在能通过 EvoLink 使用 Qwen3.8 Max 吗?

暂时不能。EvoLink 尚未发布受支持的 Qwen3.8 路由。加入抢先体验即可获取确认后的可用性、模型 ID、价格和请求行为。

官方预览模型 ID 是什么?

Qwen Token Plan 文档列出的 ID 是 qwen3.8-max-preview。这是特定渠道的预览 ID,不应假定它就是最终 EvoLink 请求 ID。

Qwen3.8 和 Qwen3-8B 是同一个模型吗?

不是。Qwen3.8 是 2026 年模型家族的版本号;Qwen3-8B 则是旧版 Qwen3 家族中的 80 亿参数模型。Qwen3-8B 的下载、本地部署与价格页面都不能用于说明 Qwen3.8 Max Preview。

Qwen Token Plan 和标准 API 有什么区别?

Token Plan 是面向兼容交互式编程和 Agent 工具的订阅渠道,使用独立 Key 与 Credits。Qwen 禁止将该订阅 Key 用于自动化脚本或应用后端,因此它不能替代生产 API 路由。

Qwen3.8 支持 Prompt 缓存吗?

支持。Qwen 当前缓存文档为 qwen3.8-max-preview 列出显式缓存、隐式缓存和 Responses API 会话缓存。三者的创建成本、命中折扣、最低长度和保留时间不同;EvoLink 缓存规则仍需等路由激活后确认。

个人 Token Plan Key 能用于应用后端吗?

不能。Qwen 将个人 Token Plan 限定于交互式编程和智能体工具,禁止自动化脚本、自定义应用后端和非交互批量调用;生产使用需要等待获准的正式路由。

Qwen3.8 在 EvoLink 上的价格是多少?

EvoLink 尚未公布价格。Token Plan 订阅积分与促销倍率不能直接换算为 EvoLink 的按 Token 价格。

Qwen3.8 支持图片吗?

Qwen 官方 Token Plan 模型列表标明 qwen3.8-max-preview 支持视觉理解,但各生产渠道的具体输入格式和路由限制仍需验证。

Qwen3.8 会开放权重吗?

Qwen 已宣布计划开放权重,但截至 2026 年 7 月 21 日,最终仓库、许可证、架构披露和发布日期仍未确认。

现在应该替换 Qwen3.7 Max 吗?

默认不建议直接用于生产替换。应保留已有稳定路由,在预览版上重放代表性任务,并验证质量、延迟、可靠性和成功任务成本。

Qwen3.8 Token Plan 在哪里购买?

请只通过 Qwen 官方页面 qwencloud.com/pricing/token-plan 购买。它适用于兼容的交互式编程与 Agent 工具,不适用于自动化应用后端。

EvoLink 当前可用模型

Kimi K3 模型封面

Kimi K3

拥有已记录 EvoLink 路由,可用于编程、Agent、长上下文和多模态工作负载。

查看模型
Claude Opus 4.8 模型封面

Claude Opus 4.8

适用于复杂编程、长时间 Agent、研究和生产审查的高能力路由。

查看模型
GPT-5.6 模型封面

GPT-5.6

包含 Sol、Terra 和 Luna 档位,可适配不同质量与成本目标的生产推理模型系列。

查看模型