GPT Image 2.5 Flare 与 Sunburst 已上线 EvoLink立即体验

API 更新

获取所有 API 最新变更与改进通知。

2026年9月

2026-09-30

新模型 | Suno V6、Suno V6 Mini 与 Suno V6 Wild

models

Suno V6、Suno V6 Mini 与 Suno V6 Wild 已在 EvoLink 上线,Suno V6 成为 Suno 页面默认推荐的版本。三个模型与现有 Suno 音乐模型同价,按次计费,每次生成 2 首。

Suno V6

  • 模型 ID:suno-v6-beta
  • 特点:人声更自然,细节更丰富,音乐表现力更强
  • 支持:Persona 与自定义时长 duration(建议 60 秒及以上)

Suno V6 Mini

  • 模型 ID:suno-v6-mini-beta
  • 特点:轻量快速,兼顾质量与速度
  • 支持:Persona;暂不支持自定义时长 duration
  • 试用:在模型选择中切换到 Suno V6 Mini

Suno V6 Wild

  • 模型 ID:suno-v6-wild-beta
  • 特点:风格表达更大胆,更具辨识度
  • 支持:Persona 与自定义时长 duration
  • 试用:在模型选择中切换到 Suno V6 Wild

三个模型共同的规则

  • 价格:与现有 Suno 音乐模型相同,按次计费,与生成时长无关。详见价格
  • 长度上限:自定义模式(custom_mode=true)下歌词最多 5000 字符、风格最多 1000 字符
  • Persona 与时长:仅在自定义模式下可用
  • 异步任务:提交后轮询状态或使用 callback_url

所有 Suno 版本

  • 简单模式(custom_mode=false)的提示词上限从 500 字符提高到 3000 字符
2026-09-29

新模型 | GPT-6.1 Sol

models

GPT-6.1 Sol 已在 EvoLink 上线。OpenAI 对它的定位是:以更低成本,在复杂任务上接近 GPT-6 Astra 的表现,面向复杂编程、电脑操作与专业工作。

GPT-6.1 Sol

  • 模型 ID:gpt-6.1-sol —— 中间是点;GPT-6 Sol 仍以自己的 ID 继续提供
  • 擅长:复杂编程与调试、电脑操作、多步骤的专业工作
  • 上下文窗口:1,050,000 Token,最大输出 12.8 万 Token
  • 计费:普通输入、缓存读取、缓存写入与输出四项独立计量;OpenAI 的缓存读取官方价是 GPT-6 Sol 的一半。当前价格见 GPT-6.1 Sol 模型页
  • 长上下文:prompt Token 超过 27.2 万时,整个请求按长上下文价格结算 —— 输入与两种缓存 2 倍,输出 1.5 倍
  • 支持协议:兼容 OpenAI 的 Chat Completions 与 Responses,共用同一个 EvoLink API Key

相比 GPT-6 Sol 的变化

  • 思考强度:reasoning_effort(Chat)或 reasoning.effort(Responses)可设为 low、medium(默认)、high、xhigh,Responses 另支持 max;不再支持 none,原来发 none 的请求请改成 low
  • 工具调用:Chat Completions 只接受不带工具的请求;函数调用与内置工具请走 Responses
  • 参数:请从请求中删掉 temperature、top_p、logprobs 和 top_logprobs
2026-09-29

Claude Sonnet 5.5 | Anthropic 面向编程与 Agent 的最新 Sonnet

models

Anthropic 的 Claude Sonnet 5.5 现已在 EvoLink 上线 —— 接替 Claude Sonnet 5 且官方标价不变,适合日常编程、工具调用型 Agent 与高并发生产流量,具备 1M token 上下文窗口与最高 128K 最大输出。

Claude Sonnet 5.5

  • 模型 ID:claude-sonnet-5-5
  • 上下文窗口:1M token
  • 最大输出:128K token
  • 能力:真实代码库里的 Agent 编程、可靠的工具调用、adaptive thinking(默认开启)、视觉输入、提示缓存
  • 推荐场景:日常编程、工具调用型 Agent 与高并发生产流量
  • 计费:按 token 计费 —— 输入、输出、缓存写入、缓存命中;联网搜索工具在支持的路由上按次计费。当前价格见定价区
  • API:兼容 OpenAI 的 Chat Completions 与 Anthropic Messages,共用同一个 EvoLink API Key
2026-09-29

GLM、DeepSeek 与 Kimi K3 | 降价

pricing

EvoLink 上的 GLM、DeepSeek 与 Kimi K3 降价,自 2026 年 9 月 30 日(UTC+8) 起生效。本次涉及 GLM-5.3、GLM-5.3 Flash、GLM-5.3 FlashX、GLM-5.2、DeepSeek V4 Pro、DeepSeek V4 Flash、DeepSeek V4.1 Flash 与 Kimi K3:这些模型的输入和输出价格全部下调,其中多数模型的缓存读取价格下调或不变。新价自动应用,调用方式无需任何改动。

  • GLM-5.3 与 GLM-5.3 FlashX 的缓存读取价格小幅上调
  • deepseek-v4-flash-vision-exp 现由 DeepSeek V4.1 Flash 提供服务,按 DeepSeek V4.1 Flash 价格计费
2026-09-24

新模型 | Seedream 5.0 Flash 与 Seedream 5.0 Flash Layerize

models

Seedream 5.0 Flash 与 Seedream 5.0 Flash Layerize 已在 EvoLink 上线。Flash 是更快的 Seedream 5.0 模型,用于生图与编辑;Flash Layerize 把一张图拆成可编辑的图层。两者都按每张输出图一口价收费,为官方价格的 9 折。

Seedream 5.0 Flash

  • 模型 ID:doubao-seedream-5.0-flash
  • 生图与编辑:支持文生图、图生图和编辑,最多 10 张参考图;size 支持 auto、画面比例或自定义像素;quality 可选 1K、1.5K、2K。透明输出仅保留单张参考图已有的 alpha,必须输出 PNG,不是自动抠图
  • 价格:每张输出图一口价——1K、1.5K、2K 同价,参考图不收费。详见价格

Seedream 5.0 Flash Layerize

  • 模型 ID:doubao-seedream-5.0-flash-layerize
  • 输入:恰好 1 张 png 或 jpeg 图片;prompt 可选
  • 输出:1 张底图加最多 16 张透明 PNG 图层,每层带叠放顺序和位置框
  • 价格:每张输出图(底图和每个图层)都按与 Flash 相同的一口价计费;任务开始时最多预留 17 张的费用,未用完的部分退回

两个模型共同的规则

  • 请求与 Seedream 5.0 Pro 一致:quality 可选 1K、1.5K、2K(Layerize 另支持 auto)
  • 提示词模式:prompt_priority 只支持 standard,传 fast 会被拒绝且不收费
  • 异步任务:提交后轮询状态或使用 callback_url
2026-09-23

新模型 | GPT-6 Sol 与 GPT-6 Luna

models

GPT-6 Sol 与 GPT-6 Luna 已在 EvoLink 上线,和 GPT-6 Astra 组成 GPT-6 三档。Sol 为复杂编程与 Agent 工作流打造;Luna 是 OpenAI 效率最高的 GPT-6 模型,面向聚焦、大批量的任务。

GPT-6 Sol

  • 模型 ID:gpt-6-sol —— 没有通用的 gpt-6 别名
  • 擅长:复杂编程、多文件修改与工具驱动的 Agent
  • 计费:普通输入、缓存读取、缓存写入与输出四项独立计量。当前价格见 GPT-6 Sol 模型页

GPT-6 Luna

  • 模型 ID:gpt-6-luna
  • 擅长:大批量的分类、信息抽取、路由与子 Agent 调用
  • 计费:同样按四项独立计量。当前价格见 GPT-6 Luna 模型页

两个模型共同的规格

  • 上下文窗口:1,050,000 Token,最大输出 12.8 万 Token
  • 长上下文:prompt Token 超过 27.2 万时,整个请求按长上下文价格结算 —— 输入与两种缓存 2 倍,输出 1.5 倍
  • 支持协议:兼容 OpenAI 的 Chat Completions 与 Responses,共用同一个 EvoLink API Key
  • 思考强度:reasoning_effort(Chat)或 reasoning.effort(Responses)可设为 none、low、medium(默认)、high、xhigh、max —— 其中 none 是相比 GPT-6 Astra 新增的一档
  • 工具调用:内置工具与函数调用使用 Responses;在 Chat Completions 上,只有 reasoning_effort 为 none 时才能使用函数调用
2026-09-23

GPT-5.6 Sol | 降价

pricing

EvoLink 上的 GPT-5.6 Sol 全面降价,跟随 OpenAI 对该模型的新官方定价,自 2026 年 9 月 23 日(UTC+8) 起生效。输入、缓存读取、缓存写入和输出价格均已下调,长上下文价格同步下调。新价自动应用,继续调用 gpt-5.6-sol 即可,调用方式无需任何改动。

2026-09-22

新模型 | Claude Opus 5.5

models

Claude Opus 5.5 —— Anthropic 最新的 Opus 模型,接替 Claude Opus 5 且官方标价更低 —— 已在 EvoLink 上线。

可用性

Claude Opus 5.5 已可在 EvoLink 生产 API 上调用,沿用同一个 EvoLink API Key。Claude Opus 5.5 模型页 是实时价格与参数的准确来源。

模型 ID

  • claude-opus-5-5 —— 100 万 Token 上下文窗口,最大输出 12.8 万 Token

计费维度

输入、缓存写入、缓存读取、输出与联网搜索工具,共五个维度独立计量。联网搜索按次计费,搜索结果带入请求的内容另按普通输入 Token 计费。当前价格见定价区。

从 Claude Opus 5 迁移

Anthropic 给 Opus 5.5 的每一档 Token 标价都低于 Opus 5,缓存读取更是从输入价的十分之一降到了 二十分之一。有三项请求设置行为不同:思考不能关闭 —— 传 thinking: {type: "adaptive"} 或直接省略该参数,用 effort 控制思考深度;effort 默认值从 high 变为 medium;强制指定工具(any 或 tool)会被拒绝,请改用 auto。

支持协议

兼容 OpenAI 的 Chat Completions 与 Anthropic Messages,共用同一个 EvoLink API Key。

试用 Claude Opus 5.5 | 查看价格

2026-09-22

Grok 4.7 | xAI 最新推理模型,价格与 Grok 4.6 持平

models

Grok 4.7 已在 EvoLink 上线,500,000 Token 上下文,Chat Completions 与 Responses 两个端点都可用。

价格 —— 与 Grok 4.6 逐项相同

  • 输入:每 100 万 Token 挂牌价 $2.00
  • 缓存读取:每 100 万 Token $0.50
  • 输出:每 100 万 Token $6.00,思考 Token 计入输出
  • 提示词达到 200,000 Token 后,该请求的全部 Token 进入长上下文档,按 2 倍计价
  • 模型页上显示的是你账户实际执行的单价

与 Grok 4.6 的差异

  • 请求用的模型 ID 是 grok-4.7;页面地址里的 grok-4-7 不能当请求参数用
  • reasoning_effort 接受 low、medium、high(默认)、xhigh 四档
  • Responses 端每一次响应都会返回加密思考内容,不需要在 include 里声明
  • 知识截止时间变为 2026 年 5 月
2026-09-22

Grok X 搜索 | 改为按抓取的帖子与用户资料计费

modelspricing

Grok 的 X 搜索改为按一次搜索返回了什么计费,不再按运行了多少次计费。xAI 于 2026 年 9 月 21 日 12:00(太平洋时间)起执行,grok-4.5、grok-4.6、grok-4.7 三代同时适用。

费率 —— 2026 年 9 月 21 日起

  • 抓取的帖子:每 1,000 条 $5,原为每 1,000 次调用 $5
  • 抓取的用户资料:每 1,000 个 $10,这是新增的计费项
  • 一次搜索或 thread 拉取返回的每条帖子都计数,父帖与引用帖同样计入,且不去重
  • 其余服务端工具单价不变:网页搜索、代码执行各为每 1,000 次 $5,附件搜索每 1,000 次 $10,集合检索每 1,000 次 $2.50

对账单的实际影响

  • 旧口径下,一次 x_search 返回 1 条还是 30 条帖子都按一次算;现在逐条计费
  • 会拉取长 thread 的搜索明显变贵,可以用 search_parameters.max_search_results 控制返回量
  • Token 费用不受影响,仍与工具费分开计算
2026-09-22

Seedance 2.5 更新 | 样片模式与样片转正式

models

Seedance 2.5 支持两步式样片流程:先快速预览,满意再生成正式视频。

新增

  • 样片模式:在五个 Seedance 2.5 生成模型上传 draft: true(或在 Playground 打开样片模式),快速得到 480p 预览,用于确认场景结构、镜头运动与主体动作。计费与普通 480p 视频相同
  • seedance-2.5-draft-to-video:只需 source_task_id 与可选的 output_format,把已完成的样片转成 1080p 正式视频。提示词、素材、时长、比例、种子与音频设置沿用样片

说明

  • 样片与正式视频分别计费,正式视频按 1080p 计费;内容审核开关沿用样片,转正式时不能更改
  • 样片完成后返回 draft_expires_at,请在该时间前转换;过期后转换返回 410 draft_task_expired
2026-09-21

GLM-5.3 FlashX | 5.3 家族新增吞吐档

models

GLM-5.3 FlashX 已上线。它卡在 GLM-5.3 Flash 与 GLM-5.3 旗舰之间:同样是原生多模态、100 万 Token 上下文、思考常开,价格约为旗舰的四分之一。

  • 模型 ID glm-5.3-flashx,支持 Chat Completions、Responses 与 Anthropic Messages
  • 文本、图片、视频、文件输入;缓存读取走单独的低费率
  • 联网搜索按次单独计费,与 Token 用量分开
  • 推理强度接受 low、high、max,其余取值会映射到最接近的可用档

模型页展示的是你账户当前的实时单价。具体数字见价格页。

2026-09-17

新模型 | MiniMax H3 Max 参考生视频

models

MiniMax H3 Max 新增一条参考生视频路由,支持参考图、参考视频与参考音频。输出按秒计费,参考视频有独立且更高的单价。

MiniMax H3 Max 参考生视频

  • 模型 ID:minimax-h3-max-reference-to-video
  • 参考素材:最多 9 张图、3 段视频、3 段音频,合计不超过 12 个。必须至少有一张参考图或一段参考视频——只传音频会被拒绝
  • 输出:768p 或 480p MP4,5–15 秒,画面比例默认跟随参考素材。H3 Max 没有 2K 档
  • 价格:分三段计费——输出秒、参考视频秒(独立单价,比输出更贵)、超出免费额度的参考图。参考音频不计费。详见价格
  • 免费图额度:前 2 张参考图免费。MiniMax H3 是 5 张,同一个需求搬过来可能更贵——迁移前先看估价
  • 不支持:image_start / image_end
  • 异步任务:提交后轮询状态,或使用 callback_url
2026-09-17

新模型 | MiniMax H3 Max Turbo

models

MiniMax H3 Max 的极速档 MiniMax H3 Max Turbo 已在 EvoLink 上线,提供两条路由,输出 768p / 480p,按秒计费。

MiniMax H3 Max Turbo

  • 模型 ID:minimax-h3-max-turbo-text-to-video、minimax-h3-max-turbo-image-to-video
  • 输出:768p 或 480p MP4,5–15 秒。画面比例 21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16——文生视频必须给具体比例(默认 16:9)
  • 价格:按输出秒计费,同分辨率下按 Turbo 官方价格的 95 折收费;每个任务的最低计费等于最便宜的合法请求(480p × 5 秒)。详见价格
  • 图生视频:image_start(首帧)必填,image_end(尾帧)可选;不支持只传尾帧。这条路由不支持指定画面比例,输出始终跟随输入图的比例
  • 默认分辨率:不传 quality 的请求按 768p 出片;要用最便宜的档位请显式传 "quality": "480p"
  • Turbo 不提供:2K 输出、4 秒时长,以及任何形式的参考素材驱动生成——不支持参考图、参考视频、参考音频。需要参考素材时请用 MiniMax H3 或 MiniMax H3 Max
  • 异步任务:提交后轮询状态或使用 callback_url
2026-09-17

Seedance 2.5 | 1080p 恢复原价

pricing

Seedance 2.5 1080p 输出的限时 7.2 折已于 2026 年 9 月 17 日(UTC+8) 按期结束,五个模型的 1080p 均恢复原价。API 调用无需改动。

  • 480p 与 720p 价格不变
  • 适用于 seedance-2.5-text-to-video、seedance-2.5-image-to-video、seedance-2.5-reference-to-video、seedance-2.5-video-edit、seedance-2.5-video-extend

Playground 估价与价格页已同步显示原价。当前秒价请见价格页。

2026-09-16

MiniMax H3 Max | 两档统一降价 5%

modelspricing

MiniMax H3 Max 的文生视频和图生视频在两个输出档位均降价 5%。

价格 —— 2026 年 9 月 16 日起打 95 折

  • 768p:每输出秒 $0.076,原价 $0.080
  • 480p:每输出秒 $0.0475,原价 $0.050
  • 最低消费:每个任务 $0.2375,原为 $0.250(480p × 5 秒)
  • 两条路由同价:minimax-h3-max-text-to-video、minimax-h3-max-image-to-video

选择输出档位

  • 不传 quality 的请求按 768p 出片;要使用最低单价,请显式传 "quality": "480p"
  • 两档均支持 5–15 秒输出,按输出视频秒数计费
2026-09-10

新模型 | DeepSeek V4.1 Flash

models

DeepSeek V4.1 Flash 新增原生图像理解,适合编程、文档和截图类工作流。上线前请在模型页查看当前价格。

DeepSeek V4.1 Flash

  • 模型 ID:EvoLink 上为 deepseek-v4.1-flash;页面地址是 /deepseek-v4-1-flash
  • 上下文窗口:1,000,000 Token,最大输出 38.4 万 Token;请按任务设定输出预算
  • 计费:输入、缓存命中与输出分别计价。请查看模型页价格区和账户最终扣费;每 Token 单价不能单独决定任务成本
  • 图像输入:支持 PNG、JPEG、WebP 与 GIF。扩量前先用代表性图片测量用量
  • 支持协议:Chat Completions、Messages 与 Responses 使用同一个模型 ID;图片字段不同,分别是 image_url、image 内容块与 input_image
  • 思考与缓存:思考模式默认开启,前缀缓存自动生效;请记录请求中发送的思考设置,核对所用协议的文档,并从 usage 读取缓存命中 Token
  • 旧模型路线:在 EvoLink 上,deepseek-v4-flash 与 deepseek-v4-pro 不受影响,继续提供 V4 Flash 与 V4 Pro;deepseek-v4-flash-vision-exp 现已重定向到 V4.1 Flash。详见迁移指南
2026-09-09

新模型 | GPT Image 2.5 Sunburst 与 Flare

models

GPT Image 2.5 Sunburst 与 GPT Image 2.5 Flare 现已在 EvoLink 上线——这是 OpenAI 于 2026 年 9 月 8 日发布的两个 GPT Image 2.5 模型,token 费率与 GPT Image 2 相同。

GPT Image 2.5 Sunburst

  • 模型 ID:gpt-image-2.5-sunburst(没有别名,请使用完整 ID)
  • 定位:OpenAI 面向最看重编辑精度的工作流,多轮编辑控制更紧,生成时间更长
  • 输入:文本提示词、最多 16 张参考图与可选的局部重绘蒙版;输出:图像
  • 画质:五档 low / medium / high / xhigh / max(默认 medium);尺寸 auto、15 种比例或显式 WxH;分辨率 1K / 2K / 4K
  • 计费:按 token——图像输出、图像输入、缓存输入与文本输入 token 按上游 usage 结算;费率见定价区
  • 调用方式:POST /v1/images/generations,异步任务,轮询或 callback_url 取结果

GPT Image 2.5 Flare

  • 模型 ID:gpt-image-2.5-flare(没有别名,请使用完整 ID)
  • 定位:OpenAI 给日常高质量生图的快速默认选择——质量高于 GPT Image 2,延迟最多降低 50%(OpenAI 数据)
  • 输入:文本提示词、最多 16 张参考图与可选的局部重绘蒙版;输出:图像
  • 画质:五档 low / medium / high / xhigh / max(默认 medium);尺寸 auto、15 种比例或显式 WxH;分辨率 1K / 2K / 4K
  • 计费:按 token——图像输出、图像输入、缓存输入与文本输入 token 按上游 usage 结算;费率见定价区
  • 调用方式:POST /v1/images/generations,异步任务,轮询或 callback_url 取结果

费率相同不等于账单相同:各画质档消耗的输出 token 不同,且 GPT Image 2.5 每档的 tile 基数比 GPT Image 2 低(它的 high 大约相当于 GPT Image 2 的 medium)。标准化选档前,先在 Playground 或价格计算器里估一次。

2026-09-07

降价延期 | Seedance 2.0 Mini 与 Fast

pricing

Seedance 2.0 Mini 与 Seedance 2.0 Fast 的限时降价原定今日结束,现延长至 2026 年 10 月 6 日(UTC+8)。价格与折扣力度均保持不变,折后价依旧自动生效,调用方式无需任何改动。Seedance 2.0 Standard 仍不在本次活动范围内。

  • Seedance 2.0 Mini:全线 4 折(省 60%)
  • Seedance 2.0 Fast:全线 75 折(省 25%)

降幅继续适用于全部清晰度与全部生成方式(文生视频、图生视频、参考生视频)。当前费率请见各模型定价页。

活动将于 2026 年 10 月 6 日(UTC+8) 结束,届时两个模型恢复原价。

2026-09-04

新模型 | GPT-6 Astra

models

GPT-6 Astra —— OpenAI 能力最强的模型,面向最难的端到端推理、编程、电脑操作与研究任务 —— 已在 EvoLink 上线,价格为 OpenAI 官方价 9 折。

GPT-6 Astra

  • 模型 ID:gpt-6-astra —— 没有通用的 gpt-6 别名
  • 上下文窗口:1,050,000 Token,最大输出 12.8 万 Token
  • 计费:普通输入、缓存读取、缓存写入与输出四项独立计量,每一项都是 OpenAI 官方价的 9 折。当前价格见 GPT-6 Astra 模型页
  • 长上下文:prompt Token 超过 27.2 万时,整个请求按长上下文价格结算 —— 输入与两种缓存 2 倍,输出 1.5 倍
  • 支持协议:兼容 OpenAI 的 Chat Completions 与 Responses,共用同一个 EvoLink API Key;OpenAI 要求工具调用使用 Responses
  • 思考强度:reasoning_effort(Chat)或 reasoning.effort(Responses)可设为 low、medium、high、xhigh、max —— none 与 minimal 会被拒绝,且不接受 temperature 与 top_p
  • 同时支持:提示词缓存与结构化输出,两个接口都可用
2026-09-03

新模型 | MiniMax H3 Max

models

MiniMax Hailuo 家族的极速生成版本 MiniMax H3 Max 已在 EvoLink 上线,提供两条路由,输出 768p / 480p,按秒计费。

MiniMax H3 Max

  • 模型 ID:minimax-h3-max-text-to-video、minimax-h3-max-image-to-video
  • 输出:768p 或 480p MP4,5–15 秒。画面比例 21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16——文生视频必须给具体比例(默认 16:9)
  • 价格:768p 每输出秒 $0.080,480p 每输出秒 $0.050,两条路由同价;每个任务的最低计费等于最便宜的合法请求(480p × 5 秒,$0.25)
  • 图生视频:可只传首帧、只传尾帧或同时传两张。这条路由不支持指定画面比例,输出始终跟随输入图的比例
  • 默认分辨率:不传 quality 的请求按 768p 出片;要用最便宜的档位请显式传 "quality": "480p"
  • H3 Max 不提供:2K 输出、4 秒时长,以及参考素材驱动生成。需要 2K 或参考图、参考视频、参考音频时请用 MiniMax H3
  • 异步任务:提交后轮询状态或使用 callback_url
2026-09-02

新模型 | Gemini 3.8 Flash

models

Gemini 3.8 Flash 现已在 EvoLink 上线,与 Gemini 3.7 Flash 同价。

它是 Google 目前最强的 Flash 模型,在软件工程、计算机操作与多步智能体任务上较 3.7 有明显提升,同时保持 Flash 档的吞吐与成本。

Gemini 3.8 Flash

  • 模型 ID:gemini-3.8-flash
  • 上下文:1,048,576 Token;最大输出:65,536 Token
  • 输入:文本、图像、音频、视频、PDF;输出:文本
  • 能力:思考、系统指令、结构化输出、上下文缓存、函数调用、代码执行、Google 搜索 / 地图 grounding
  • 价格:输入 $0.675/百万 Token,输出 $3.375/百万 Token,缓存命中 $0.0676/百万 Token(限时价,2026 年 12 月 31 日前)
  • 调用方式:同时支持 /v1/chat/completions(OpenAI 风格)与 Gemini 原生接口

思考档位与 3.7 相同

Gemini 3.8 Flash 与 3.7 一样不支持 minimal 档,可用档位为 low / medium / high,默认 medium。

从 3.7 迁移时,如果你的代码里设置了 reasoning_effort: "none" 或 "minimal"(原生接口对应 thinkingLevel: "MINIMAL"),EvoLink 会自动降级为 low,请求不会失败。若希望明确控制,建议显式改为 low。

除更换模型 ID 外无需任何改动:3.8 与 3.7 在上下文窗口、最大输出、模态与官方价格上逐项一致。若你是从 3.6 Flash 或更早版本迁移,Google 官方迁移清单仍要求:移除自定义 temperature、top_p、top_k 与 candidate_count,把数值型 thinking_budget 换成 thinking_level 字符串,并移除预填的 model 轮次。

2026-09-02

新模型 | Claude Fable 5.1

models

Claude Fable 5.1 —— Anthropic 能力最强的模型,位于 Opus 之上的 Fable 档 —— 已在 EvoLink 上线,Token 价格为官方价 95 折。

可用性

Claude Fable 5.1 已可在 EvoLink 生产 API 上调用,沿用同一个 EvoLink API Key。Claude Fable 5.1 模型页 是实时价格与参数的准确来源。

模型 ID

  • claude-fable-5-1 —— 100 万 Token 上下文窗口,最大输出 12.8 万 Token

计费维度

输入、缓存写入、缓存读取、输出与联网搜索工具,共五个维度独立计量。Token 价格为官方价 95 折;联网搜索按次计费、维持官方原价不打折,且搜索结果带入请求的内容另按普通输入 Token 计费。当前价格见定价区。

从 Claude Fable 5 迁移

Anthropic 官方的输入、输出与缓存写入价格均未变化。差别在于 Anthropic 把缓存读取价降到了 Fable 5 的四分之一 —— 缓存密集的智能体运行和长时间编程会话会明显更便宜。在 EvoLink,其余三档比 Fable 5 高约 5.6%:Fable 5 走官方价 9 折,5.1 走 95 折。

支持协议

兼容 OpenAI 的 Chat Completions 与 Anthropic Messages,共用同一个 EvoLink API Key。该模型的思考恒为开启:传 thinking: {type: "adaptive"} 或直接省略该参数,并用 effort 而不是采样参数来控制思考深度。

试用 Claude Fable 5.1 | 查看价格

2026-09-01

价格调整 | Claude Sonnet 5

pricing

Anthropic 已将 Claude Sonnet 5 的降价永久化。EvoLink 同步把上新期的优惠价固定为长期价:每 Token 实付金额不变,且不会再因促销到期而回涨。

变化的部分

  • 官方标价永久下调:输入 $3.00 → $2.00/1M tokens,输出 $15.00 → $10.00/1M tokens,缓存写入 $3.75 → $2.50/1M tokens,缓存读取 $0.30 → $0.20/1M tokens。
  • 你在 EvoLink 的实付单价不变。 原定 8 月 31 日结束的限时上新优惠已转为长期价,不存在到期涨价。
  • 页面上的折扣数字会变。 此前折扣是相对旧标价 $3.00 计算的;官方价永久降到 $2.00 后,同样的 EvoLink 单价显示为官方价 9 折。实际扣费金额完全一致。

不变的部分

模型 ID 仍为 claude-sonnet-5,100 万 Token 上下文窗口与 12.8 万最大输出不变,兼容 OpenAI 的 Chat Completions 与 Anthropic Messages 两条协议均照常可用,你的调用代码无需任何改动。联网搜索工具仍按次、按官方原价计费。

当前费率始终以 Claude Sonnet 5 模型页为准。

Claude Sonnet 5 | 查看价格