GPT Image 2.5 Flare 与 Sunburst 已上线 EvoLink立即体验

GPT-5.6 API

通过 EvoLink 统一对话 API 接入 OpenAI 的 GPT-5.6(也常被搜索为 GPT 5.6 / gpt-5.6-sol / terra / luna)。集成前可先测试推理、工具调用、结构化输出。

OpenAI文本生成可用
输入价格低至 $0.181 / 1M tokens$0.200 官方价-10%
API 文档
Chat CompletionsResponses API推理强度提示词缓存工具调用
生产路由已上线
上下文
1.05M 上下文 · 最大输出 128K
适用场景
编程、生产级 Agent、复杂推理
可输入
文本
输出形态
文本 · JSON(结构化输出)· 工具调用

选择 GPT-5.6

三个变体共用同一套 OpenAI 兼容接入,只需切换精确模型 ID,即可在能力、延迟和成本之间取舍。

GPT-5.6 Sol

旗舰档位,面向最高推理深度与 Agent 能力。

已选择
模型 ID
gpt-5.6-sol
适合

高难推理、编程 Agent 与高价值工作流

< 272K
输入
$3.600 / 1M-10%
244.8 cr / 1M$4.000官方价
缓存读取
$0.361 / 1M-10%
24.5 cr / 1M$0.400官方价
缓存写入
$4.500 / 1M-10%
306 cr / 1M$5.000官方价
输出
$18.000 / 1M-10%
1224 cr / 1M$20.000官方价
≥ 272K
输入
$7.200 / 1M-10%
489.6 cr / 1M$8.000官方价
缓存读取
$0.721 / 1M-10%
49 cr / 1M$0.800官方价
缓存写入
$9.000 / 1M-10%
612 cr / 1M$10.000官方价
输出
$27.000 / 1M-10%
1836 cr / 1M$30.000官方价

GPT-5.6 Terra

均衡档位,兼顾生产级推理效果与成本。

模型 ID
gpt-5.6-terra
适合

产品功能、分析、对话与日常 Agent

< 272K
输入
$1.800 / 1M-10%
122.4 cr / 1M$2.000官方价
缓存读取
$0.181 / 1M-10%
12.3 cr / 1M$0.200官方价
缓存写入
$2.250 / 1M-10%
153 cr / 1M$2.500官方价
输出
$10.800 / 1M-10%
734.4 cr / 1M$12.000官方价
≥ 272K
输入
$3.600 / 1M-10%
244.8 cr / 1M$4.000官方价
缓存读取
$0.362 / 1M-10%
24.6 cr / 1M$0.400官方价
缓存写入
$4.500 / 1M-10%
306 cr / 1M$5.000官方价
输出
$16.200 / 1M-10%
1101.6 cr / 1M$18.000官方价

GPT-5.6 Luna

高速低成本档位,适合大规模调用。

模型 ID
gpt-5.6-luna
适合

低延迟对话、信息抽取与规模化自动化

< 272K
输入
$0.181 / 1M-10%
12.3 cr / 1M$0.200官方价
缓存读取
$0.020 / 1M-4%
1.3 cr / 1M$0.020官方价
缓存写入
$0.225 / 1M-10%
15.3 cr / 1M$0.250官方价
输出
$1.081 / 1M-10%
73.5 cr / 1M$1.200官方价
≥ 272K
输入
$0.362 / 1M-10%
24.6 cr / 1M$0.400官方价
缓存读取
$0.039 / 1M-4%
2.6 cr / 1M$0.040官方价
缓存写入
$0.450 / 1M-10%
30.6 cr / 1M$0.500官方价
输出
$1.622 / 1M-10%
110.25 cr / 1M$1.800官方价

所有费率按每百万 Token 计,同时显示美元与 Credits,以你账户当前的价格为准。 提示 Token 超过 272K 后进入长上下文档位:输入与缓存角色 ×2,输出 ×1.5。

GPT-5.6 价格

集成前先估算一次 GPT-5.6 请求的费用。计算器按你账户的当前费率计算,官方价格仅作对照。

请求费用计算器

输入一次请求的 Token 组合。

单次请求预估

GPT-5.6 Sol
短上下文费率
USD$0.0091
Credits0.6169

官方价预估 $0.011 · 省 $0.0011(10%)

输入 Token0.2448 cr
缓存读取 Token0.0049 cr
缓存写入 Token0 cr
输出 Token0.3672 cr

最低计费:每次请求 0.01 Credits。 提示 Token 达到 272K 时,输入与缓存角色按 ×2、输出按 ×1.5 计费;工具调用不乘倍率。

预算指南

按当前 Token 组合估算可发起的请求数。
充值 Credits
$10
约 1053 次请求

快速测试

$50
约 5511 次请求

日常开发

$100
约 11022 次请求

生产评估

GPT-5.6 API — Sol、Terra 与 Luna

一把 EvoLink API Key 即可使用 GPT-5.6 三个档位:Sol 面向最高能力,Terra 兼顾效果与成本,Luna 适合高并发与成本敏感场景。

GPT-5.6 在 EvoLink 上以模型 ID gpt-5.6-sol 提供,支持 Chat Completions · Responses,和其他模型共用同一把 API 密钥与余额。它提供 1.05M 上下文窗口,最大输出 128K Token,并支持推理、工具调用、结构化输出。

GPT-5.6

GPT-5.6 规格与能力

数字取自 EvoLink 路由配置;能力以 API 当前实际提供为准。

上下文窗口
1.05M Token
最大输出
128K Token
输入
文本
输出
文本 · JSON(结构化输出)· 工具调用
工具调用
函数调用,支持多步工具序列
提示缓存
缓存写入 + 缓存读取两种费率
长上下文档位
提示 Token 超过 272K 后输入 ×2 / 输出 ×1.5
协议
Chat Completions · Responses
模型 ID
gpt-5.6-sol

GPT-5.6 最适合做什么

按负载选档位:Sol 求深度,Terra 跑日常生产,Luna 跑大流量。

用 GPT-5.6 Sol 做智能体编码与大型重构

多文件修改、代码审阅和重度工具调用的智能体循环,推理深度能换回成本。

用 GPT-5.6 Terra 做生产助手

面向客户的对话、文档问答和结构化抽取,价格与质量平衡。

用 GPT-5.6 Luna 做大批量分类与路由

打标、分诊和轻量摘要,按 Token 成本说话的场景。

最长 1M Token 的长上下文分析

整仓代码或整批文档一次载入,用提示词缓存把重复上下文的成本压下来。

两种方式使用 GPT-5.6:EvoLink API 或 Agent

产品后端与批量任务走 EvoLink API;编码与分析类工作可直接在 Codex、Claude、Gemini 里调用 GPT-5.6。两条路径共用同一把 EvoLink API 密钥、余额、模型 ID 与请求记录。

方式一

用 EvoLink API 接入

适合:产品后端、批量任务、自动化流水线

向 EvoLink 发送 OpenAI 兼容的 Chat Completions(或 Anthropic Messages)请求,自行控制模型 ID、系统提示、输出预算、工具与结构化输出。

  1. 1在控制台创建 EvoLink API 密钥
  2. 2把 OpenAI 或 Anthropic SDK 的 base URL 指向 EvoLink,并选择上方显示的模型 ID
  3. 3先发一条有代表性的请求,从 usage 字段读取输入、缓存与输出 token
  4. 4按任务设置 max_tokens 与重试;多轮时保留 tool-call ID 与工具结果
方式二

用 Agent 调用

适合:在 Codex、Claude、Gemini 里做编码、评审与分析

把任务、要带入的材料和验收标准交给 Agent,由它组装请求、通过 EvoLink 调用 GPT-5.6,并把回答连同 token 用量一起返回。

  1. 1在本地环境变量里配置 EVOLINK_API_KEY,不要写进代码或提示词
  2. 2描述任务、要带入的材料和期望的输出格式
  3. 3让 Agent 通过 EvoLink 调用 GPT-5.6,并在发送前先展示请求
  4. 4让 Agent 汇报回答、token 用量和任何错误信息

GPT-5.6 API 代码示例与错误处理

这个示例是最短可运行的请求:一条 OpenAI 兼容的 Chat Completions 调用,带系统提示、用户消息和输出预算。完整参数与响应说明见 API 标签页。

查看完整 API 文档
cURL
curl -X POST https://api.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.6-sol",
    "messages": [
      { "role": "system", "content": "You are a senior engineer reviewing a pull request." },
      { "role": "user", "content": "Review this diff and list the blocking issues with file and line:\n<diff>" }
    ],
    "max_tokens": 4096,
    "temperature": 0.2
  }'

# Swap the model ID for gpt-5.6-terra or gpt-5.6-luna to change the tier.
# The response includes choices[0].message and a usage object
# (prompt_tokens, completion_tokens, and cached tokens when a prefix is
# reused).

请求无效或参数不支持

对照 API 文档检查模型 ID、messages 数组和参数范围,去掉该路由不支持的字段。

鉴权或余额问题

检查 Authorization bearer token,并在控制台确认可用余额。

超出上下文长度

提示词 token 超过了 GPT-5.6 的上下文窗口。裁剪或只检索相关材料,并复用缓存前缀。

触发限流(429)

退避并带抖动重试;用批处理或队列代替并发突发。

内容或工具调用被拒

重试前检查敏感内容、格式错误的 tool-call 参数和 JSON schema 不匹配。

把 GPT-5.6 接入生产前

决定成本与稳定性的四项检查。

01

选准 GPT-5.6 模型 ID

用 gpt-5.6-sol、gpt-5.6-terra 或 gpt-5.6-luna,没有通用的 gpt-5.6 别名。

必做
02

给 272K 长上下文阈值留预算

提示词超过 272K Token 后整个请求按长上下文费率计费,能压在线下就压在线下。

建议
03

按缓存读取来组织提示词

把稳定的指令和参考资料放在最前面,重复调用时缓存读取替代全价输入。

建议
04

按 usage 核算,不看标价

扩流量前先用 usage 对象(未缓存输入、缓存读取、缓存写入、输出)对账。

必做

四段提示词缓存计费

普通输入、缓存读取、缓存写入和输出根据最终 usage 分开结算;缓存写入不会再次按普通输入收费。

长上下文阈值

prompt tokens 超过 272K 后,整个请求的输入与两种缓存价格变为 2 倍,输出价格变为 1.5 倍。

GPT-5.6 与其他文本模型对比

EvoLink

按每 1M tokens 的 EvoLink 价格,对比当前所选 GPT-5.6 档位与同类旗舰文本模型。

GPT-5.6 Sol
EvoLink 每 1M 价格(输入 / 输出)$3.6 / $18
上下文窗口1.05M
提示词缓存缓存读取 + 缓存写入
适用场景高难推理、编程 Agent 与高价值工作流
Claude Opus 4.8
EvoLink 每 1M 价格(输入 / 输出)$4.5 / $22.5
上下文窗口1M
提示词缓存缓存读取 + 5 分钟/1 小时写入
适用场景Anthropic 旗舰模型,适合深度推理、编程与长时间运行的 Agent。
Gemini 3.1 Pro
EvoLink 每 1M 价格(输入 / 输出)$1.865 / $11.183
上下文窗口1M
提示词缓存上下文缓存
适用场景Google 旗舰模型,适合多模态推理与大上下文工作负载。

表中使用基础上下文档位和当前 EvoLink 用户组价格;登录用户展示所属用户组价格,未登录用户展示 Default 价格。长上下文倍率请查看各模型 Pricing。

GPT 模型家族

同一把 API 密钥、同一份余额,换档位不用改接入。

查看全部 GPT 模型
GPT-6.1 Sol

GPT-6.1 Sol

新版 Sol,适合多文件编程与 Responses 工具 Agent

查看模型
GPT-6 Astra

GPT-6 Astra

用已可调用的 GPT-5.6 对照 GPT-6 Astra 官方规格,在升级前明确成本、评测、灰度与回退门槛

查看模型
GPT-6 Sol

GPT-6 Sol

为复杂编程与 Agent 工作流打造的 GPT-6 模型

查看模型

GPT-5.6 之外的其他文本模型

Claude Opus 4.8

Claude Opus 4.8

Anthropic 旗舰模型,适合深度推理、编程与长时间运行的 Agent。

查看模型
Gemini 3.1 Pro

Gemini 3.1 Pro

Google 旗舰模型,适合多模态推理与大上下文工作负载。

查看模型
Grok 4.5

Grok 4.5

xAI 推理与工具调用路由,提供 50 万上下文,适合联网研究与 Agent 工作流。

查看模型
Kimi K3

Kimi K3

Moonshot 长上下文推理模型,适合仓库级编程与多文档工作。

查看模型

GPT-5.6 API - 常见问题

有哪些可用模型 ID?

请使用 gpt-5.6-sol、gpt-5.6-terra 或 gpt-5.6-luna;当前不提供通用 gpt-5.6 别名。

缓存输入如何计费?

缓存读取与缓存写入是两个独立 token 分段,二者都不会再按普通输入重复收费。

什么时候使用长上下文价格?

总 prompt tokens 超过 272,000 时,整个请求按价格表中的长上下文倍率结算。

在 EvoLink 上能用 OpenAI SDK 调 GPT-5.6 吗?

可以。把 SDK 的 base URL 指到 EvoLink,用 EvoLink API Key,选三个 GPT-5.6 模型 ID 之一即可。

GPT-5.6 该从哪个档位开始?

大多数生产工作从 Terra 起步,任务需要更深推理时换 Sol,大流量、成本敏感的请求用 Luna。

GPT-5.6 支持工具调用和结构化输出吗?

支持。三个档位都支持函数调用和 JSON 结构化输出,走标准 Chat Completions 字段。