GPT Image 2.5 Flare 与 Sunburst 已上线 EvoLink立即体验

GPT-6.1 Sol API

接入 OpenAI 的 GPT-6.1 Sol,处理跨文件代码修改与工具驱动的 Agent 任务,支持 1.05M 上下文。通过一把 EvoLink API 密钥比较 Token 费率并保留 GPT 模型选择;工具调用使用 Responses。

OpenAI文本生成可用
输入价格低至 $1.800 / 1M tokens$2.000 官方价-10%
API 文档
Chat(无工具)Responses 工具推理档位提示词缓存文本与图像输入
生产路由已上线
上下文
1.05M 上下文 · 最大输出 128K
适用场景
复杂编程、电脑操作、专业工作
可输入
文本 + 图像
输出形态
文本 · JSON(结构化输出)· 工具调用

选择 GPT-6.1 Sol

一个精确模型 ID,走同一套 OpenAI 兼容接入;卡片列出四种 token 角色在短、长上下文下的价格。

GPT-6.1 Sol

面向编程与 Agent 工作的精确版本 ID;Responses 处理工具调用,Chat Completions 接受不带工具的请求。

已选择
模型 ID
gpt-6.1-sol
适合

跨文件修复、文档问答和多步 Agent,按任务结果验收

≤ 272K
输入
$1.800 / 1M-10%
122.4 cr / 1M$2.000官方价
缓存读取
$0.092 / 1M-9%
6.2 cr / 1M$0.100官方价
缓存写入
$2.250 / 1M-10%
153 cr / 1M$2.500官方价
输出
$9.000 / 1M-10%
612 cr / 1M$10.000官方价
> 272K
输入
$3.600 / 1M-10%
244.8 cr / 1M$4.000官方价
缓存读取
$0.183 / 1M-9%
12.4 cr / 1M$0.200官方价
缓存写入
$4.500 / 1M-10%
306 cr / 1M$5.000官方价
输出
$13.500 / 1M-10%
918 cr / 1M$15.000官方价

所有费率按每百万 Token 计,同时显示美元与 Credits,以你账户当前的价格为准。 prompt tokens 超过 272K 后,整个请求的输入与两种缓存价格变为 2 倍,输出价格变为 1.5 倍。

GPT-6.1 Sol 价格

集成前先估算一次 GPT-6.1 Sol 请求的费用。计算器按你账户的当前费率计算,官方价格仅作对照。

请求费用计算器

输入一次请求的 Token 组合。

单次请求预估

GPT-6.1 Sol
短上下文费率
USD$0.0046
Credits0.3073

官方价预估 $0.0051 · 省 $0.0006(10%)

输入 Token0.1224 cr
缓存读取 Token0.0013 cr
缓存写入 Token0 cr
输出 Token0.1836 cr

最低计费:每次请求 0.01 Credits。 prompt tokens 超过 272K 后,整个请求的输入与两种缓存价格变为 2 倍,输出价格变为 1.5 倍。

预算指南

按当前 Token 组合估算可发起的请求数。
充值 Credits
$10
约 2212 次请求

快速测试

$50
约 11064 次请求

日常开发

$100
约 22128 次请求

生产评估

GPT-6.1 Sol API

OpenAI 更新后的 Sol 型号,面向代码修改、文档分析和多步 Agent 工作。提供文本或图像,获取文字或结构化结果;通过 Responses 调用应用自己的工具,把建议转化为可检查的动作。

GPT-6.1 Sol 在 EvoLink 上以模型 ID gpt-6.1-sol 提供,支持 Chat Completions · Responses,和其他模型共用同一把 API 密钥与余额。它提供 1.05M 上下文窗口,最大输出 128K Token,并支持编程、多步 Agent、工具调用。

GPT-6.1 Sol

GPT-6.1 Sol 规格与能力

数字取自 EvoLink 路由配置;能力以 API 当前实际提供为准。

上下文窗口
1.05M Token
最大输出
128K Token
输入
文本 + 图像
输出
文本 · JSON(结构化输出)· 工具调用
推理
可配置推理强度
工具调用
函数调用,支持多步工具序列
提示缓存
缓存写入 + 缓存读取两种费率
长上下文档位
prompt tokens 超过 272K 后,整个请求的输入与两种缓存价格变为 2 倍,输出价格变为 1.5 倍。
协议
Chat Completions · Responses
模型 ID
gpt-6.1-sol

GPT-6.1 Sol 的编程 Agent 与文档应用场景

优先试跑仓库修改、审查负担较重的文档问题,以及反复复用上下文的工作流。测试前定义合格补丁、有依据的答案或正确的最终记录。厂商评测可帮助选择试跑任务,不能证明自己的生产质量或延迟。

交付多文件代码修改

提供固定仓库版本、失败测试与 issue。按所需测试和无关改动检查产出的补丁,记录重试及审查时间。这样才能评估跨文件修复和重构的价值,而不只判断一段代码看起来是否合理。

在 Responses 上运行工具驱动的 Agent

把应用自己的函数工具接到 Responses 工作流,由应用控制权限、工具结果关联与最终记录检查。生产写入前先回放失败和取消场景。Chat Completions 用于不带工具的请求;新增模型不会自动让旧工具循环兼容。

处理文档与多步骤业务流程

利用提供的文档文本或图像,回答规格、报告和表格中的问题。要求可追溯的依据,并对照来源检查提取字段。1.05M 上下文容纳较大的输入输出预算,但保留材料不保证结论准确,文字输出也不代表能生成图片。

按请求调节推理强度

从 medium 开始,在同一任务集上比较支持的推理档位。困难调试和设计审查只有在通过结果足以抵偿输出用量与延迟时才提高档位。none 和 minimal 不受支持,max 使用 Responses;常规工作保留更简单的 GPT 路由。

两种方式使用 GPT-6.1 Sol:EvoLink API 或 Agent

产品后端与批量任务走 EvoLink API;编码与分析类工作可直接在 Codex、Claude、Gemini 里调用 GPT-6.1 Sol。两条路径共用同一把 EvoLink API 密钥、余额、模型 ID 与请求记录。

方式一

用 EvoLink API 接入

适合:产品后端、批量任务、自动化流水线

向 EvoLink 发送 OpenAI 兼容的 Chat Completions(或 Anthropic Messages)请求,自行控制模型 ID、系统提示、输出预算、工具与结构化输出。

  1. 1在控制台创建 EvoLink API 密钥
  2. 2把 OpenAI 或 Anthropic SDK 的 base URL 指向 EvoLink,并选择上方显示的模型 ID
  3. 3先发一条有代表性的请求,从 usage 字段读取输入、缓存与输出 token
  4. 4按任务设置 max_tokens 与重试;多轮时保留 tool-call ID 与工具结果
方式二

用 Agent 调用

适合:在 Codex、Claude、Gemini 里做编码、评审与分析

把任务、要带入的材料和验收标准交给 Agent,由它组装请求、通过 EvoLink 调用 GPT-6.1 Sol,并把回答连同 token 用量一起返回。

  1. 1在本地环境变量里配置 EVOLINK_API_KEY,不要写进代码或提示词
  2. 2描述任务、要带入的材料和期望的输出格式
  3. 3让 Agent 通过 EvoLink 调用 GPT-6.1 Sol,并在发送前先展示请求
  4. 4让 Agent 汇报回答、token 用量和任何错误信息

GPT-6.1 Sol API 代码示例与错误处理

这个示例是最短可运行的请求:一条 OpenAI 兼容的 Chat Completions 调用,带系统提示、用户消息和输出预算。完整参数与响应说明见 API 标签页。

查看完整 API 文档
cURL
curl -X POST https://api.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6.1-sol",
    "messages": [
      { "role": "system", "content": "You are a senior engineer fixing a failing test suite." },
      { "role": "user", "content": "These tests fail after the refactor. Find the root cause and propose a minimal patch:\n<test output>" }
    ],
    "reasoning_effort": "medium",
    "max_tokens": 4096
  }'

# Use the exact ID gpt-6.1-sol (with a dot) on both Chat Completions and Responses.
# reasoning_effort accepts low, medium (default), high, and xhigh; max is available
# on Responses. none is not supported — migrate none to low. Reasoning tokens are
# billed as output. Chat Completions requests cannot include tools: use Responses
# for function calling and built-in tools. Remove temperature, top_p, logprobs,
# and top_logprobs from requests.

请求无效或参数不支持

对照 API 文档检查模型 ID、messages 数组和参数范围,去掉该路由不支持的字段。

鉴权或余额问题

检查 Authorization bearer token,并在控制台确认可用余额。

超出上下文长度

提示词 token 超过了 GPT-6.1 Sol 的上下文窗口。裁剪或只检索相关材料,并复用缓存前缀。

触发限流(429)

退避并带抖动重试;用批处理或队列代替并发突发。

内容或工具调用被拒

重试前检查敏感内容、格式错误的 tool-call 参数和 JSON schema 不匹配。

把 GPT-6.1 Sol 接入生产前

决定成本与稳定性的四项检查。

01

选准 GPT-6.1 Sol 模型 ID

Chat Completions 与 Responses 都用 gpt-6.1-sol(中间是点)。它不会替换 gpt-6-sol,后者仍以自己的 ID 继续提供。

必做
02

工具调用走 Responses

函数调用与内置工具只能走 Responses API;Chat Completions 请求只要带了 tools,无论推理强度如何都会被拒绝。

必做
03

清理从 GPT-6 Sol 沿用过来的参数

把推理强度 none 改成 low,并删掉 temperature、top_p、logprobs 和 top_logprobs;GPT-6.1 Sol 会拒绝这些参数。

必做
04

按缓存读取组织提示词,给 272K 留预算

把稳定的指令放在最前面,让缓存读取替代全价输入;提示词超过 272K Token 后整个请求按长上下文费率计费。

建议

四段提示词缓存计费

分别读取未缓存输入、缓存读取、缓存写入和输出四类 Token。计费以用量与价格区为准,重复提示词不等于缓存命中。OpenAI 缓存读价为旧 Sol 的一半,但输出、重试和审查仍决定整项任务成本。

长上下文阈值

prompt tokens 超过 272K 后,整个请求的输入与两种缓存价格变为 2 倍,输出价格变为 1.5 倍。

GPT-6.1 Sol 价格与 GPT 模型选择

EvoLink

对比 6.1 Sol、Astra 和上一版 Sol 的 EvoLink 输入/输出费率与任务适配。缓存类别和长上下文费率复用现有 Models 与 Pricing 区域。

GPT-6.1 Sol
EvoLink 每 1M 价格(输入 / 输出)$1.8 / $9
上下文窗口1.05M
提示词缓存缓存读取 + 缓存写入
适用场景跨文件修复、文档问答和多步 Agent,按任务结果验收
GPT-6 Astra
EvoLink 每 1M 价格(输入 / 输出)$9 / $45
上下文窗口1.05M
提示词缓存缓存读取 + 缓存写入
适用场景最难的端到端推理、编程、电脑操作与研究任务
GPT-6 Sol
EvoLink 每 1M 价格(输入 / 输出)$1.8 / $9
上下文窗口1.05M
提示词缓存缓存读取 + 缓存写入
适用场景上一版 Sol;保留 none 推理强度,以及 Chat Completions 上的函数调用

表中使用基础上下文档位,价格以你账户当前的价格为准;未登录时展示 Default 价格。长上下文倍率见价格区。

GPT 模型家族

同一把 API 密钥、同一份余额,换档位不用改接入。

查看全部 GPT 模型
GPT-6 Astra

GPT-6 Astra

OpenAI 能力最强的模型,面向最难的端到端任务

查看模型
GPT-6 Sol

GPT-6 Sol

为复杂编程与 Agent 工作流打造的 GPT-6 模型

查看模型
GPT-6 Luna

GPT-6 Luna

GPT-6 中效率最高的型号,面向聚焦、大批量的任务

查看模型

GPT-6.1 Sol 之外的其他文本模型

Claude Opus 5.5

Claude Opus 5.5

Anthropic 最新的 Opus 模型,适合最难的长周期编程与 Agent 任务,1M 上下文,思考模式始终开启。

查看模型
Claude Sonnet 5.5

Claude Sonnet 5.5

Anthropic 最新的 Sonnet 模型,适合日常编程、调用工具的 Agent 与大批量生产流量,1M 上下文。

查看模型
Grok 4.7

Grok 4.7

xAI 推理与工具调用模型,500K 上下文,服务端工具按次计费。

查看模型
Gemini 3.8 Flash

Gemini 3.8 Flash

Google 能力最强的 Flash 模型,软件工程与 Agent 任务明显提升,1M 上下文。

查看模型

GPT-6.1 Sol 延伸阅读

GPT-6.1 Sol 发布时间与渠道开放

GPT-6.1 Sol 发布时间与渠道开放

9 月 29 日公告、各渠道开放情况与已确认模型事实

阅读指南
GPT-6.1 Sol 和 GPT-6 Sol:升级决策

GPT-6.1 Sol 和 GPT-6 Sol:升级决策

官方证据、完整有效任务成本案例、端点迁移及回滚门槛

阅读指南
GPT-6 Astra API 接入指南

GPT-6 Astra API 接入指南

Astra 专用接入参考;6.1 的请求设置以本页 Sol 文档为准

阅读指南

GPT-6.1 Sol API - 常见问题

应该使用哪个模型 ID?

请使用 gpt-6.1-sol(中间是点),Chat Completions 与 Responses 使用同一个 ID。gpt-6-sol 是另一个模型,仍以自己的 ID 继续提供。

GPT-6.1 Sol 在 EvoLink 上多少钱?

提示词不超过 272K tokens 时,页面显示的 EvoLink 每百万 tokens 费率为输入 $1.800、输出 $9.000,缓存读取 $0.092、写入 $2.250。未登录显示 Default 费率,登录账户使用自己的费率。OpenAI Standard 输入/输出标价为 $2.000 / $10.000;更长提示词使用本页列出的独立倍率。

缓存输入如何计费?

缓存读取与缓存写入是两个独立 token 分段,二者都不会再按普通输入重复收费。OpenAI 对 GPT-6.1 Sol 的缓存读取定价比普通输入低 95%,是 GPT-6 Sol 缓存读取价的一半。

什么时候使用长上下文价格?

总 prompt tokens 超过 272,000 时,整个请求按长上下文倍率结算:输入与两种缓存 2 倍,输出 1.5 倍。

支持哪些推理强度?

两个接口都支持 low、medium(默认)、high 和 xhigh,Responses API 的 reasoning.effort 另外支持 max。不支持 none 和 minimal,仍在发 none 的请求请改成 low。推理 token 按输出计费。

能在 Chat Completions 上使用函数调用吗?

不能。GPT-6.1 Sol 在 Chat Completions 上只接受不带工具的请求。函数调用与内置工具请用同一个 gpt-6.1-sol ID 调用 Responses API。

支持 temperature、top_p 和 logprobs 吗?

不支持。请从 GPT-6.1 Sol 请求中删掉 temperature、top_p、logprobs 和 top_logprobs,并把 message.output_text.logprobs 从 Responses 的 include 列表里去掉;保留这些参数的请求会被拒绝。

上下文窗口和最大输出是多少?

输入输出共用 1,050,000-token 上下文,最大输出 128,000 tokens。OpenAI 列出的知识截止为 2026 年 4 月 30 日。输入可包含文本和图像,输出为文字,不是生成图片。不要把总上下文窗口当成保证可用的最大输入额度。

该从 GPT-6 Sol 换到 GPT-6.1 Sol 吗?

OpenAI Standard 普通输入、输出和缓存写入费率与上一版 Sol 一致,缓存读价减半。厂商评估报告编程与工作流改进,不代表自己的任务通过结果。先检查 none 移除、工具必须使用 Responses,以及采样/logprobs 参数不受支持,再比较有效任务成本与延迟后迁移流量。

GPT-6.1 Sol 和 GPT-6 Astra 该用哪个?

用自己的最难任务比较验收结果与总成本。GPT-6.1 Sol 的 OpenAI Standard 输入/输出费率为 Astra 的五分之一,但不代表整项任务省五倍或每项工作质量相同。实测质量足以抵偿成本的任务继续选 Astra;保留两款模型 ID,并分别核验工具约定。