Skip to main content
POST
Grok 对话补全(全模型,完整参数)
BaseURL 说明:默认 BaseURL 为 https://direct.evolink.ai,对文本模型支持更好,支持长连接;https://api.evolink.ai 是多模态主力地址,对文本模型作为备用地址使用。
本页展示普通 function 工具调用。服务端工具(联网搜索、X 搜索、代码执行、附件搜索、文档集搜索)建议使用 Responses 接口,其中包含工具配置和计费说明。

Grok 4.7 接入说明

将 model 设为 grok-4.7 即可调用,保留现有的 messages 请求格式。上下文窗口为 500,000 token,知识截止于 2026 年 5 月。 推理深度使用顶层 reasoning_effort,支持 low、medium、high(默认)和 xhigh;推理无法关闭。grok-4.6 同样支持 xhigh,grok-4.5 会将其按 high 处理。 prompt_cache_key 可为共享相同 Prompt 前缀的请求提供稳定的缓存路由提示,不保证缓存命中。实际命中量请查看 usage.prompt_tokens_details.cached_tokens。如需在多轮对话中保留加密思考内容,请使用 Responses 接口。

授权

Authorization
string
header
必填

##所有接口均需 Bearer Token 认证##

获取 API Key:

访问 API Key 管理页面 获取你的 API Key

添加到请求头:

请求体

application/json
model
enum<string>
必填

要调用的模型:

可用选项:
grok-4.7,
grok-4.6,
grok-4.5
示例:

"grok-4.7"

messages
object[]
必填

对话消息列表,支持 system、user、assistant 角色。

Minimum array length: 1
示例:
stream
boolean
默认值:false

是否流式返回(SSE,chat.completion.chunk 事件)。默认 false。

示例:

false

max_tokens
integer

生成的最大 token 数。

示例:

1024

reasoning_effort
enum<string>
默认值:high

推理深度:low / medium / high(默认)/ xhigh。推理无法关闭。xhigh 支持 grok-4.7 和 grok-4.6;grok-4.5 接受该值但会降级为 high。推理 token 按输出 token 计费。

可用选项:
low,
medium,
high,
xhigh
temperature
number

采样温度(0-2),越大输出越随机。

示例:

0.7

top_p
number

核采样参数(0-1)。

示例:

0.95

tools
object[]

本页展示普通 OpenAI function 工具定义(客户端函数调用,无服务端工具调用费)。联网搜索、X 搜索等服务端工具的配置与用量说明请参阅 Responses 接口。

tool_choice

函数选择控制:"auto" / "none" / "required",或用对象指定某个函数。

可用选项:
auto,
none,
required
prompt_cache_key
string

可选的缓存路由键。同一会话或共享相同 Prompt 前缀的请求使用稳定值,可提高 Prompt 缓存命中机会;不保证命中,也不改变缓存计费规则。实际命中量以 usage 中的 cached_tokens 为准。

示例:

"grok-session-001"

响应

对话生成成功(JSON 对象;stream=true 时为 chat.completion.chunk 的 SSE 事件流)

id
string

对话补全的唯一标识

示例:

"chatcmpl-20260812164515123456789AbCdEfGh"

model
string

实际使用的模型名称

示例:

"grok-4.7"

object
enum<string>

响应类型

可用选项:
chat.completion
示例:

"chat.completion"

created
integer

创建时间戳

示例:

1786538000

choices
object[]

对话补全选项列表

usage
object

Token 用量统计。Prompt 达到 20 万 token 起,全部 token(输入、缓存输入、输出)按 2 倍价格计费。