Grok 全模型接口 - Responses 完整参数
- xAI Grok 系列文本模型的 OpenAI 兼容 Responses 接口,通过
model选择具体模型(全部可选值见model参数的对照表) grok-4.5:50 万 token 上下文窗口;Prompt 达到 20 万 token 起,全部 token 按 2 倍价格计费- Prompt 缓存自动生效:命中缓存的输入 token 按更低的缓存价计费
- 支持同步与流式(SSE)两种模式
- xAI 服务端工具在 xAI 基础设施上执行、按成功调用次数计费:
web_search、x_search、code_execution、attachment_search、collections_search - 同时支持普通
function工具(客户端函数调用,无按次费用)
https://direct.evolink.ai,对文本模型支持更好,支持长连接;https://api.evolink.ai 是多模态主力地址,对文本模型作为备用地址使用。授权
请求体
要调用的模型:
grok-4.5 "grok-4.5"
模型输入:纯字符串,或 OpenAI Responses 输入项数组(如 {"role":"user","content":[...]}),原样透传。
"搜索最新的 SpaceX 发射并用一句话总结。"
是否流式返回(SSE 事件流,以 response.completed 结束)。默认 false。
false
生成的最大 token 数(含推理 token)。
2048
工具声明。xAI 服务端工具(按成功调用次数计费,工具费不受长上下文倍率影响):
同时支持普通 function 工具(客户端函数调用,无按次费用)。
⚠️ image_generation 目前不可用:为兼容会接受该声明,但会在请求到达模型前被移除。未识别的工具类型返回 400。
工具选择控制:"auto"(默认)/ "none" / "required",或用对象指定某个工具,如 {"type": "web_search"}。
auto, none, required 本次请求的服务端工具最大调用次数。省略(或传 null)时,平台会按你的可用余额自动注入不超过 10 次的上限。声明付费工具会预留最坏情况的预算,未用完的部分在结算时退回。
5
响应
响应生成成功(JSON 对象;stream=true 时为 SSE 事件流,以 response.completed 结束)
响应的唯一标识
"55d44212-8d5e-90cc-975f-36d341ce21f5"
响应类型
response "response"
响应状态
completed, incomplete, failed "completed"
实际使用的模型名称
"grok-4.5"
创建时间戳
1786538000
按生成顺序排列的输出项:reasoning 项(思考摘要)、服务端工具调用项(如 web_search_call / code_interpreter_call,状态 completed 表示成功且计费的调用),以及最后含 output_text 内容的 message 项。
Token 与工具用量统计。Prompt 达到 20 万 token 起,全部 token 按 2 倍价格计费;工具费不受倍率影响。