Grok 전체 모델 인터페이스 - Responses 전체 매개변수
- xAI Grok 텍스트 모델용 OpenAI 호환 Responses 엔드포인트. 모델은
model매개변수로 선택 (전체 값은model매개변수의 대조표 참조) grok-4.5: 컨텍스트 윈도우 500K 토큰. 프롬프트가 200K 토큰 이상이면 모든 토큰 유형이 2배 요금으로 과금됩니다- 프롬프트 캐싱은 자동 적용: 캐시에 적중한 입력 토큰은 더 저렴한 캐시 입력 요금으로 과금됩니다
- 동기 및 스트리밍(SSE) 모드 지원
- xAI 서버 측 도구는 xAI 인프라에서 실행되며 성공한 호출당 과금됩니다:
web_search,x_search,code_execution,attachment_search,collections_search - 일반
function도구(클라이언트 측 함수 호출)도 지원하며 호출당 추가 요금은 없습니다
https://direct.evolink.ai이며, 텍스트 모델 지원이 더 우수하고 장시간 연결을 지원합니다. https://api.evolink.ai는 멀티모달 서비스의 주력 엔드포인트이며, 텍스트 모델에 대해서는 대체 주소로 사용됩니다.인증
본문
호출할 모델:
grok-4.5 "grok-4.5"
모델에 전달할 입력: 일반 문자열 또는 OpenAI Responses 입력 항목 배열(예: {"role":"user","content":[...]}). 그대로 전달됩니다.
"Search the web for the latest SpaceX launch and summarize it in one sentence."
스트리밍으로 응답을 반환할지 여부 (SSE 이벤트, response.completed로 종료). 기본값 false.
false
생성할 최대 토큰 수 (추론 토큰 포함).
2048
도구 선언. xAI 서버 측 도구(성공한 호출당 과금, 요금은 롱 컨텍스트 배수의 영향을 받지 않음):
일반 function 도구(클라이언트 측 함수 호출)도 지원하며, 호출당 추가 요금은 없습니다.
⚠️ image_generation은 현재 사용할 수 없습니다: 호환성을 위해 선언은 허용되지만 요청이 모델에 도달하기 전에 제거됩니다. 인식되지 않는 도구 유형은 400으로 거부됩니다.
도구 선택을 제어합니다: "auto"(기본값) / "none" / "required", 또는 특정 도구를 지정하는 객체(예: {"type": "web_search"}).
auto, none, required 이 요청에서 허용할 서버 측 도구 호출의 최대 횟수. 생략하거나 null로 두면 플랫폼이 사용 가능한 잔액에 따라 최대 10회까지 자동으로 상한을 적용합니다. 선언된 유료 도구는 최악의 경우 예산을 먼저 예약하며, 사용하지 않은 부분은 정산 시 환불됩니다.
5
응답
응답 생성 성공 (JSON 객체, 또는 stream=true인 경우 response.completed로 끝나는 SSE 이벤트 스트림)
응답의 고유 식별자
"55d44212-8d5e-90cc-975f-36d341ce21f5"
응답 유형
response "response"
응답 상태
completed, incomplete, failed "completed"
실제 사용된 모델 이름
"grok-4.5"
생성 타임스탬프
1786538000
생성 순서대로 나열된 출력 항목: reasoning 항목(사고 과정 요약), web_search_call / code_interpreter_call 등 서버 측 도구 호출 항목(상태 completed는 성공하여 과금되는 호출을 의미), 마지막으로 output_text 콘텐츠를 담은 message 항목.
토큰 및 도구 사용 통계. 프롬프트가 200K 토큰 이상이면 모든 토큰 유형이 2배로 과금되며, 도구 요금은 배수의 영향을 받지 않습니다.