curl --request POST \
--url https://direct.evolink.ai/v1/responses \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "grok-4.7",
"input": "프롬프트 캐싱이 무엇인지 한 문장으로 설명하세요.",
"reasoning": {
"effort": "xhigh"
},
"max_output_tokens": 2048,
"prompt_cache_key": "grok-session-001"
}
'{
"id": "55d44212-8d5e-90cc-975f-36d341ce21f5",
"object": "response",
"status": "completed",
"model": "grok-4.7",
"created_at": 1786538000,
"output": [
{
"id": "<string>",
"type": "web_search_call",
"status": "completed",
"content": [
{}
],
"encrypted_content": "<string>"
}
],
"usage": {
"input_tokens": 10329,
"output_tokens": 299,
"total_tokens": 10628,
"input_tokens_details": {
"cached_tokens": 6016
},
"output_tokens_details": {
"reasoning_tokens": 128
},
"num_server_side_tools_used": 2,
"server_side_tool_usage_details": {
"web_search_calls": 2,
"x_search_calls": 0,
"code_interpreter_calls": 0,
"document_search_calls": 0,
"file_search_calls": 0,
"mcp_calls": 0,
"x_posts_fetched": 0,
"x_users_fetched": 0
}
}
}{
"error": {
"code": 400,
"message": "Invalid request parameters",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Insufficient quota",
"type": "insufficient_quota_error",
"fallback_suggestion": "https://evolink.ai/dashboard/billing"
}
}{
"error": {
"code": 429,
"message": "Rate limit exceeded",
"type": "rate_limit_error",
"fallback_suggestion": "retry after 60 seconds"
}
}{
"error": {
"code": 500,
"message": "Internal server error",
"type": "internal_server_error",
"fallback_suggestion": "try again later"
}
}{
"error": {
"code": 503,
"message": "Service temporarily unavailable",
"type": "service_unavailable_error",
"fallback_suggestion": "retry after 30 seconds"
}
}Grok 전체 모델 인터페이스 - Responses 전체 매개변수
- xAI Grok 텍스트 모델용 OpenAI 호환 Responses 엔드포인트. 모델은
model매개변수로 선택 (전체 값은model매개변수의 대조표 참조) - 컨텍스트 윈도우 500K 토큰. 프롬프트가 200K 토큰 이상이면 모든 토큰 유형이 2배 요금으로 과금됩니다
- 프롬프트 캐싱은 자동 적용: 캐시에 적중한 입력 토큰은 더 저렴한 캐시 입력 요금으로 과금됩니다
- 동기 및 스트리밍(SSE) 모드 지원
- xAI 서버 측 도구는 xAI 인프라에서 실행됩니다:
web_search,x_search,code_execution,attachment_search,collections_search. X Search는 가져온 게시물과 사용자 프로필 수로 과금하며, 다른 도구는 성공한 호출당 과금합니다. - 일반
function도구(클라이언트 측 함수 호출)도 지원하며 호출당 추가 요금은 없습니다 - xAI 공식 명세에 따르면
grok-4.7은 기본적으로encrypted_content가 포함된reasoning항목을 반환합니다. 실제 반환 필드는 현재 사용 중인 경로의 응답을 확인하세요.
curl --request POST \
--url https://direct.evolink.ai/v1/responses \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "grok-4.7",
"input": "프롬프트 캐싱이 무엇인지 한 문장으로 설명하세요.",
"reasoning": {
"effort": "xhigh"
},
"max_output_tokens": 2048,
"prompt_cache_key": "grok-session-001"
}
'{
"id": "55d44212-8d5e-90cc-975f-36d341ce21f5",
"object": "response",
"status": "completed",
"model": "grok-4.7",
"created_at": 1786538000,
"output": [
{
"id": "<string>",
"type": "web_search_call",
"status": "completed",
"content": [
{}
],
"encrypted_content": "<string>"
}
],
"usage": {
"input_tokens": 10329,
"output_tokens": 299,
"total_tokens": 10628,
"input_tokens_details": {
"cached_tokens": 6016
},
"output_tokens_details": {
"reasoning_tokens": 128
},
"num_server_side_tools_used": 2,
"server_side_tool_usage_details": {
"web_search_calls": 2,
"x_search_calls": 0,
"code_interpreter_calls": 0,
"document_search_calls": 0,
"file_search_calls": 0,
"mcp_calls": 0,
"x_posts_fetched": 0,
"x_users_fetched": 0
}
}
}{
"error": {
"code": 400,
"message": "Invalid request parameters",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Insufficient quota",
"type": "insufficient_quota_error",
"fallback_suggestion": "https://evolink.ai/dashboard/billing"
}
}{
"error": {
"code": 429,
"message": "Rate limit exceeded",
"type": "rate_limit_error",
"fallback_suggestion": "retry after 60 seconds"
}
}{
"error": {
"code": 500,
"message": "Internal server error",
"type": "internal_server_error",
"fallback_suggestion": "try again later"
}
}{
"error": {
"code": 503,
"message": "Service temporarily unavailable",
"type": "service_unavailable_error",
"fallback_suggestion": "retry after 30 seconds"
}
}https://direct.evolink.ai이며, 텍스트 모델 지원이 더 우수하고 장시간 연결을 지원합니다. https://api.evolink.ai는 멀티모달 서비스의 주력 엔드포인트이며, 텍스트 모델에 대해서는 대체 주소로 사용됩니다.Grok 4.7 사용 방법
model을 grok-4.7로 설정하세요. 컨텍스트 윈도우는 500,000 토큰이며 지식 기준은 2026년 5월입니다. reasoning.effort로 추론 깊이를 설정하며 low, medium, high(기본값), xhigh를 지원합니다. 추론은 끌 수 없습니다.
xAI의 암호화된 추론 명세에 따르면 4.7은 명시적인 include 없이 encrypted_content가 있는 reasoning 항목을 output에 기본적으로 반환합니다. 대화 기록을 직접 관리한다면 전체 reasoning 항목을 다른 이전 출력과 함께 변경하지 않고 다음 input에 전달하세요. 암호문을 디코딩하거나 수정하지 마세요. 실제 응답에 포함된 필드를 확인하세요.
X Search 과금
X Search의 새 과금 규칙은 Grok 4.5, 4.6, 4.7에 적용됩니다. 한 번의 검색으로 여러 게시물과 프로필을 가져올 수 있으며 상위 게시물과 인용 게시물도 셉니다. 예를 들어 게시물 30개와 프로필 3개를 가져오면 도구 요금은30 × 0.005 USD + 3 × 0.01 USD = 0.18 USD이며 토큰 요금은 별도입니다.
가져온 항목 수는 usage.server_side_tool_usage_details.x_posts_fetched와 x_users_fetched에서 확인하세요. 두 필드가 모두 없는 응답은 호환 처리를 위해 성공한 호출당 과금합니다. x_search_calls는 호출 횟수이고 max_tool_calls는 횟수 제어 값으로, 실제 제한 효과는 경로에 따라 다릅니다. 둘 다 가져오는 항목 수나 비용의 상한이 아닙니다. x_users_fetched는 사용량 필드이므로 도구를 추가로 선언할 필요가 없습니다.
image_generation은 현재 Grok 4.5, 4.6, 4.7에서 사용할 수 없습니다. 호환성을 위해 선언은 받지만 모델에 요청이 도달하기 전에 도구를 제거합니다. 인식할 수 없는 tools[].type은 400을 반환합니다.인증
##모든 API는 Bearer Token 인증이 필요합니다##
API Key 받기:
API Key 관리 페이지를 방문하여 API Key를 받으세요
요청 헤더에 추가:
Authorization: Bearer YOUR_API_KEY
본문
호출할 모델:
| 모델 ID | 포지셔닝 |
|---|---|
grok-4.7 | xAI 추론 및 도구 호출 모델. 500K 토큰 컨텍스트 윈도우. xhigh 지원. 지식 기준: 2026-05 |
grok-4.6 | xAI 추론 + 도구 호출 모델, 컨텍스트 윈도우 500K; xhigh 추론 레벨 추가 지원; 지식 컷오프 2026-02-01 |
grok-4.5 | xAI 추론 + 도구 호출 모델, 컨텍스트 윈도우 500K; 추론 레벨은 high까지(xhigh는 허용되지만 high로 강등됨) |
grok-4.7, grok-4.6, grok-4.5 "grok-4.7"
모델에 전달할 입력: 일반 문자열 또는 OpenAI Responses 입력 항목 배열(예: {"role":"user","content":[...]}).
"Search the web for the latest SpaceX launch and summarize it in one sentence."
SSE 스트리밍 반환 여부입니다. 기본값은 false입니다. 최종 응답의 status와 usage를 확인하세요. completed는 생성 완료이며 출력 제한 등에 도달하면 incomplete가 될 수 있습니다. response.completed 이벤트만 기다리지 마세요.
false
생성할 최대 토큰 수 (추론 토큰 포함).
2048
추론 깊이를 객체로 지정합니다: {"effort": "low" | "medium" | "high" | "xhigh"}. 기본값은 high이며 추론은 끌 수 없습니다. grok-4.7과 grok-4.6은 xhigh를 지원하고 grok-4.5는 high로 처리합니다. 추론 토큰은 출력 토큰으로 과금되며 usage.output_tokens_details.reasoning_tokens에 기록됩니다.
Show child attributes
Show child attributes
도구 선언입니다. 서버 측 도구 요금은 토큰 요금에 추가되며 긴 컨텍스트 요금 배수의 영향을 받지 않습니다:
| 도구 유형 | 기능 | 과금 단위 및 가격 |
|---|---|---|
web_search | 웹 검색 및 페이지 탐색 | 성공한 호출당 0.005 USD |
x_search | X 게시물, 계정, 주제 검색 | 가져온 게시물당 0.005 USD + 사용자 프로필당 0.01 USD |
code_execution | 샌드박스에서 Python 실행(별칭: code_interpreter) | 성공한 호출당 0.005 USD |
attachment_search | 대화 첨부 파일 검색(파일 입력 시 자동 활성화될 수 있음) | 성공한 호출당 0.01 USD |
collections_search | 업로드한 문서 컬렉션 검색(별칭: file_search) | 성공한 호출당 0.0025 USD |
X Search의 새 과금 방식은 grok-4.5, grok-4.6, grok-4.7에 적용됩니다. 한 번의 호출로 여러 게시물이 반환될 수 있으며, 검색이나 스레드 조회로 반환된 상위 게시물과 인용 게시물도 셉니다. 실제 사용량은 usage.server_side_tool_usage_details를 확인하세요. 가져온 항목 수를 나타내는 두 필드가 모두 없으면 호환 처리를 위해 성공한 호출당 과금합니다.
일반 function 도구도 지원합니다(클라이언트 측 함수 호출로, 서버 측 도구 호출 요금은 없습니다).
image_generation은 현재 Grok 4.5, 4.6, 4.7에서 사용할 수 없습니다. 호환성을 위해 선언은 받지만 모델에 요청이 도달하기 전에 도구를 제거합니다. 인식할 수 없는 tools[].type은 400을 반환합니다.
Show child attributes
Show child attributes
[{ "type": "web_search" }]
도구 선택을 제어합니다: "auto"(기본값) / "none" / "required", 또는 특정 도구를 지정하는 객체(예: {"type": "web_search"}).
auto, none, required 선택적 캐시 라우팅 키입니다. 같은 대화 또는 동일한 프롬프트 접두사를 공유하는 요청에 일관된 값을 사용하면 캐시 적중 가능성을 높일 수 있습니다. 적중을 보장하지 않으며 캐시 과금 규칙도 바뀌지 않습니다. 실제 적중량은 usage의 cached_tokens를 확인하세요.
"grok-session-001"
응답에 추가로 요청할 필드입니다. 예를 들어 grok-4.6은 ["reasoning.encrypted_content"]로 암호화된 추론을 요청할 수 있습니다. xAI 명세에 따르면 grok-4.7은 명시적인 include 없이 기본적으로 반환합니다.
["reasoning.encrypted_content"]
도구 호출 횟수 제어 값입니다. 게이트웨이는 이 값을 전달하고 도구 요금 예약액 추정에 사용합니다. 경로가 호출 횟수를 엄격하게 제한하는지는 실제 동작으로 확인해야 합니다. 이 값은 가져오는 X 게시물이나 사용자 프로필 수를 제한하지 않으며 비용 상한도 아닙니다.
1
응답
응답이 반환되었습니다. status도 확인하세요. 생성 완료는 completed, 출력 제한 등으로 미완료된 경우는 incomplete, 실패는 failed입니다. stream=true이면 SSE 스트림으로 반환되므로 최종 응답의 status와 usage를 읽으세요.
응답의 고유 식별자
"55d44212-8d5e-90cc-975f-36d341ce21f5"
응답 유형
response "response"
응답 상태
completed, incomplete, failed "completed"
실제 사용된 모델 이름
"grok-4.7"
생성 타임스탬프
1786538000
생성 순서대로 나열된 출력 항목: reasoning(암호화된 추론이 포함될 수 있음), 서버 측 도구 호출, function_call, output_text가 포함된 message 항목입니다. 도구 사용량은 usage를 기준으로 하며, x_search 한 번으로 여러 게시물과 프로필에 대한 요금이 발생할 수 있습니다.
Show child attributes
Show child attributes
토큰 및 도구 사용 통계. 프롬프트가 200K 토큰 이상이면 모든 토큰 유형이 2배로 과금되며, 도구 요금은 배수의 영향을 받지 않습니다.
Show child attributes
Show child attributes