Grok 4.5 API
Grok 4.5 선택
복잡한 추론, 장문 컨텍스트, 리서치, xAI 서버 도구를 결합한 워크플로를 평가하기 위한 라우트입니다.
Grok 4.5
xAI 추론 및 도구 사용 모델
grok-4.5Web·X 검색 리서치, 코드 기반 분석, 문서·컬렉션 검색, 복잡한 추론, 다중 제공사 라우팅.
Grok 4.5 가격
Estimate token and successful server-side tool usage together. Live prices for your user group override the contract-backed fallback rates.
Request calculator
Enter uncached input, cached input, output, and successful tool calls.Estimated request cost
Grok 4.5At 200,000 prompt tokens (uncached + cached input), every token role is billed at 2×. Minimum total charge: 0.01 credits. Tool calls are not multiplied.
Budget guide
Approximate requests using the current mix.For quick testing
For regular development
For production evaluation
Token rates
| Model | Prompt tokens | Uncached input tokens | Cached input tokens | Output tokens |
|---|---|---|---|---|
Grok 4.5grok-4.5 | < 200K | $1.700 / 1M-15% 115.6 cr / 1M$2.000xAI 공식가 | $0.256 / 1M-15% 17.4 cr / 1M$0.300xAI 공식가 | $5.100 / 1M-15% 346.8 cr / 1M$6.000xAI 공식가 |
Grok 4.5grok-4.5 | ≥ 200K | $3.400 / 1M-15% 231.2 cr / 1M$4.000xAI 공식가 | $0.512 / 1M-15% 34.8 cr / 1M$0.600xAI 공식가 | $10.200 / 1M-15% 693.6 cr / 1M$12.000xAI 공식가 |
USD and credits are shown per 1M tokens. The long-context tier starts inclusively at 200,000 prompt tokens and applies 2× to input, cached input, and output.
Responses 서버 도구 요금
Only successful server-side calls on /v1/responses are billed per call. Ordinary client function calls and failed attempts have no server-tool fee; tokens still apply.
Grok 4.5 API란 무엇인가요?
Grok 4.5는 코딩 Agent, 연결형 리서치, 장문 문서 분석, 도구 워크플로를 위한 xAI 추론 모델입니다. 페이지 URL은 grok-4-5, API 요청 모델 ID는 grok-4.5입니다. Grok 4.5는 EvoLink 프로덕션 라우트에서 사용할 수 있으며, Pricing과 API 영역에서 가격 구간, 지원 워크플로, 모델 설정을 확인할 수 있습니다.
Grok 4.5 API는 어떤 작업에 적합한가요?
Grok 4.5는 50만 Token 컨텍스트, 조정 가능한 추론, 이미지 입력, 도구 기능을 결합합니다. 근거를 유지하고 외부 시스템을 호출하며 검증 가능한 결과를 제공해야 하는 작업에 적합합니다.
저장소 단위 코딩과 코드 리뷰
관련 소스, 이슈, 테스트 결과, 이전 변경을 한 작업에 모아 여러 파일의 문제를 찾고 구현 계획과 리뷰를 만들 수 있습니다. 프로덕션 적용 전에는 고정된 저장소 작업으로 테스트 통과율, 누락 단계, 구조화 결과, 사람의 수정량을 확인해야 합니다.
장문 문서와 다중 소스 분석
50만 Token 컨텍스트에 보고서, 계약서, 지식 베이스, 대화 기록, 검색 결과를 함께 담을 수 있습니다. 컨텍스트가 많다고 답이 자동으로 좋아지는 것은 아닙니다. 핵심 근거가 유지되는지 확인하고 Pricing의 장문 컨텍스트 및 캐시 입력 구간으로 허용 가능한 결과당 비용을 계산하세요.
연결형 리서치와 도구 워크플로
웹 검색, X 검색, 코드 실행, 첨부 파일 검색, 컬렉션 검색을 결합해 출처가 있는 리서치를 만들 수 있습니다. EvoLink의 API와 Pricing에서 도구 지원, Token 사용량, 호출 요금을 확인한 뒤 실제 리서치 흐름에서 인용과 결과 품질을 테스트하세요.
구조화 출력과 Agent 오케스트레이션
텍스트와 이미지 입력을 JSON Schema, function calling, 다단계 Agent 흐름에 연결해 추출, 검토, 후속 자동화를 수행할 수 있습니다. 프로덕션 전에는 Schema 유효성, 함수 인자, 스트리밍 종료, 도구 실패 후 안전한 복구를 확인하세요.
플랫폼에 따라 Grok 4.5 사용 방식은 무엇이 달라지나요?
같은 모델이라도 컨텍스트 설정, 도구 지원, 사용량 표시, 과금 방식이 다를 수 있습니다. EvoLink는 모델 설정과 사용량을 하나의 API로 통합해 이후 모델 전환을 단순하게 만듭니다.
올바른 API 모델 ID 사용
grok-4-5는 페이지 URL과 검색 표기이고, API 요청에 사용하는 모델 ID는 grok-4.5입니다. 기존 Chat Completions 또는 Responses 앱은 모델 설정에 이 ID를 사용하면 됩니다. 정확한 필드는 API 영역에서 확인할 수 있습니다.
현재 API 경로의 설정을 기준으로 확인
xAI는 50만 Token 모델 창을 문서화했지만, 플랫폼마다 컨텍스트 설정, 도구, 속도 제한이 다를 수 있습니다. EvoLink에서는 현재 경로에 표시된 모델 설정, 사용 가능한 기능, 실제 usage 데이터를 기준으로 판단하세요.
워크플로에 따라 Chat 또는 Responses 선택
일반 대화, 스트리밍, 클라이언트 함수는 Chat Completions부터 시작합니다. 리서치 Agent, 서버 검색, 코드 실행이 필요하면 Responses를 선택합니다. 익숙한 OpenAI 방식은 유지하면서 불필요한 복잡성을 줄일 수 있습니다.
통합 게이트웨이에서 모델 선택권 유지
하나의 EvoLink 계정, 잔액, API 방식으로 Grok, GPT, Claude, Kimi를 사용할 수 있습니다. 모델 선택을 설정에 두면 공급자마다 애플리케이션 코드를 다시 만들지 않고 품질, 비용, 가용성에 따라 경로를 바꿀 수 있습니다.
Grok 4.5 API 비용을 더 정확히 관리하려면?
현재 Token과 도구 가격은 Pricing에 표시됩니다. 실제 사용에서는 캐시, 컨텍스트 관리, 추론 설정, 모델 라우팅으로 불필요한 사용을 줄이고 완료된 비즈니스 작업 단위로 비용을 연결할 수 있습니다.
반복 컨텍스트를 캐시에 유리하게 구성
고정된 시스템 프롬프트, 도구 Schema, 공통 컨텍스트는 캐시로 재사용하기 쉽습니다. 선택한 프로토콜이 지원하는 캐시 또는 대화 식별자를 설정하고 usage의 cached tokens를 확인해 반복 요청의 실제 절감 효과를 검증하세요.
현재 작업에 필요한 컨텍스트만 전송
50만 Token 창은 큰 저장소와 장문 문서에 유용하지만 매 요청마다 채울 필요는 없습니다. 관련 파일, 메시지, 검색 구간만 선택하면 입력 비용을 줄이고 핵심 근거에 집중하기 쉬워집니다.
작업별로 추론, 출력, 도구 호출 조정
간단한 작업은 낮은 reasoning effort와 짧은 출력부터 시작하고, 어려운 분석에서 추론 예산을 늘립니다. 리서치와 Agent에서는 도구 호출 수도 확인해 반복 검색, 중복 실행, 무효한 루프를 피하세요.
완료 작업의 총비용으로 모델 비교
Token, 캐시 입력, 서버 도구, 필요한 재시도를 같은 완료 작업 안에서 평가합니다. EvoLink는 모델과 사용량을 한곳에 보여 주므로 Grok 4.5와 다른 경로가 동일한 작업을 끝내는 총비용을 비교하기 쉽습니다.
Chat Completions, Responses, 프로덕션 트래픽은 어떻게 선택하나요?
두 프로토콜은 서로 다른 워크플로를 위한 것입니다. 아래는 선택 요약이며, 정확한 요청 필드는 API와 EvoLink 문서, Token 및 도구 비용은 기존 Pricing을 기준으로 확인하세요.
일반 대화와 클라이언트 함수: Chat Completions
OpenAI 호환 대화, 스트리밍, 클라이언트 function calling을 이미 사용한다면 Chat Completions부터 시작하세요. 메시지 형식, 스트림 종료, 함수 인자, usage가 현재 클라이언트의 예상과 일치하는지 확인합니다.
리서치 Agent와 서버 도구: Responses
웹/X 검색, 코드 실행, 첨부 파일 또는 컬렉션 검색, 긴 다단계 Agent 흐름이 필요하면 Responses를 평가하세요. 도구 가용성, 호출 요금, 인용 결과, 실패 상태, 재시도 경계를 확인해야 합니다.
대규모 컨텍스트: 캐시와 총비용 함께 확인
장문 문서, 저장소, 긴 대화를 항상 한 요청에 모두 넣을 필요는 없습니다. 대표 컨텍스트 길이, 캐시 적중과 미적중, 출력 길이, 재시도를 비교하고 최종 청구액으로 성공 작업 비용을 계산하세요.
프로덕션 트래픽: 작게 시작하고 대체 경로 유지
먼저 소수의 관측 가능한 작업을 Grok 4.5로 보내고 검증된 GPT, Claude, Kimi 경로를 유지하세요. EvoLink 통합 API는 모델 선택, usage, 잔액을 모아 관리하며 제한, 타임아웃, Schema 또는 도구 오류 후 경로 전환을 쉽게 합니다.
Grok 4.5를 프로덕션에 사용하기 전에 무엇을 확인해야 하나요?
소수의 실제 워크로드부터 시작해 품질, 지연, 비용, 안정성이 요구사항을 충족하는지 확인한 뒤 이동할 트래픽을 늘리세요.
연동과 사용량 정보가 명확함
올바른 grok-4.5 모델 ID와 대상 프로토콜을 사용하고 필요한 응답, usage, 캐시 정보가 반환되는지 확인합니다. 명확한 사용량 데이터는 비용 분석을 돕고 Chat과 Responses 워크플로를 같은 방식으로 관측하게 합니다.
출력이 실제 비즈니스 요구를 충족함
실제 코드 변경, 장문 문서 분석, 리서치, 구조화 추출을 테스트합니다. 답변 품질뿐 아니라 테스트 통과, 인용 신뢰도, 함수 인자 정확성, 후속 시스템이 JSON Schema를 직접 사용할 수 있는지도 확인합니다.
지연과 오류 처리가 기대에 맞음
대표적인 요청량에서 응답 시간을 관측하고 속도 제한, 타임아웃, 잘못된 구조화 출력, 도구 실패에 대한 재시도를 준비합니다. EvoLink에서 모델 선택을 설정 가능하게 유지하면 경로가 잠시 중단될 때 검증된 대안으로 전환하기 쉽습니다.
비용과 모델 선택을 계속 제어할 수 있음
Pricing, usage, 최종 청구액으로 같은 작업 유형의 총비용을 계산하고 Grok 4.5를 기본 경로, 고난도 작업, 또는 대체 경로 중 어디에 둘지 결정합니다. 통합 게이트웨이는 이 결정을 연동 구현과 분리합니다.
먼저 소수의 관측 가능하고 되돌릴 수 있는 작업에 Grok 4.5를 적용하세요. 품질, 지연, 비용이 기대를 충족한 뒤 확대하는 것이 좋습니다. EvoLink 통합 API 뒤에 여러 모델 선택지를 유지하면 확장, 전환, 비용 최적화가 쉬워집니다.
API 모델 ID
grok-4.5grok-4-5는 페이지 URL입니다. Chat Completions와 Responses 요청에서는 여기에 표시된 정확한 모델 ID를 사용해야 합니다.
관련 모델




Grok 4.5 관련 가이드와 업그레이드 정보


Grok 4.5 API 자주 묻는 질문
현재 EvoLink에서 Grok 4.5 API를 사용할 수 있나요?
예. Grok 4.5는 EvoLink 프로덕션 라우트에서 사용할 수 있습니다. 모델 ID grok-4.5로 Chat Completions 또는 Responses에 요청하세요. 모델 ID, 가격, 컨텍스트, 지원 워크플로는 이 페이지에서 확인할 수 있습니다.
grok-4-5가 API 모델 ID인가요?
아닙니다. grok-4-5는 페이지 URL과 검색 표기입니다. API 요청에 사용하는 실제 모델 ID는 grok-4.5입니다.
컨텍스트 창과 장문 컨텍스트 가격 기준은 무엇인가요?
xAI 문서의 컨텍스트 창은 50만 Token입니다. Pricing에 표시된 Prompt Token 기준부터 장문 컨텍스트 요금이 적용됩니다. 매번 전체 창을 쓰지 말고 대표적인 길이와 캐시 입력을 테스트하세요.
Grok 4.5는 어떤 입력과 출력을 지원하나요?
상위 문서는 텍스트와 이미지 입력, 텍스트 출력을 명시합니다. 이미지 입력은 시각 이해를 위한 것이며 이미지 생성 모델이라는 뜻은 아닙니다. 현재 지원 방식은 API 영역을 기준으로 확인하세요.
Chat Completions와 Responses API는 어떻게 선택하나요?
일반 대화, 스트리밍, 클라이언트 함수는 Chat Completions, 긴 Agent와 xAI 서버 도구는 Responses를 평가하세요. 정확한 필드는 API와 EvoLink 문서를 기준으로 합니다.
reasoning effort는 어떻게 선택해야 하나요?
필요한 품질을 만족하는 가장 낮은 설정부터 시작하고 같은 작업에서 medium과 high를 비교하세요. 복잡한 작업은 추론을 늘리고 간단한 작업은 응답 시간과 비용을 우선할 수 있습니다.
캐시 입력은 Grok 4.5 API 가격에 어떤 영향을 주나요?
반복 컨텍스트 비용을 낮출 수 있지만 캐시 미적중, 긴 출력, 재시도, 반복 도구 호출은 총비용을 늘립니다. Pricing과 최종 요청 청구액으로 성공 작업당 비용을 계산하세요.
서버 도구와 클라이언트 함수의 차이는 무엇인가요?
클라이언트 함수는 애플리케이션에서 실행됩니다. 웹/X 검색, 코드 실행, 첨부 파일과 컬렉션 검색은 xAI 서버 도구입니다. 실행 위치, 실패 처리, 과금 방식이 다르므로 API와 Pricing을 확인하세요.
Grok 4.5를 GPT, Claude, Kimi와 어떻게 비교하나요?
동일한 실제 작업을 같은 컨텍스트, 도구, 추론 설정으로 실행하세요. 결과 품질, 응답 시간, Token 구성, 도구 성능, 총비용을 비교하면 트래픽별 EvoLink 경로를 판단할 수 있습니다.
출시할 때 어떤 대체 모델을 유지해야 하나요?
같은 워크로드를 안정적으로 처리하는 모델을 유지하고 경로 선택을 설정 가능하게 두세요. 제한, 타임아웃, 잘못된 출력이 발생하면 EvoLink에서 GPT, Claude, Kimi 또는 적합한 대안으로 전환할 수 있습니다.