GPT Image 2.5 Flare & Sunburst가 EvoLink에 출시되었습니다GPT Image 2.5 체험하기

GLM-5.3 FlashX API

GLM-5.3 FlashX는 대화형 코딩과 에이전트 워크플로를 위해 속도를 중시하는 Z.ai의 멀티모달 모델입니다. Flash와 토큰 비용을 비교하고 EvoLink 통합 API로 연동하세요.

Z.ai텍스트 생성사용 가능
입력 100만 토큰당 $0.371부터
API 문서
멀티모달 입력이미지 · 영상 · 파일 입력사고 상시 활성Chat + Messages
프로덕션 라우트라이브
컨텍스트
컨텍스트 1M · 최대 출력 131K
적합한 용도
대화형 코딩 에이전트, 스크린샷 분석, 문서 워크플로
입력
텍스트 + 이미지 + 영상 + 파일
출력
텍스트 · JSON(구조화 출력) · 도구 호출

GLM-5.3 FlashX 선택

GLM-5.3 FlashX는 대화형 코딩과 에이전트 워크플로를 위해 속도를 중시하는 Z.ai의 멀티모달 모델입니다. Flash와 토큰 비용을 비교하고 EvoLink 통합 API로 연동하세요.

GLM-5.3 FlashX

속도를 중시하는 Z.ai 멀티모달 모델

선택됨
모델 ID
glm-5.3-flashx
적합한 용도

대화형 코딩 에이전트, 스크린샷 분석, 문서 워크플로

입력
$0.371 / 1M25.2 cr / 1M
캐시 읽기
$0.075 / 1M5.1 cr / 1M
출력
$1.250 / 1M85 cr / 1M

모든 요금은 100만 토큰 기준이며 USD와 크레딧으로 표시되고, 계정의 현재 가격을 반영합니다.

GLM-5.3 FlashX 요금

통합 전에 GLM-5.3 FlashX 요청 1건의 비용을 예상해 보세요. 계산기는 계정의 현재 요금을 사용하며 공식 가격은 비교용 참고 정보입니다.

요청 계산기

요청 1건의 토큰 구성과 성공한 도구 호출 횟수을 입력하세요.

요청당 예상 비용

GLM-5.3 FlashX
USD$0.0008
크레딧0.0518
입력 토큰0.0252 cr
캐시 읽기 토큰0.0011 cr
출력 토큰0.0255 cr

최소 과금: 요청당 0.01 크레딧.

예산 가이드

현재 토큰 구성 기준의 대략적인 요청 수.
크레딧 충전
$10
약 13127회 요청

빠른 테스트용

$50
약 65637회 요청

일반 개발용

$100
약 131274회 요청

프로덕션 평가용

서버 측 도구 요금

성공한 서버 측 호출만 호출당 과금됩니다. 실패한 시도에는 도구 요금이 없지만 토큰은 과금됩니다.
  • 웹 검색$0.010/ 회0.68 cr / 회

대화형 멀티모달 워크플로를 위한 GLM-5.3 FlashX

모델 출력을 기다리느라 코딩이나 에이전트 작업이 지연된다면 FlashX를 평가해 보세요. Flash의 토큰 단가는 더 낮으므로, 실제 작업에서 FlashX가 절약하는 시간이 가격 차이를 정당화하는지 측정해야 합니다.

GLM-5.3 FlashX은(는) EvoLink에서 모델 ID glm-5.3-flashx로 Chat Completions · Responses · Anthropic Messages를 통해 제공되며, 다른 모든 모델과 같은 API 키와 잔액을 사용합니다. 1M 컨텍스트 윈도우와 최대 131K 출력 토큰, 그리고 이미지 입력, 긴 문서 분석, 다단계 에이전트를 제공합니다.

GLM-5.3 FlashX

GLM-5.3 FlashX 사양과 기능

숫자는 EvoLink 경로 설정에서 가져오며, 기능은 API가 현재 제공하는 범위입니다.

컨텍스트 윈도우
1M 토큰
최대 출력
131K 토큰
입력
텍스트 + 이미지 + 영상 + 파일
출력
텍스트 · JSON(구조화 출력) · 도구 호출
추론
항상 켜진 추론
도구 사용
여러 단계 도구 시퀀스를 지원하는 함수 호출
프롬프트 캐싱
자동 캐시 읽기, 더 낮은 요금
서버 측 도구
웹 검색, 성공한 호출당 과금
프로토콜
Chat Completions · Responses · Anthropic Messages
모델 ID
glm-5.3-flashx

FlashX 선택을 좌우하는 기준

속도뿐 아니라 입력 요구사항, 작업 품질, 사용할 수 있는 결과를 얻는 비용을 함께 비교하세요.

Flash와 함께 선택할 수 있는 속도 중심 옵션

Z.ai는 FlashX를 더 빠른 추론을 위한 옵션으로 소개합니다. 이것이 Flash보다 높은 품질을 입증하거나 EvoLink 지연 시간을 보장하지는 않습니다. 동일한 프롬프트, 추론 설정, 출력 한도로 비교하세요.

긴 컨텍스트에서 다루는 멀티모달 정보

Z.ai는 텍스트·이미지·영상·파일 입력과 100만 토큰 컨텍스트를 문서화했습니다. 허용되는 요청 형식은 API 문서를 확인하세요. 모델은 텍스트를 반환하며 파일 생성이나 실제 동작은 에이전트 도구가 수행합니다.

하나의 게이트웨이에서 모델 선택

EvoLink에서 모델 비용을 비교하고 통합 API 게이트웨이로 연동하세요. 더 낮은 비용으로 품질 기준을 충족하는 작업에는 Flash를 유지하고, 응답 시간이 중요할 때 FlashX를 평가하세요.

GLM-5.3 FlashX를 평가할 작업

사람이나 다른 도구가 모델의 다음 응답을 기다리는 작업부터 시작하세요.

대화형 코딩 에이전트

동일한 에이전트 루프에서 구현, 디버깅, 도구 결과 해석을 평가하세요. 토큰 속도뿐 아니라 도구 실행과 재시도를 포함해 작동하는 결과를 얻기까지의 시간을 측정하세요.

스크린샷 기반 개발

인터페이스 스크린샷을 바탕으로 코드를 수정하거나 시각적 결함을 설명하게 하세요. 결과가 참조 이미지와 일치하는지, 선택한 API 경로가 이미지 형식을 받는지 확인하세요.

즉각적인 피드백이 필요한 문서 작업

텍스트와 시각 자료가 포함된 문서에서 정보 추출과 후속 질문을 평가하세요. 기다려도 되는 오프라인 분류나 일괄 처리라면 단가가 낮은 Flash부터 비교하세요.

FlashX, Flash, GLM-5.3 선택하기

EvoLink

아래의 현재 요금을 비교하세요. FlashX는 속도를 중시하고 Flash는 토큰 단가가 더 낮습니다. 모델을 바꾸기 전에 작업 성공률과 전체 소요 시간을 측정하세요.

GLM-5.3 FlashX
입력 / 출력$0.371 / $1.25
컨텍스트1M
캐싱캐시 읽기
적합한 용도대화형 코딩 에이전트, 스크린샷 분석, 문서 워크플로
GLM-5.3
입력 / 출력$1.4 / $4.4
컨텍스트1M
캐싱캐시 읽기
적합한 용도어려운 추론 작업에는 텍스트 전용 플래그십을 평가할 수 있습니다. 멀티모달 요청을 텍스트만 받는 모델에 그대로 전달할 수는 없습니다.
GLM-5.3 Flash
입력 / 출력$0.15 / $0.5
컨텍스트1M
캐싱캐시 읽기
적합한 용도오프라인 처리와 비용에 민감한 작업을 위한 저렴한 멀티모달 옵션입니다. 응답 대기가 병목일 때 FlashX를 비교하되 정확도 향상을 전제하지 마세요.

GLM-5.3 FlashX을(를) 사용하는 두 가지 방법: EvoLink API 또는 Agent

프로덕트 백엔드와 배치 작업에는 EvoLink API를, 코딩·분석 워크플로에는 Codex, Claude, Gemini에서 GLM-5.3 FlashX을(를) 직접 호출하세요. 두 경로 모두 같은 EvoLink API 키, 잔액, 모델 ID, 요청 기록을 공유합니다.

방법 1

EvoLink API로 통합

적합한 용도: 프로덕트 백엔드, 배치 작업, 자동화 파이프라인

OpenAI 호환 Chat Completions(또는 Anthropic Messages) 요청을 EvoLink로 보내고 모델 ID, 시스템 프롬프트, 출력 예산, 도구, 구조화 출력을 직접 제어합니다.

  1. 1콘솔에서 EvoLink API 키를 만드세요
  2. 2OpenAI 또는 Anthropic SDK의 base URL을 EvoLink로 지정하고 위에 표시된 모델 ID를 선택하세요
  3. 3대표 요청을 한 번 보내고 usage 필드에서 입력·캐시·출력 토큰을 확인하세요
  4. 4작업별로 max_tokens와 재시도를 설정하고, 여러 턴에서는 tool-call ID와 결과를 유지하세요
방법 2

Agent로 호출

적합한 용도: Codex, Claude, Gemini에서의 코딩·리뷰·분석 작업

작업, 포함할 입력, 수락 기준을 Agent에 전달하면 Agent가 요청을 구성해 EvoLink를 통해 GLM-5.3 FlashX을(를) 호출하고 토큰 사용량과 함께 답변을 돌려줍니다.

  1. 1EVOLINK_API_KEY를 로컬 환경 변수에 설정하세요. 코드나 프롬프트에 넣지 마세요
  2. 2작업, 포함할 입력, 기대하는 출력 형식을 설명하세요
  3. 3Agent가 EvoLink를 통해 GLM-5.3 FlashX을(를) 호출하고 전송 전에 요청을 보여주게 하세요
  4. 4Agent가 답변, 토큰 사용량, 오류 본문을 보고하게 하세요

GLM-5.3 FlashX API 코드 예시와 오류 처리

이 예시는 가장 짧게 실행 가능한 요청입니다: 시스템 프롬프트, 사용자 메시지, 출력 예산을 포함한 OpenAI 호환 Chat Completions 호출. 전체 파라미터와 응답 레퍼런스는 API 탭을 여세요.

전체 API 문서 보기
cURL
curl -X POST https://api.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.3-flashx",
    "messages": [
      { "role": "system", "content": "You extract structured data. Answer in JSON only." },
      { "role": "user", "content": "Extract the product, quantity, and unit price: 2 notebooks at $4.50 each." }
    ],
    "thinking": { "type": "enabled", "clear_thinking": false },
    "reasoning_effort": "low",
    "max_tokens": 4096,
    "temperature": 0.1
  }'

# Reasoning is always on for the 5.3 generation: do not send
# thinking.type "disabled". The same model ID works on /v1/messages
# (Anthropic Messages). The response includes choices[0].message and
# a usage object; image and video input is counted in prompt_tokens.

잘못된 요청 또는 지원하지 않는 파라미터

API 레퍼런스를 기준으로 모델 ID, messages 배열, 파라미터 범위를 확인하고 이 경로가 지원하지 않는 필드를 제거하세요.

인증 또는 잔액 문제

Authorization Bearer 토큰을 확인하고 콘솔에서 사용 가능한 잔액을 확인하세요.

컨텍스트 길이 초과

프롬프트 토큰이 GLM-5.3 FlashX의 컨텍스트 윈도우를 초과했습니다. 관련 근거만 잘라내거나 검색해 넣고 캐시된 프리픽스를 재사용하세요.

속도 제한(429)

지터를 두고 백오프 후 재시도하고, 병렬 버스트 대신 배치나 큐로 보내세요.

콘텐츠 또는 도구 호출 거부

재시도 전에 민감한 콘텐츠, 잘못된 tool-call 인자, JSON 스키마 불일치를 확인하세요.

입력·출력·캐시 비용을 따로 계산하세요

동일한 모델 ID에 대한 이 페이지의 현재 요금과 계산기를 사용하세요. 대표 요청의 반환 사용량과 청구 내역을 확인하세요. 프롬프트를 반복했다고 해서 캐시 적중이 입증되지는 않습니다.

전체 요청을 측정하세요

첫 토큰까지의 시간, 출력 속도, 전체 작업 시간, 재시도, 채택된 결과당 비용을 각각 기록하세요. 공급업체의 초당 토큰 수에는 애플리케이션의 모든 실행 단계가 포함되지 않습니다.

GLM 모델 제품군

같은 API 키와 잔액으로, 연동을 바꾸지 않고 티어를 전환할 수 있습니다.

GLM-5.3

GLM-5.3

Z.ai 플래그십 추론 모델

모델 보기
GLM-5.2

GLM-5.2

이전 세대 GLM 플래그십. 5.3 세대는 사고 비활성화를 더 이상 허용하지 않으므로, 그 기능에 의존하는 클라이언트에는 여전히 필요합니다.

모델 보기
GLM-5.3 Flash

GLM-5.3 Flash

Z.ai 멀티모달 대량 처리 모델

모델 보기

GLM-5.3 FlashX 외 EvoLink의 다른 텍스트 모델

DeepSeek V4 Flash

DeepSeek V4 Flash

DeepSeek의 대량 처리 모델. 100만 컨텍스트에 캐시 읽기 가격이 매우 낮아 대량 텍스트 작업에서 가장 직접적인 비용 비교 대상입니다.

모델 보기
Gemini 3.7 Flash

Gemini 3.7 Flash

구글의 저비용 멀티모달 모델. 이미지와 문서 이해가 선택을 좌우할 때 벤더 간 비교 기준으로 유용합니다.

모델 보기
Kimi K3

Kimi K3

Moonshot의 장문맥 추론 라우트. 리포지토리 규모 코딩과 다중 문서 작업에 적합합니다.

모델 보기
GPT-5.6

GPT-5.6

OpenAI의 단계형 프런티어 제품군(Sol / Terra / Luna). 성능·지연·비용에 따라 유연하게 라우팅합니다.

모델 보기

GLM-5.3 FlashX 관련 읽을거리

GLM-5.3 Flash vs GLM-5.3

GLM-5.3 Flash vs GLM-5.3

모달리티, 작업 난이도, 승인된 결과당 비용으로 라우트를 고르고 Flash-first 선택적 승격 정책을 설계합니다.

글 읽기
게이트웨이 하나로 코딩 CLI 3종

게이트웨이 하나로 코딩 CLI 3종

설정 파일 경로, 환경 변수, 그리고 여러 CLI를 단일 엔드포인트로 운영하기 위한 문제 해결 체크리스트.

글 읽기

GLM-5.3 FlashX API 자주 묻는 질문

GLM-5.3 FlashX는 무엇인가요?

FlashX는 GLM-5.3 Flash 제품군에서 속도를 중시하는 Z.ai의 옵션으로, 대화형 코딩과 멀티모달 에이전트 작업을 겨냥합니다. 토큰 단가가 높다는 사실이 더 높은 답변 품질을 입증하지는 않습니다.

이 EvoLink 페이지는 어떤 모델 ID를 사용하나요?

모델 ID는 glm-5.3-flashx입니다. 엔드포인트별 요청 형식과 지원 매개변수는 이 페이지에 연결된 API 문서를 확인하세요.

GLM-5.3 FlashX API 요금은 얼마인가요?

가격 영역에 이 모델의 입력, 출력, 캐시 읽기 요금이 표시됩니다. 계산기로 토큰 구성을 추산한 다음 실제 사용량과 청구 내역을 확인하세요. 다른 공급업체의 가격이나 프로모션을 적용해서는 안 됩니다.

언제 Flash 대신 FlashX를 선택해야 하나요?

응답 시간이 대화형 작업을 제한할 때 FlashX를 평가하세요. Flash는 토큰 단가가 더 낮아 오프라인 일괄 처리에 유리할 수 있습니다. 동일한 설정에서 성공률, 전체 시간, 재시도, 비용을 비교하세요.

EvoLink는 초당 200토큰을 보장하나요?

이 페이지는 속도를 보장하지 않습니다. Z.ai가 발표한 FlashX 속도는 200 tokens/s이며 공급업체의 주장이지 EvoLink 실측이나 SLA가 아닙니다. 첫 토큰 지연과 전체 요청 시간을 각각 측정하세요.

FlashX는 어떤 입력과 출력을 지원하나요?

Z.ai는 텍스트·이미지·영상·파일 입력과 텍스트 출력을 명시합니다. 해당 경로의 형식은 연결된 API 문서에서 확인하세요. 영상이나 파일을 입력받는다고 API가 영상이나 Office 파일을 직접 생성하는 것은 아닙니다.

추론을 끌 수 있나요?

Z.ai 문서에서 FlashX의 thinking.type은 enabled만 지원합니다. reasoning_effort를 낮춰도 추론이 꺼지지는 않습니다. Z.ai는 thinking 객체 안에 clear_thinking: false를 설정하도록 권장합니다(전체 경로: thinking.clear_thinking). 경로 지원 여부는 API 문서를 확인하세요.

미디어 입력과 캐시 비용은 어떻게 계산하나요?

대표 요청의 사용량과 청구 내역을 확인하고 가격 영역의 해당 요금을 적용하세요. 이미지마다 고정된 토큰 수가 있다고 가정하거나 반복 프롬프트마다 캐시가 적중한다고 가정하지 마세요.

FlashX의 컨텍스트 창은 얼마나 큰가요?

Z.ai는 100만 토큰 컨텍스트와 최대 128K 토큰 출력을 문서화했습니다. 출력 한도를 정하기 전에 사양과 API 문서를 확인하세요. 입력 컨텍스트와 출력 허용량은 서로 다른 한도입니다.

GLM-5.3을 대체 경로로 사용할 수 있나요?

검수 기준을 통과하지 못한 호환 가능한 텍스트 전용 작업에 대해 평가할 수 있습니다. GLM-5.3은 같은 멀티모달 입력을 받지 않으므로 이미지·영상·파일 요청을 그대로 전달하지 마세요. 입력 처리, 비용, 재시도 방식을 먼저 정해야 합니다.