
GLM-5.3 정식 출시: API 가격, 마이그레이션 변화와 검증 체크리스트
glm-5.3를 사용하며, Chat Completions와 Anthropic Messages 엔드포인트를 모두 제공합니다. 아래의 단계적 상태는 출시 기록으로 남겨 둔 것이며, 오늘의 API 결론이 아닙니다. 현재 라우트 가격과 코드는 GLM-5.3 API 페이지에서 확인하세요.glm-5.3-flash로 가동 중입니다. 이미지·영상·파일 입력을 더하면서도 라우트 가격은 훨씬 낮습니다. 워크로드를 대량 처리 티어에서 시작할지, 텍스트 전용 플래그십으로 곧장 갈지는 GLM-5.3 Flash vs GLM-5.3 비교로 판단하세요.Z.ai가 실제로 발표한 것
| 항목 | 확인된 값 (2026년 8월 14일) |
|---|---|
| 공식 이름 / API 모델 ID | GLM-5.3 / glm-5.3 (Z.ai 자체 API 예제 기준) |
| 베이스 모델 | GLM-5.2와 동일; 모든 개선은 포스트 트레이닝 |
| 컨텍스트 윈도 / 최대 출력 | 1M 토큰 / 128K 토큰 |
| 모달리티 | 텍스트 입력·출력 — 비전 없음. TechTimes와 explainx가 보도한 출시 전 커뮤니티 요청이었으나 이번에 탑재되지 않음 |
| Thinking | 항상 켜짐: thinking.type: "disabled"는 더 이상 지원되지 않음 |
| 추론 제어 | 새 reasoning_effort 파라미터: low / high / max (코딩에는 max 권장) |
| 툴링 | Function calling, MCP, 스트리밍, 컨텍스트 캐싱, 구조화 출력 (공식 문서 기준) |
| 파라미터 수 | 미공개 (같은 베이스라는 추론 ≠ 공식 수치) |
| 포지셔닝 | "Built to Code. Ready for Cyber Defense." |
출시 이후 접근 상황은 어떻게 바뀌었나
| 채널 | 2026년 8월 14일 상태 | 근거 |
|---|---|---|
| GLM Coding Plan (구독) | ✅ 전 요금제에서 제공; GLM-5.2/5.1 요청은 이제 GLM-5.3로 자동 라우팅 | Z.ai devpack 문서 |
| ZCode (Z.ai 코딩 에이전트) | ✅ 제공 중, 8월 31일까지 쿼터 1.5배 프로모션 | Z.ai 발표문 |
| Z.ai 국제 API | ⚠️ 모호 — 블로그에는 "model": "glm-5.3" 요청 예제가 있지만, 공식 가격 페이지에는 GLM-5.3 항목이 없고 모델 문서 URL은 404 반환 | 2026년 8월 14일 확인 |
| BigModel API (중국) | ❌ "GLM-5.3 模型 API 即将上线" — Z.ai 자신의 표현으로 "곧 출시" | BigModel 문서 |
| 오픈 웨이트 (Hugging Face) | ❌ 안전성 평가와 하드닝 이후, 출시 약 2주 후 공개 약속; 라이선스 미공표 | Z.ai 발표문 |
| API 애그리게이터 | ❌ 주요 9개 플랫폼 중 출시 당일 GLM-5.3를 서빙할 수 있는 곳은 0곳; Together AI는 "coming soon" 자리표시만 게시 | 각 플랫폼 모델 API, 2026년 8월 14일 확인 |

벤치마크 주장 — 그리고 그 단서 조항
| 벤치마크 | GLM-5.3 | GLM-5.2 | 비고 |
|---|---|---|---|
| Terminal Bench 3.0 | 28.3 | 4.6 | 오픈 모델 1위 주장; Claude Fable 5 = 33.7 |
| DeepSWE v1.1 | 66.9 | 46.2 | |
| FrontierSWE | 78.1 | 67.5 | |
| SWE-Marathon v1.1 | 42.5 | 19.4 | |
| CyberGym | 84.5 | 77.2 | Z.ai 중국어 문서 본문에는 83.5%로 표기 — 공식 수치가 두 가지로 유통 |
| ExploitBench | 54.4 | 24.4 | Z.ai 스스로 클로즈드 모델이 여전히 앞선다고 명시 (Mythos 5 = 78) |
| Agents' Last Exam (CLI) | 28.5 | 23.8 | 오픈 모델 1위 주장 |
Z.ai는 내부 비공개 벤치마크인 자체 Code Bench에서 "GLM-5.2 대비 50% 개선"도 보고하며, 동시에 GLM-5.3가 max effort에서도 "여전히 Claude Fable 5에 뒤진다"는 점을 공개적으로 인정합니다. 출시 당일 Hacker News의 반응은 양극단을 모두 담고 있었습니다. 프런티어 클로즈드 모델에 "정말 간발의 차이(only just by a hair)"로 뒤진다는 평가와, "포스트 트레이닝 마법은 벤치마크 과적합 아닌가?"라는 질문입니다. 제3자 평가가 나오기 전까지 둘 다 기억해 둘 가치가 있는 인용입니다.
GLM-5.3, GLM 5.5, GLM-6 — 각각 무엇인가
두 달간 Z.ai 로드맵을 둘러싸고 세 가지 이름이 유통되었습니다. 오늘 출시 이후 각각의 위치는 다음과 같습니다.
- GLM-5.3 — 7월부터 개발자 커뮤니티에서 쓰인 이름. 오늘 출시된 것이 바로 이 모델입니다.
- GLM 5.5 — 별개의 애널리스트·언론 라벨(로이터를 경유한 JP모건 전망). 흔히 소문 속 1조 파라미터 초과 플래그십에 붙었습니다. 여전히 미발표 — 만약 나온다면 더 나중의 출시, 어쩌면 GLM-5.3 다음 차례가 될 것입니다. 우리의 GLM 5.5 출시 추적은 이를 독립된 실체로 계속 추적합니다.
- GLM-6 — 공식 근거가 전혀 없는 추측 갈래.
닫아 둘 만한 소문 하나: 널리 공유되던 GitHub "glm-5.3 브랜치" URL은 애초에 출시 증거가 아니었습니다(확인 당시 페이지에 커밋 기록이 없었고, 이후 저장소 자체가 공개 접근에서 사라졌습니다). 출시는 그와 무관하게 이루어졌습니다 — 공식 발표를 통해서, 정확히 이 추적기가 기다리라고 했던 그 아티팩트를 통해서 말입니다.
개발자에게 바뀐 것: API 계약
발표문에서 확인된, 마이그레이션 전에 반드시 알아야 할 API 수준 변경은 두 가지입니다.
- Thinking을 더 이상 끌 수 없습니다. GLM-5.2는
thinking.type: "disabled"를 받아들였지만 GLM-5.3는 받지 않습니다. 지연이나 비용 관리를 위해 non-thinking 호출에 의존하던 파이프라인에는 처리해야 할 브레이킹 체인지입니다. reasoning_effort가 새 제어 수단입니다 —low/high/max, 코딩 작업에는max권장.
Z.ai 공식 요청 예제:
{
"model": "glm-5.3",
"thinking": { "type": "enabled" },
"reasoning_effort": "max"
}오늘 GLM-5.3를 쓰고 싶다면
이제 구매 경로는 두 가지입니다. 포인트 기반 코딩 구독과 토큰당 과금 API — 두 방식의 표면 단위를 직접 비교하지는 마세요.
| 당신의 상황 | 오늘의 현실적 선택지 | 지켜볼 것 |
|---|---|---|
| Claude Code / OpenCode / 코딩 에이전트 사용 | GLM Coding Plan 구독 (월 $18부터, 포인트 기반 쿼터; GLM-5.3는 제품군 최고 포인트 배수로 과금) | 비피크 시간대는 포인트 50%로 과금 |
| API로 토큰 단위 과금 | EvoLink GLM-5.3 페이지에서 glm-5.3 호출; 일상 업무는 reasoning_effort: "low"부터 시작 | 수락 작업당 비용, 캐시 적중, 출력 토큰 증가폭 |
| 셀프 호스팅 | 웨이트(~8월 28일)와 라이선스 조건을 대기 | Hugging Face zai-org 조직; 라이선스가 GLM-5.2와 같으리란 보장 없음 |
| 비전이 필요 | GLM-5.3에는 없습니다; 멀티모달 라우트를 사용 | GLM-V 라인이 본류 GLM과 합류하는지 |
EvoLink는 이제 GLM-5.3를 다른 프로덕션 모델들과 같은 게이트웨이에서 제공합니다. 모델 ID는 설정값으로 유지하고, 스트리밍과 도구 동작은 자신의 페이로드로 검증하며, 테스트된 fallback을 남겨 두세요. 라우트가 열렸다는 사실이 워크로드 수용 테스트를 대신하지는 않습니다.
아직 모르는 것
가격이 공개된 뒤에도, 프로덕션과 직결되는 몇 가지 사실은 여전히 워크로드 수준의 검증을 요구합니다.
- 속도 제한과 동시성. RPM/TPM 수치 미공개.
- 오픈 웨이트 라이선스. GLM-5.2는 MIT 계열이었지만, Kimi와 Qwen은 최근 제한적 라이선스로 옮겨 갔고 커뮤니티는 Z.ai가 뒤따를지 지켜보고 있습니다. 2주의 안전성 심사는 조건이 달라질 수 있다는 뜻이기도 합니다.
- 파라미터 수. "GLM-5.2와 같은 베이스"는 추론을 부르지만, Z.ai는 수치를 공개하지 않았습니다.
- 독립 벤치마크. 출시 당일 숫자는 전부 Z.ai 공식 발표 수치입니다.
다음 업데이트를 트리거할 신호
- huggingface.co/zai-org에 GLM-5.3 웨이트가 명시적인 라이선스 조건과 함께 등장.
- 프로덕션 사이징에 쓸 수 있는 속도 제한·동시성 가이던스 공개.
- 벤더 벤치마크 표를 재현하거나 반박하는, 동일 하네스의 독립 평가 등장.
- Z.ai 또는 EvoLink 쪽에서 가격이나 API 계약에 실질적 변화 발생.
FAQ
GLM-5.3는 출시됐나요?
네. Z.ai가 2026년 8월 14일 GLM-5.3를 공식 발표했습니다. 출시 당일 접근은 구독 우선이었지만, 토큰당 API 가격은 현재 공개되어 있습니다.
오늘 GLM-5.3를 실제로 쓰는 방법은?
glm-5.3를 호출하거나, Z.ai의 GLM Coding Plan·ZCode 구독을 쓰면 됩니다. 앞쪽은 토큰당 과금이고, 뒤쪽은 플랜 경제성을 따릅니다.GLM-5.3 API는 언제 열리고, 얼마일까요?
GLM-5.3의 모델 ID는 무엇인가요?
glm-5.3를 사용하세요. 공식 예제와 EvoLink 라우트가 같은 공개 모델 ID를 씁니다."같은 베이스, 모든 개선은 포스트 트레이닝"이란 무슨 뜻인가요?
Z.ai는 새 모델을 사전학습하지 않았습니다. GLM-5.3는 GLM-5.2의 베이스 네트워크에 포스트 트레이닝(파인튜닝, RL 등)을 대폭 확장한 결과입니다. 새 파라미터 수가 없는 이유이자, 일부 개발자가 벤치마크 상승이 일반화될지 의심하는 이유입니다.
GLM-5.3는 GLM-5.2와 크기가 같나요?
베이스가 같으니 그럴 것으로 짐작되지만 — Z.ai는 GLM-5.3의 파라미터 수를 공개하지 않았으므로 어떤 수치도 공식으로 취급해서는 안 됩니다.
GLM-5.3는 비전을 지원하나요?
오픈 웨이트는 언제, 어떤 라이선스로 공개되나요?
Z.ai는 안전성 평가와 하드닝 이후, 출시 약 2주 후(2026년 8월 28일 전후) 웨이트 공개를 약속했습니다. 라이선스는 공표되지 않았습니다 — GLM-5.2의 조건이 이어진다고 가정하지 마세요.
이것이 GLM 5.5와 같은 모델인가요?
벤치마크 숫자는 믿을 만한가요?
Z.ai 공식 발표 수치이며, GLM-5.3가 클로즈드 모델에 뒤지는 비교까지 포함하고 있어 솔직함 면에서는 가산점이 있습니다. 그러나 독립 재현은 아직 없고, 한 수치(CyberGym)는 공식 문서마다 84.5와 83.5로 다르게 적혀 있습니다. 제3자 테스트가 나올 때까지 벤더 주장으로 취급하세요.
GLM-5.2 통합을 GLM-5.3로 옮기면 무엇이 깨지나요?
reasoning_effort가 새 제어 수단이 됩니다. 전체 마이그레이션 체크리스트는 GLM-5.3 vs GLM-5.2 가이드에 있습니다.지금 GLM-5.2에서 갈아타야 하나요?
glm-5.3로 통제된 챌린저 레인을 돌리고, thinking.type: "disabled"를 제거한 뒤 수락 작업당 비용을 비교하세요. 게이트를 통과할 때까지는 GLM-5.2를 롤백 라우트로 남겨 둡니다.참고 자료 및 변경 기록
- Z.ai — GLM-5.3 발표문
- BigModel — GLM-5.3 모델 문서
- Z.ai — GLM-5.3 공식 가격
- Z.ai — GLM Coding Plan / devpack 문서
- Hacker News — 출시 당일 토론
- Unite.AI — 출시 보도
- Hugging Face — zai-org (GLM-5.3 웨이트 아직 없음)
glm-5.3를 사용하며 현재 가격, 지원되는 두 API 프로토콜, 마이그레이션 점검, 코드 예제를 제공합니다. 현재형으로 "API 사용 불가"라고 안내하던 문장은 모두 내렸고, 출시 당일 상태는 날짜가 붙은 기록으로만 남겨 두었습니다.glm-5.3 모델 ID(공식 예제 기준), 1M/128K 한도, 텍스트 전용 모달리티, 항상 켜진 thinking과 reasoning_effort, 벤더 벤치마크 표, Coding Plan 제공과 GLM-5.2/5.1 자동 라우팅, 약 2주 후 오픈 웨이트 일정. 그 시점에 미해결이던 것: 토큰당 가격, API 개방일, 속도 제한, 라이선스, 파라미터 수, 독립 평가.

