Messages API
GLM 전체 모델 인터페이스 - Messages 빠른 시작
- Anthropic Messages 프로토콜로 GLM 시리즈 모델을 호출하며,
model파라미터로 구체적인 모델을 선택합니다 - 필요한 파라미터는
model,max_tokens,messages세 가지뿐입니다(max_tokens는 Anthropic 프로토콜에서 필수) - 전 시리즈 1M token 컨텍스트 윈도우, 최대 출력 131,072 tokens
- 전 시리즈가 기본적으로 사고를 켜며, 응답
content에type="thinking"블록이 포함되고 이 부분은 output 토큰에 계산됩니다 - 스트리밍 출력, 도구 호출, 이미지 입력 등의 기능은 ‘전체 매개변수’ 페이지를 참조하세요
POST
BaseURL: 기본 BaseURL은
https://direct.evolink.ai이며, 텍스트 모델과 장시간 연결을 더 잘 지원합니다. https://api.evolink.ai는 멀티모달 서비스의 기본 엔드포인트이자 텍스트 모델의 대체 주소 역할을 합니다.GLM 시리즈는 기본적으로 사고가 켜져 있습니다. 응답
content 배열에 type="thinking" 블록이 포함되며 이 부분은 output 토큰에 계산됩니다. 따라서 max_tokens를 너무 작게 잡지 말고 1024 이상을 권장합니다. 너무 작으면 사고가 끝나기 전에 잘려 본문을 받지 못할 수 있습니다.인증
##모든 인터페이스는 Bearer Token 인증이 필요합니다##
API Key 발급:
API Key 관리 페이지에 방문하여 API Key를 발급받으세요
요청 헤더에 추가:
참고: EvoLink는 /v1/messages에 대해 일괄적으로 Bearer Token 인증을 사용합니다.
본문
application/json
호출할 모델:
사용 가능한 옵션:
glm-5.3, glm-5.3-flash, glm-5.2 예시:
"glm-5.3"
이번 생성의 최대 토큰 수로, Anthropic 프로토콜에서는 필수입니다.
참고: GLM 시리즈는 기본적으로 사고가 켜져 있고 사고 내용도 output 토큰을 차지하므로, 이 값을 너무 작게 잡지 말고 1024 이상을 권장합니다.
필수 범위:
1 <= x <= 131072예시:
1024
대화 메시지 목록으로, 시간 순서대로 배열합니다. 최소 1개의 메시지가 필요합니다.
Minimum array length:
1응답
메시지 객체
Anthropic 스타일의 메시지 응답
메시지 고유 ID(형식: msg_<uuid>)
응답 객체 유형
사용 가능한 옵션:
message 사용 가능한 옵션:
assistant 실제 사용된 모델
예시:
"glm-5.3"
응답 콘텐츠 블록 목록
포함될 수 있는 block type:
thinking: 추론 과정(사고가 켜져 있을 때, 기본적으로 켜짐)text: 최종 답변 텍스트tool_use: 모델이 발생시킨 도구 호출
중지 사유
end_turn: 자연스러운 종료(stop_sequences에 적중할 때도 이 값을 반환)max_tokens: max_tokens 상한 도달tool_use: 모델이 도구 호출을 트리거
사용 가능한 옵션:
end_turn, max_tokens, tool_use Token 사용 통계(Anthropic 규범)