Skip to main content
POST
BaseURL: 기본 BaseURL은 https://direct.evolink.ai이며, 텍스트 모델과 장시간 연결을 더 잘 지원합니다. https://api.evolink.ai는 멀티모달 서비스의 기본 엔드포인트이자 텍스트 모델의 대체 주소 역할을 합니다.
GLM 시리즈는 기본적으로 사고가 켜져 있습니다. 응답 content 배열에 type="thinking" 블록이 포함되며 이 부분은 output 토큰에 계산됩니다. 따라서 max_tokens를 너무 작게 잡지 말고 1024 이상을 권장합니다. 너무 작으면 사고가 끝나기 전에 잘려 본문을 받지 못할 수 있습니다.

인증

Authorization
string
header
필수

##모든 인터페이스는 Bearer Token 인증이 필요합니다##

API Key 발급:

API Key 관리 페이지에 방문하여 API Key를 발급받으세요

요청 헤더에 추가:

참고: EvoLink는 /v1/messages에 대해 일괄적으로 Bearer Token 인증을 사용합니다.

본문

application/json
model
enum<string>
기본값:glm-5.3
필수

호출할 모델:

사용 가능한 옵션:
glm-5.3,
glm-5.3-flash,
glm-5.2
예시:

"glm-5.3"

max_tokens
integer
기본값:1024
필수

이번 생성의 최대 토큰 수로, Anthropic 프로토콜에서는 필수입니다.

참고: GLM 시리즈는 기본적으로 사고가 켜져 있고 사고 내용도 output 토큰을 차지하므로, 이 값을 너무 작게 잡지 말고 1024 이상을 권장합니다.

필수 범위: 1 <= x <= 131072
예시:

1024

messages
Message · object[]
필수

대화 메시지 목록으로, 시간 순서대로 배열합니다. 최소 1개의 메시지가 필요합니다.

Minimum array length: 1

응답

메시지 객체

Anthropic 스타일의 메시지 응답

id
string

메시지 고유 ID(형식: msg_<uuid>)

type
enum<string>

응답 객체 유형

사용 가능한 옵션:
message
role
enum<string>
사용 가능한 옵션:
assistant
model
string

실제 사용된 모델

예시:

"glm-5.3"

content
object[]

응답 콘텐츠 블록 목록

포함될 수 있는 block type:

  • thinking: 추론 과정(사고가 켜져 있을 때, 기본적으로 켜짐)
  • text: 최종 답변 텍스트
  • tool_use: 모델이 발생시킨 도구 호출
stop_reason
enum<string>

중지 사유

  • end_turn: 자연스러운 종료(stop_sequences에 적중할 때도 이 값을 반환)
  • max_tokens: max_tokens 상한 도달
  • tool_use: 모델이 도구 호출을 트리거
사용 가능한 옵션:
end_turn,
max_tokens,
tool_use
usage
object

Token 사용 통계(Anthropic 규범)