Chat Completions API
GLM 전체 모델 인터페이스 - Chat Completions 빠른 시작
- OpenAI Chat Completions 프로토콜로 GLM 시리즈 모델을 호출하며,
model파라미터로 구체적인 모델을 선택합니다 - 필요한 파라미터는
model과messages두 가지뿐입니다 - 전 시리즈 1M token 컨텍스트 윈도우, 최대 출력 131,072 tokens
- 전 시리즈가 기본적으로 심층 사고를 켜며, 추론 과정은
reasoning_content로 반환됩니다 - 스트리밍 출력, 도구 호출, 사고 강도 조절, 이미지 입력 등의 기능은 ‘전체 매개변수’ 페이지를 참조하세요
POST
BaseURL: 기본 BaseURL은
https://direct.evolink.ai이며, 텍스트 모델과 장시간 연결을 더 잘 지원합니다. https://api.evolink.ai는 멀티모달 서비스의 기본 엔드포인트이자 텍스트 모델의 대체 주소 역할을 합니다.인증
본문
application/json
응답
채팅 완성이 성공적으로 생성되었습니다
작업 ID
예시:
"chatcmpl-a6613b56-c61c-94ba-9a9f-43d4cdc7d77a"
응답 유형
사용 가능한 옵션:
chat.completion 예시:
"chat.completion"
요청 ID(요청에서 request_id를 제공한 경우 다시 반환)
예시:
"req-7f3a2c1e8b9d4f0a"
요청 생성 시각, Unix 타임스탬프(초)
예시:
1777021417
모델 이름
예시:
"glm-5.3"
모델 응답 목록
호출 종료 시 반환되는 Token 사용 통계
콘텐츠 안전 관련 정보