메인 콘텐츠로 건너뛰기
POST
BaseURL 설명: 기본 BaseURL은 https://direct.evolink.ai이며, 텍스트 모델을 더 잘 지원하고 장기 연결을 지원합니다; https://api.evolink.ai는 멀티모달 주력 주소로, 이미지 / 오디오 / 비디오 입력을 포함할 때 이 주소를 사용하세요.

인증

Authorization
string
header
필수

##모든 API에는 Bearer Token 인증이 필요합니다##

API Key 발급:

API Key 관리 페이지에서 API Key를 발급받으세요

요청 헤더에 추가:

본문

application/json
model
enum<string>
필수

대화 모델 이름

사용 가능한 옵션:
qwen3.8-max-preview
예시:

"qwen3.8-max-preview"

messages
(System Message · object | User Message · object | Assistant Message · object | Tool Message · object)[]
필수

대화 메시지 목록, 멀티턴 대화 지원. 역할(system / user / assistant / tool)에 따라 메시지 필드 구조가 다르므로 해당 역할을 선택해 확인하세요.

enable_thinking
boolean
기본값:false

심층 사고 활성화 여부

  • true: 모델이 사고 과정을 출력하며 reasoning_content로 반환
  • false(기본값): 사고 과정을 출력하지 않음

참고: 일부 모델은 비스트리밍 호출에서 명시적으로 true로 설정해야 사고 내용을 반환합니다.

temperature
number

샘플링 온도, 출력 무작위성을 제어합니다. 값이 낮을수록 더 결정적이고 높을수록 더 다양합니다. 범위 [0, 2]. temperature와 top_p를 동시에 조정하지 않는 것을 권장합니다.

필수 범위: 0 <= x <= 2
top_p
number

뉴클리어스 샘플링(Nucleus Sampling) 매개변수, 누적 확률 상위 일부 token에서 샘플링합니다. 범위 (0, 1]. temperature와 top_p를 동시에 조정하지 않는 것을 권장합니다.

필수 범위: 0 <= x <= 1
max_completion_tokens
integer

생성 콘텐츠 길이 상한(token 수), 사고 체인과 답변을 포함합니다. 사고형 모델에서는 이 매개변수 사용을 권장합니다. 기본값과 최대값은 모두 모델의 최대 출력 길이이며, 초과 시 finish_reason=length로 조기 중단됩니다.

max_tokens
integer

구버전 생성 길이 제한 매개변수.

지원 중단됨: 신규 연동에서는 max_completion_tokens를 사용하세요. 이 매개변수는 답변 부분만 제한합니다(사고 체인 미포함).

stream
boolean
기본값:false

응답을 스트리밍 방식으로 반환할지 여부.

  • true: SSE(Server-Sent Events)로 청크 단위 반환
  • false(기본값): 완전한 응답을 한 번에 반환
stream_options
object

스트리밍 응답 옵션, stream=true일 때만 유효합니다.

tools
object[]

도구 정의 목록, Function Calling에 사용됩니다. 각 도구는 이름, 설명, 매개변수 schema를 정의해야 합니다.

응답

대화 생성 성공

id
string

이번 대화의 고유 식별자

예시:

"chatcmpl-xxxxxxxx"

object
string
예시:

"chat.completion"

created
integer

생성 시간(Unix 초)

예시:

1735120033

model
string
예시:

"qwen3.8-max-preview"

choices
object[]
usage
object

token 사용 통계 정보.