Skip to main content
POST
BaseURL 설명: 기본 BaseURL은 https://direct.evolink.ai이며, 텍스트 모델을 더 잘 지원하고 장기 연결을 지원합니다; https://api.evolink.ai는 멀티모달 주력 주소로, 이미지 입력을 포함할 때 이 주소를 사용하세요.세션 캐시: Responses API는 요청 헤더 x-dashscope-session-cache: enable로 서버 측 세션 캐시를 활성화하여 멀티턴 지연과 비용을 절감합니다.

인증

Authorization
string
header
필수

##모든 API에는 Bearer Token 인증이 필요합니다##

API Key 발급:

API Key 관리 페이지에서 API Key를 발급받으세요

요청 헤더에 추가:

헤더

x-dashscope-session-cache
enum<string>
기본값:disable

세션 캐시 스위치. enable로 설정하면 서버가 대화 컨텍스트를 자동 캐시하여 멀티턴 추론 지연과 비용을 절감합니다.

사용 가능한 옵션:
enable,
disable

본문

application/json
model
enum<string>
필수

대화 모델 이름

사용 가능한 옵션:
qwen3.8-max
예시:

"qwen3.8-max"

input
필수

모델 입력. 문자열(순수 텍스트)을 전달할 수 있으며, Chat 형식의 메시지 배열도 전달 가능(멀티모달 input_text / input_image 지원).

instructions
string

시스템 지시로 컨텍스트 시작 위치에 삽입됩니다. previous_response_id를 사용할 때, 이전 턴의 instructions는 이번 턴에 전달되지 않습니다.

previous_response_id
string

이전 턴 응답의 고유 ID(응답 id, 유효 기간 7일). 멀티턴 대화를 연결하는 데 사용하며, 서버가 해당 턴의 입력과 출력을 자동으로 검색·구성하여 컨텍스트로 사용합니다.

max_output_tokens
integer

이번 생성 출력 콘텐츠의 최대 token 수(사고 포함).

reasoning
object

사고 제어.

store
boolean
기본값:true

이번 응답을 저장할지 여부.

  • true(기본값): previous_response_id로 참조 가능
  • false: 저장하지 않으며, 이후 참조할 수 없음
stream
boolean
기본값:false

Responses 이벤트로 스트리밍 반환할지 여부.

temperature
number

샘플링 온도, 범위 [0, 2].

필수 범위: 0 <= x <= 2
top_p
number

뉴클리어스 샘플링 매개변수, 범위 (0, 1].

필수 범위: 0 <= x <= 1
tools
object[]

도구 목록. 내장 도구(web_search 웹 검색, web_extractor 웹 페이지 추출, code_interpreter 코드 인터프리터)와 사용자 정의 function을 지원합니다.

응답

생성 성공

id
string

이번 응답의 고유 ID(유효 기간 7일, previous_response_id로 사용 가능)

예시:

"resp_xxxxxxxx"

object
string
예시:

"response"

status
string

응답 상태

예시:

"completed"

model
string
예시:

"qwen3.8-max"

output
object[]

출력 항목 배열(message / reasoning / 내장 도구 호출 등 포함)

usage
object

token 사용 통계.