메인 콘텐츠로 건너뛰기
POST
BaseURL: 기본 BaseURL은 https://direct.evolink.ai이며, 텍스트 모델 지원이 더 우수하고 장시간 연결을 지원합니다. https://api.evolink.ai는 멀티모달 서비스의 주력 엔드포인트이며, 텍스트 모델에 대해서는 대체 주소로 사용됩니다.

인증

Authorization
string
header
필수

##모든 API는 Bearer Token 인증이 필요합니다##

API Key 받기:

API Key 관리 페이지를 방문하여 API Key를 받으세요

요청 헤더에 추가:

본문

application/json
model
enum<string>
필수

호출할 Gemini 텍스트 모델을 선택하세요:

사용 가능한 옵션:
gemini-3.6-flash,
gemini-3.5-flash,
gemini-3.5-flash-lite,
gemini-3.1-pro-preview,
gemini-3.1-pro-preview-customtools,
gemini-3.1-flash-lite-preview,
gemini-3-pro-preview,
gemini-3-flash-preview,
gemini-2.5-pro,
gemini-2.5-flash,
gemini-2.5-flash-lite
예시:

"gemini-3.6-flash"

messages
object[]
필수

채팅 메시지 목록, 다중 턴 대화 및 멀티모달 입력 지원

Minimum array length: 1
stream
boolean
기본값:false

스트리밍 모드로 응답을 반환할지 여부

  • true: 스트리밍 반환, 실시간 청크로 내용 수신
  • false: 완전한 응답을 한 번에 반환
예시:

false

max_completion_tokens
integer | null

Maximum number of completion tokens for the generated response, corresponding to Gemini's maxOutputTokens.

gemini-3.6-flash / gemini-3.5-flash-lite는 상한 65,536 tokens이며, 그 외 모델은 각자의 사양을 따릅니다.

필수 범위: 1 <= x <= 65536
예시:

2000

max_tokens
integer

Maximum number of tokens for the generated response, compatible with the legacy OpenAI parameter.

필수 범위: 1 <= x <= 65536
예시:

2000

temperature
number
기본값:1

샘플링 온도, 출력의 무작위성을 제어합니다

설명:

  • 낮은 값 (예: 0.2): 더 결정적이고 집중된 출력
  • 높은 값 (예: 1.5): 더 무작위적이고 창의적인 출력

⚠️ Gemini 3.x 전 시리즈 동일(모델에 따라 다르지 않음): 유효 범위 내의 사용자 지정 값은 출력에 영향을 주지 않습니다. 이 파라미터의 유효 범위를 벗어나면 조용히 무시되지 않고 400을 반환합니다.

필수 범위: 0 <= x <= 2
예시:

0.7

top_p
number
기본값:0.95

핵 샘플링(Nucleus Sampling) 파라미터

설명:

  • 누적 확률 상위 몇 %까지의 token에서 샘플링할지 제어합니다
  • 예를 들어 0.9는 누적 확률이 90%에 도달하는 token에서 선택함을 의미합니다
  • 기본값: 0.95

권장사항: temperature와 top_p를 동시에 조정하지 마세요

⚠️ Gemini 3.x 전 시리즈 동일(모델에 따라 다르지 않음): 유효 범위 내의 사용자 지정 값은 출력에 영향을 주지 않습니다. 이 파라미터의 유효 범위를 벗어나면 조용히 무시되지 않고 400을 반환합니다.

필수 범위: 0 <= x <= 1
예시:

0.9

frequency_penalty
number | null
기본값:0

Frequency penalty coefficient. Range: -2.0 to 2.0. Corresponds to Gemini's frequencyPenalty.

⚠️ Gemini 3.x 전 시리즈 동일: 전달하면 게이트웨이에서 필터링되어 적용되지 않습니다(오류는 발생하지 않음).

필수 범위: -2 <= x <= 2
예시:

0

presence_penalty
number | null
기본값:0

Presence penalty coefficient. Range: -2.0 to 2.0. Corresponds to Gemini's presencePenalty.

⚠️ Gemini 3.x 전 시리즈 동일: 전달하면 게이트웨이에서 필터링되어 적용되지 않습니다(오류는 발생하지 않음).

필수 범위: -2 <= x <= 2
예시:

0

stop

Stop sequences. Supports a string or string array, corresponding to Gemini's stopSequences.

n
integer | null
기본값:1

생성 후보 수

⚠️ Gemini 3.x는 1만 지원하며, >1을 전달하면 400을 반환합니다(native에서 이미 제거된 candidateCount와 동일).

필수 범위: 1 <= x <= 1
예시:

1

reasoning_effort
enum<string> | null

사고 작업량을 제한하며, Gemini의 사고 레벨에 대응합니다:

  • minimal: 거의 사고하지 않으며, 고처리량 / 저지연
  • low: 적은 사고, 간단한 작업
  • medium: 품질과 속도의 균형
  • high: 심층 다단계 추론

Gemini 3.x 시리즈에서만 적용되며, 각 모델이 지원하는 레벨과 기본값이 다릅니다(Native와 동일):

사용 가능한 옵션:
minimal,
low,
medium,
high
예시:

"minimal"

seed
integer | null

Random seed used to make output as reproducible as possible, corresponding to Gemini's seed.

예시:

12345

response_format
object

Response format settings, supporting JSON mode and JSON Schema, corresponding to Gemini's responseMimeType, responseSchema and responseJsonSchema.

stream_options
object | null

Streaming response options. Can be set when stream is true.

tools
object[] | null

List of tool definitions for Function Calling.

tool_choice

Controls tool-calling behavior.

사용 가능한 옵션:
none,
auto,
required
extra_body
object | null

Gemini extension parameters.

응답

채팅 완성이 성공적으로 생성되었습니다

id
string

채팅 완성의 고유 식별자

예시:

"chatcmpl-20251010015944503180122WJNB8Eid"

model
string

실제 사용된 모델 이름

예시:

"gemini-3.6-flash"

object
enum<string>

응답 유형

사용 가능한 옵션:
chat.completion
예시:

"chat.completion"

created
integer

생성 타임스탬프

예시:

1760032810

choices
object[]

채팅 완성 선택지 목록

usage
object

토큰 사용 통계