Gemini 전체 모델 인터페이스 - OpenAI 호환 형식
요청 본문의 model을 통해 호출할 Gemini 텍스트 모델을 선택합니다(전체 선택 가능한 값은 model 파라미터의 대조표 참조).
- OpenAI SDK / Chat Completions 형식을 사용하여 대화 내용을 동기적으로 반환
- 일반 텍스트 / 멀티모달 입력: 텍스트 + 이미지 혼합 입력(
messages[].content) - 스트리밍:
stream: true를 설정하여 청크 단위로 반환
모델 사양 및 차이점
- 샘플링 / 페널티 파라미터
temperature/top_p/frequency_penalty/presence_penalty: Gemini 3.x 전 시리즈 동일하며, 사용자 지정 값은 출력에 영향을 주지 않습니다.temperature/top_p는 범위를 벗어나면 400을 반환하고,frequency_penalty/presence_penalty는 게이트웨이에서 필터링됩니다(오류는 발생하지 않음). - 사고 제어
reasoning_effort:minimal/low/medium/high(각 모델이 지원하는 레벨과 기본값은reasoning_effort파라미터 참조). Gemini 3.x 시리즈에서만 적용됩니다. - 마지막 턴 역할: 마지막 메시지의
role은assistant일 수 없습니다(Gemini 3.5+에서 오류 발생). - Token 상한:
gemini-3.6-flash/gemini-3.5-flash-lite는 컨텍스트 1,048,576, 최대 출력 65,536이며, 그 외 모델은 각자의 사양을 따릅니다.
https://direct.evolink.ai이며, 텍스트 모델 지원이 더 우수하고 장시간 연결을 지원합니다. https://api.evolink.ai는 멀티모달 서비스의 주력 엔드포인트이며, 텍스트 모델에 대해서는 대체 주소로 사용됩니다.인증
본문
호출할 Gemini 텍스트 모델을 선택하세요:
gemini-3.6-flash, gemini-3.5-flash, gemini-3.5-flash-lite, gemini-3.1-pro-preview, gemini-3.1-pro-preview-customtools, gemini-3.1-flash-lite-preview, gemini-3-pro-preview, gemini-3-flash-preview, gemini-2.5-pro, gemini-2.5-flash, gemini-2.5-flash-lite "gemini-3.6-flash"
채팅 메시지 목록, 다중 턴 대화 및 멀티모달 입력 지원
1스트리밍 모드로 응답을 반환할지 여부
true: 스트리밍 반환, 실시간 청크로 내용 수신false: 완전한 응답을 한 번에 반환
false
Maximum number of completion tokens for the generated response, corresponding to Gemini's maxOutputTokens.
gemini-3.6-flash / gemini-3.5-flash-lite는 상한 65,536 tokens이며, 그 외 모델은 각자의 사양을 따릅니다.
1 <= x <= 655362000
Maximum number of tokens for the generated response, compatible with the legacy OpenAI parameter.
1 <= x <= 655362000
샘플링 온도, 출력의 무작위성을 제어합니다
설명:
- 낮은 값 (예: 0.2): 더 결정적이고 집중된 출력
- 높은 값 (예: 1.5): 더 무작위적이고 창의적인 출력
⚠️ Gemini 3.x 전 시리즈 동일(모델에 따라 다르지 않음): 유효 범위 내의 사용자 지정 값은 출력에 영향을 주지 않습니다. 이 파라미터의 유효 범위를 벗어나면 조용히 무시되지 않고 400을 반환합니다.
0 <= x <= 20.7
핵 샘플링(Nucleus Sampling) 파라미터
설명:
- 누적 확률 상위 몇 %까지의 token에서 샘플링할지 제어합니다
- 예를 들어 0.9는 누적 확률이 90%에 도달하는 token에서 선택함을 의미합니다
- 기본값: 0.95
권장사항: temperature와 top_p를 동시에 조정하지 마세요
⚠️ Gemini 3.x 전 시리즈 동일(모델에 따라 다르지 않음): 유효 범위 내의 사용자 지정 값은 출력에 영향을 주지 않습니다. 이 파라미터의 유효 범위를 벗어나면 조용히 무시되지 않고 400을 반환합니다.
0 <= x <= 10.9
Frequency penalty coefficient. Range: -2.0 to 2.0. Corresponds to Gemini's frequencyPenalty.
⚠️ Gemini 3.x 전 시리즈 동일: 전달하면 게이트웨이에서 필터링되어 적용되지 않습니다(오류는 발생하지 않음).
-2 <= x <= 20
Presence penalty coefficient. Range: -2.0 to 2.0. Corresponds to Gemini's presencePenalty.
⚠️ Gemini 3.x 전 시리즈 동일: 전달하면 게이트웨이에서 필터링되어 적용되지 않습니다(오류는 발생하지 않음).
-2 <= x <= 20
Stop sequences. Supports a string or string array, corresponding to Gemini's stopSequences.
생성 후보 수
⚠️ Gemini 3.x는 1만 지원하며, >1을 전달하면 400을 반환합니다(native에서 이미 제거된 candidateCount와 동일).
1 <= x <= 11
사고 작업량을 제한하며, Gemini의 사고 레벨에 대응합니다:
minimal: 거의 사고하지 않으며, 고처리량 / 저지연low: 적은 사고, 간단한 작업medium: 품질과 속도의 균형high: 심층 다단계 추론
Gemini 3.x 시리즈에서만 적용되며, 각 모델이 지원하는 레벨과 기본값이 다릅니다(Native와 동일):
minimal, low, medium, high "minimal"
Random seed used to make output as reproducible as possible, corresponding to Gemini's seed.
12345
Response format settings, supporting JSON mode and JSON Schema, corresponding to Gemini's responseMimeType, responseSchema and responseJsonSchema.
- Option 1
- Option 2
Streaming response options. Can be set when stream is true.
List of tool definitions for Function Calling.
Controls tool-calling behavior.
none, auto, required Gemini extension parameters.