Google Native API Format
Gemini 전체 모델 인터페이스 - Native API 형식
경로의 {model}을 통해 호출할 Gemini 텍스트 모델을 선택합니다(전체 선택 가능한 값은 model 파라미터의 대조표 참조).
- Google Native API 형식을 사용하여 대화 내용을 동기적으로 반환
- 일반 텍스트 / 멀티모달 입력: 텍스트 + 이미지 / 오디오 / 비디오 혼합 입력
- 스트리밍: 경로의
generateContent를streamGenerateContent로 대체(?alt=sse를 추가하여 SSE 획득 가능)
모델 사양 및 차이점
- 샘플링 파라미터
temperature/topP/topK: Gemini 3.x 전 시리즈 동일하며, 사용자 지정 값은 출력에 영향을 주지 않습니다.topK는 게이트웨이에서 바로 폐기되고(업스트림으로 전달되지 않음),temperature/topP는 유효 범위를 벗어나면 400을 반환합니다. - 사고 제어: Gemini 3.x 시리즈는
thinkingConfig.thinkingLevel(각 모델이 지원하는 레벨과 기본값은thinkingLevel파라미터 참조)을 사용하며, Gemini 2.5 시리즈는thinkingConfig.thinkingBudget(정수,0=비활성화)을 사용합니다. 둘은 상호 배타적입니다. - 함수 호출: Gemini 3.x의
FunctionResponse는 대응하는FunctionCall과 일치하는id와name을 반드시 함께 반환해야 하며, 그렇지 않으면 오류가 발생합니다. - 마지막 턴 역할: 마지막 메시지의
role은model일 수 없습니다(Gemini 3.5+에서 오류 발생). - Token 상한:
gemini-3.6-flash/gemini-3.5-flash-lite는 컨텍스트 1,048,576, 최대 출력 65,536이며, 그 외 모델은 각자의 사양을 따릅니다.
POST
BaseURL: 기본 BaseURL은
https://direct.evolink.ai이며, 텍스트 모델 지원이 더 우수하고 장시간 연결을 지원합니다. https://api.evolink.ai는 멀티모달 서비스의 주력 엔드포인트이며, 텍스트 모델에 대해서는 대체 주소로 사용됩니다.인증
경로 매개변수
호출할 Gemini 텍스트 모델을 선택하세요:
사용 가능한 옵션:
gemini-3.6-flash, gemini-3.5-flash, gemini-3.5-flash-lite, gemini-3.1-pro-preview, gemini-3.1-pro-preview-customtools, gemini-3.1-flash-lite-preview, gemini-3-pro-preview, gemini-3-flash-preview, gemini-2.5-pro, gemini-2.5-flash, gemini-2.5-flash-lite 예시:
"gemini-3.6-flash"
본문
application/json
List of conversation contents, supports multi-turn dialogue and multimodal input
Minimum array length:
1Generation configuration parameters (optional)
System instruction (optional), mainly text content
List of tools the model can call, such as function calling or code execution
Tool calling configuration (optional)
Safety settings list (optional)
Cached content name, in the form cachedContents/{cachedContent}
응답
콘텐츠가 성공적으로 생성되었습니다
응답 형식 설명:
generateContent엔드포인트 사용 시,GenerateContentResponse반환 (완전한 응답을 한 번에 반환)streamGenerateContent엔드포인트 사용 시,StreamGenerateContentResponse반환 (스트리밍 응답, 콘텐츠를 청크 단위로 반환)