Seedance 2.5가 EvoLink에 출시되었습니다Seedance 2.5 체험하기
어두운 프로덕션 게이트웨이를 가속하며 통과하는 밝은 AI 라우트
출시 워치

Gemini 3.7 Flash 출시: 2026년 8월 13일에 공개된 내용 정리

EvoLink Team
EvoLink Team
Product Team
2026년 8월 14일
13분 소요

결론부터: 현재까지 확인된 사실은?

Gemini 3.7 Flash는 정식 출시(GA)되었습니다. Google은 2026년 8월 13일에 이 모델을 공개하면서 "코딩과 에이전트를 위한 역대 가장 똑똑한 워크호스 모델"이라고 소개했습니다. 아래 내용은 2026년 8월 14일 기준 Google 공식 문서를 통해 확인된 사실입니다:
  • 모델 ID: gemini-3.7-flash — preview 접미사가 없는 stable 릴리스입니다.
  • 컨텍스트 윈도우: 1,048,576 토큰, 최대 출력: 65,536 토큰.
  • 입력: 텍스트, 이미지, 비디오, 오디오, PDF. 출력: 텍스트 전용.
  • 공식 프로모션 가격: 2026년 12월 31일까지 1M 토큰당 입력 $0.75 / 출력 $3.75, 2027년 1월 1일부터는 $1.50 / $7.50입니다. thinking 토큰은 출력 요율로 과금됩니다.
  • Gemini 3.6 Flash와 동일한 가격 — 업그레이드의 이유는 요금 인하가 아니라 성능과 토큰 효율입니다.
  • 새로 사전학습(pretrained)된 모델은 아닙니다. Google의 모델 카드는 Gemini 3.6 Flash의 추론 기반 위에 알고리즘 개선을 적용한 모델로 설명하며, 3.6 출시 3주 만에 나왔습니다.
EvoLink에서의 가격, 코드 예제, 프로덕션 가이드는 Gemini 3.7 Flash API 페이지를 참고하세요.

Gemini 3.6 Flash 대비 변경 사항

Google이 공개한 Gemini 3.6 Flash 대비 벤치마크 수치입니다(모든 수치는 공식 모델 카드 기준 Google 자체 발표값이므로, 독립적인 재현 결과가 나오기 전까지는 벤더 발표치로 받아들이는 것이 좋습니다):
벤치마크Gemini 3.7 FlashGemini 3.6 Flash
FrontierCode 1.1 (프로덕션 코딩)43.6%34.4%
DeepSWE v1.1 (장기 SWE 작업)65.3%~49% (기준치는 출처에 따라 다름)
Terminal-bench 2.1 (터미널 실행)85.8%78.0%
AutomationBench (에이전트)30.4%17.0%
WebDev Arena1588 Elo1538 Elo
GDM-MRCR v2 128k (롱 컨텍스트)97.0%91.8%
기존 3.6 워크로드를 옮길지 판단 중이라면 결정 가이드를 참고하세요: Gemini 3.7 Flash vs Gemini 3.6 Flash.
이번 출시의 핵심 메시지는 에이전트 안정성입니다. 실패하는 에이전트 루프가 줄고, 막히는 상황에서의 복구가 개선되었으며, design-to-code와 코드베이스 감사 작업이 강화되었다는 것입니다. 출시 당일의 외부 보도는 대부분 이 수치를 그대로 인용하고 있습니다. 지금까지 유일한 독립 측정은 Artificial Analysis의 결과인데, 최상위권 출력 속도와 함께 3.6 Flash보다 높은 할루시네이션 비율이 기록되었습니다. 프로덕션에 올리기 전에 자신의 실제 작업에서 직접 검증해 볼 가치가 있습니다.

Thinking Level: minimal이 사라졌습니다

Gemini 3.7 Flash는 조절 가능한 thinking level — low, medium(기본값), high — 을 도입했습니다. 기존 Flash 사용자에게는 두 가지 영향이 있습니다:
  1. minimal은 더 이상 존재하지 않습니다. Gemini API에 보내면 에러가 반환되므로, 이제 가장 저렴한 추론 하한은 low입니다. minimal에 의존하던 대용량 분류·추출 파이프라인이라면 저비용 대안으로 Gemini 3.5 Flash-Lite를 벤치마크해 보는 것이 좋습니다.
  2. **선택 가능한 가장 낮은 추론 수준은 low**이며, thinking 토큰은 출력 요율로 과금됩니다. 즉 출력 비용은 답변 길이뿐 아니라 선택한 thinking level에 따라 달라집니다.
EvoLink에서는 여전히 reasoning_effort: "none" 또는 "minimal"을 보내는 요청을 실패시키지 않고 자동으로 low로 다운그레이드하도록 되어 있어, 코드를 수정하는 동안에도 마이그레이션된 코드가 계속 동작합니다.

Breaking API 변경 사항과 마이그레이션 체크리스트

Gemini 3.6 Flash에서의 마이그레이션은 모델 ID 교체에 파라미터 정리를 더하는 수준입니다:

  • 모델을 gemini-3.7-flash로 변경합니다(하이픈 표기는 페이지 URL이지 API 파라미터가 아닙니다).
  • 커스텀 temperature, top_p, top_k, candidate_count를 제거합니다 — 3.7 Flash에서는 deprecated입니다.
  • 숫자형 thinking_budget 값을 문자열 thinking_level 파라미터로 교체합니다.
  • minimallow로 바꾸거나, 해당 트래픽을 Lite 계열 모델로 라우팅합니다.
  • 대표 프롬프트를 다시 돌려봅니다. 요율표가 같다고 토큰 소비량도 같은 것은 아니며, 출시 당일 일부 리포트에서는 3.6보다 작업당 토큰 사용량이 더 높게 관측되었습니다.

출시가 곧 모든 채널에서의 API 제공을 의미하지는 않습니다

Gemini 3.7 Flash 모델 라우트를 세 개의 API 채널에서 검증
Gemini 3.7 Flash 모델 라우트를 세 개의 API 채널에서 검증

Google에서 GA가 되었다고 해서 여러분이 쓰는 모든 채널에서 바로 사용할 수 있는 것은 아닙니다. 2026년 8월 14일 기준 현황:

  • 공식 채널: Gemini API / AI Studio, Android Studio, Google Antigravity, Gemini Enterprise Agent Platform, 그리고 Gemini 앱의 Spark 경험.
  • 애그리게이터: OpenRouter는 출시 당일 바로 등록했고, kie.ai가 하루 안에 뒤따랐습니다. 다른 대부분의 애그리게이션 플랫폼은 오픈 웨이트 모델 중심이라 아예 취급하지 않을 가능성이 높습니다 — 이 모델은 셀프 호스팅할 웨이트가 없는 클로즈드, API 전용 모델입니다.
  • EvoLink: gemini-3.7-flash는 OpenAI 호환 /v1/chat/completions 엔드포인트와 네이티브 Gemini API 양쪽에서 사용할 수 있습니다. 프로덕션 트래픽을 전환하기 전에 자신의 키로 경로를 확인하세요:
curl -s https://api.evolink.ai/v1/models \
  -H "Authorization: Bearer $EVOLINK_API_KEY" | grep gemini-3.7-flash
gemini-3.6-flash도 동일한 가격과 동일한 엔드포인트에서 계속 사용할 수 있으므로, 단계적으로 마이그레이션하고 문제가 생기면 즉시 롤백할 수 있습니다.

가격: 프로모션 기간이 핵심입니다

헤드라인의 $0.75 / $3.75는 만료일이 있는 프로모션 가격입니다. Google이 공개한 요금 일정:
2026년 12월 31일까지2027년 1월 1일부터
입력 / 1M 토큰$0.75$1.50
출력 (thinking 포함) / 1M$3.75$7.50
캐시 읽기 / 1M$0.075$0.15

에이전트 워크로드에서는 캐시 읽기가 실질적인 지렛대입니다. 100만 Token당 $0.075는 새 입력 토큰의 10분의 1 수준이므로, 시스템 프롬프트·리포지터리 지침·도구 스키마 같은 접두 부분이 호출 간에 동일하게 유지되면 그만큼 비용이 절감됩니다.

Batch는 두 요금 일정 모두에서 절반 가격입니다. 2027년 예산용 비용 모델을 만들고 있다면 출시 프로모션 가격이 아니라 표준 요율을 사용하세요. 이 모델의 현재 EvoLink 요율은 Gemini 3.7 Flash 가격 섹션에서 실시간으로 확인할 수 있습니다.

계속 지켜볼 만한 시그널

  • 독립 벤치마크 재현 — 아직 측정치를 공개한 독립 트래커는 한 곳뿐입니다.
  • 할루시네이션 비율 후속 데이터 — 출시 당일의 회귀 시그널은 더 많은 데이터가 필요합니다.
  • 자신의 작업당 토큰 변화량 — 효율 개선 주장은 워크로드에 따라 달라집니다.
  • 애그리게이터 롤아웃 — OpenRouter와 kie.ai 외에 이 모델을 등록하는 플랫폼이 나오는지.
  • 향후 Pro 릴리스 — Google의 최신 Pro 라인 모델은 여전히 gemini-3.1-pro-preview입니다.
  • 2026년 12월 31일 — 프로모션 가격 만료일.

FAQ

Gemini 3.7 Flash는 언제 출시되었나요?

2026년 8월 13일, 정식 출시(GA) stable 모델로 공개되었습니다 — Google 공식 API changelog와 모델 카드에서 확인할 수 있습니다.

Gemini 3.7 Flash의 모델 ID는 무엇인가요?

공식 Gemini API와 EvoLink 모두에서 점(.)을 사용하는 gemini-3.7-flash입니다. 하이픈 표기는 페이지 URL에서만 사용됩니다.

Gemini 3.7 Flash는 새 모델인가요, 업데이트인가요?

Google의 모델 카드는 새로 사전학습된 모델이 아니라 Gemini 3.6 Flash의 추론 기반 위에 알고리즘 개선을 적용한 모델로 설명합니다.

Gemini 3.7 Flash는 3.6 Flash보다 비싼가요?

아니요 — 두 모델은 2026년 12월 31일까지의 프로모션 기간을 포함해 동일한 요율표를 공유합니다.

minimal thinking level은 어떻게 되었나요?

제거되었습니다. 이제 level은 low, medium, high이며, Gemini API에 minimal을 보내면 에러가 발생합니다. EvoLink는 기존 minimal 요청을 자동으로 low로 다운그레이드하도록 되어 있습니다.

3.6에서 마이그레이션할 때 어떤 파라미터가 깨지나요?

커스텀 temperature, top_p, top_k, candidate_count가 deprecated되었고, 숫자형 thinking_budget은 thinking_level 문자열로 대체됩니다.

Gemini 3.7 Pro도 있나요?

아니요. 3.5나 3.7 Pro는 발표되지 않았으며, Pro 라인의 최신 모델은 여전히 gemini-3.1-pro-preview입니다.

Gemini 3.7 Flash API는 지금 어디에서 사용할 수 있나요?

Google의 Gemini API / AI Studio, Antigravity, Enterprise Agent Platform, 애그리게이터 중에서는 OpenRouter와 kie.ai, 그리고 위의 롤아웃 안내에 따른 EvoLink에서 사용할 수 있습니다 — 자신의 키의 /v1/models 목록에 ID가 있는지 확인하세요.

AI 비용을 89% 절감할 준비가 되셨나요?

오늘 EvoLink를 시작하고 지능형 API 라우팅의 힘을 경험해보세요.