GPT Image 2.5 Flare & Sunburst가 EvoLink에 출시되었습니다GPT Image 2.5 체험하기
DeepSeek V4 Flash Vision Exp API 이미지 입력 워크플로
튜토리얼

DeepSeek V4 Flash Vision Exp API 사용법: 이미지 입력

Jacey
Jacey
Founder
2026년 8월 21일
업데이트일 2026년 9월 10일
13분 소요
라이프사이클 업데이트(2026년 9월 10일): DeepSeek이 V4.1 Flash를 출시했습니다. DeepSeek 직결 API에서는 deepseek-v4-flash와 deepseek-v4-flash-vision-exp가 이미 V4.1 Flash로 라우팅되며, deepseek-v4-pro도 2026년 9월 14일 베이징 시간 12:00(한국 시간 13:00, UTC 04:00)부터 뒤따를 예정입니다. EvoLink에서는 deepseek-v4-flash와 deepseek-v4-pro가 영향을 받지 않으며 계속 DeepSeek V4 Flash와 V4 Pro를 제공합니다. deepseek-v4-flash-vision-exp는 이제 DeepSeek V4.1 Flash로 리디렉션됩니다. 자세한 내용은 공식 업데이트, V4.1 Flash 모델 페이지, 마이그레이션 가이드를 참고하세요.
DeepSeek은 2026년 8월 21일 텍스트와 이미지를 한 Request에서 받는 실험 모델 deepseek-v4-flash-vision-exp를 공개했습니다. EvoLink에서 deepseek-v4-flash-vision-exp로 보내는 Request는 이제 DeepSeek V4.1 Flash로 리디렉션되며, 새 연동에는 deepseek-v4.1-flash를 사용하세요. 아래 Request 구조는 8월 21일 문서를 기록한 것입니다. 이 ID 뒤의 모델이 바뀌었으므로, 새 ID로 재사용하기 전에 Protocol마다 대표 Request를 한 번씩 확인하고 이미지 평가 Set을 다시 실행하세요.
2026년 8월 21일 기준 EvoLink 문서에서 Chat은 image_url, Messages는 URL 또는 Base64 Source의 image Block, Responses는 input_image를 사용합니다. 아래 예시는 이 구조를 따릅니다. Traffic을 확대하기 전에 Production Account로 대표 이미지를 호출하세요.
DeepSeek V4.1 Flash 모델 페이지 보기
Router가 Text-only Request도 처리한다면 Vision Exp vs Flash 비교를 참고하세요. EvoLink에서 Text-only Traffic은 deepseek-v4-flash에 두고, 이미지 작업은 V4.1 Flash로 옮길 수 있습니다.

첫 이미지 호출 전 확인 사항

원래 Model ID는 deepseek-v4-flash-vision-exp이며, EvoLink에서는 이제 DeepSeek V4.1 Flash로 리디렉션됩니다. 새 연동은 deepseek-v4.1-flash를 사용합니다. 세 Protocol의 Content Block은 서로 바꿔 쓸 수 없습니다.
확인통과 조건이유
Model ID새 연동은 deepseek-v4.1-flash 전송. 기존 deepseek-v4-flash-vision-exp도 작동하지만 V4.1 Flash로 리디렉션Text Flash는 이미지 증거를 처리하지 않음
Protocol선택 Route에 이미지 입력 명시Text 호환이 Multimodal을 보장하지 않음
Input대표 URL/Base64 성공구조와 Validation이 다름
UsageInput/Output Usage 반환승인 결과당 Cost 계산
BillingEvoLink Usage/Billing 반영성공 Response만으로 과금 확인 불가
Fallback검증된 Vision Route 확보어떤 ID든 그 뒤의 모델은 변경·장애·중단될 수 있음

Runtime 확인이 실패한 Workload는 검증된 Vision 모델에 유지하고 V4.1 Flash를 평가 대상으로 둡니다.

이미지 입력 Workflow

한 장 이상의 이미지와 구체적인 지시를 보내고 Protocol을 선택한 뒤 구조화 결과와 Usage를 검증하고 Traffic을 늘립니다. 검토하지 않은 한 번의 시각 답변만으로 Browser나 Agent가 되돌릴 수 없는 Action을 실행하면 안 됩니다.

이미지, 문서, 차트를 멀티모달 API를 통해 세 가지 구조화 응답으로 Routing하는 흐름
이미지, 문서, 차트를 멀티모달 API를 통해 세 가지 구조화 응답으로 Routing하는 흐름

깨끗한 Screenshot, 복잡한 UI, Scan 문서, 작은 Label의 Chart, 의도적으로 모호한 이미지를 포함한 평가 Set을 만들고 예상 Field나 결정을 먼저 정의하세요.

Protocol별 이미지 구조

Chat Completions: image_url

{
  "model": "deepseek-v4-flash-vision-exp",
  "messages": [{"role": "user", "content": [
    {"type": "text", "text": "Return the visible error message and the UI state as JSON."},
    {"type": "image_url", "image_url": {"url": "https://example.com/screenshot.png"}}
  ]}]
}
EvoLink Chat 문서는 URL, Base64, 여러 이미지를 지원합니다. 이미지는 user Message에 두고 Model ID를 정확히 입력하세요.

Messages: image Block

{
  "model": "deepseek-v4-flash-vision-exp",
  "max_tokens": 1024,
  "messages": [{"role": "user", "content": [
    {"type": "image", "source": {"type": "url", "url": "https://example.com/invoice.png"}},
    {"type": "text", "text": "Extract invoice number, date, currency, subtotal, tax, and total."}
  ]}]
}
Messages는 최상위 max_tokens가 필요하고 source.type은 base64 또는 url입니다. Text Flash/Pro는 실제 이미지를 처리하지 않고 대체할 수 있으므로 이미지 이해에는 이미지 입력을 지원하는 ID(새 연동은 deepseek-v4.1-flash)를 지정해야 합니다.

Responses: input_image

{
  "model": "deepseek-v4-flash-vision-exp",
  "input": [{"role": "user", "content": [
    {"type": "input_text", "text": "Summarize the chart, then list every directly observed label."},
    {"type": "input_image", "image_url": "https://example.com/chart.png"}
  ]}]
}
Responses 문서는 input_image와 여러 이미지를 명시합니다. Streaming Event, Tool, Error는 Route별로 확인하고 이미지 지원만으로 Files API 전체 기능을 추정하지 마세요.

URL, Base64, Files API 선택

방식적합한 경우Production 확인
Public URL공개 Asset 또는 짧은 Signed URLGateway 접근 가능, 민감 정보 없음
Base64 Data URI작은 Private 이미지Request Limit 이내, Log에 Payload 미보관
Files API재사용·관리 FileEvoLink가 지원, 수명, 권한 명시

큰 이미지는 접근 가능한 Signed URL, 작은 Private 이미지는 Base64가 적합합니다. EvoLink 문서 전에는 Files API 지원을 주장하지 않습니다. Upstream은 JPEG, PNG, GIF, WebP를 문서화하지만 Gateway의 Size, URL, Timeout, 이미지 수 Limit은 별도 확인합니다.

이미지 Cost 계산

8월 21일 Vision Exp 모델에 대해 DeepSeek은 이미지 한 장을 최대 384 Input Token으로 설명했습니다. 현재 Vision 가이드는 직결 API에서 이미지당 최대 1024 Token을 상한으로 두며, 이 ID의 Request는 이제 V4.1 Flash에서 실행됩니다. 현재 규칙으로 이미지 부분의 상한을 잡고 EvoLink Usage로 확인하세요. 이것이 Request 전체 Cost는 아닙니다.
완료 Task Cost = 이미지 Input + Text Input + Output + Retry + Agent/Tool 추가 Turn
두 이미지는 현재 직결 API 규칙 기준 2,048 Image Token을 보수적 상한으로 잡고 Prompt와 Output을 더한 뒤 실제 EvoLink Usage와 비교합니다. Text Prefix Cache가 이미지에 똑같이 적용된다고 가정하지 않습니다. 현재 Rate는 Vision Exp 제품 페이지를 사용합니다.

자동화 전 검증

Workload승인 기준Escalation
송장 추출필수 Field 정확히 일치누락/Checksum 불일치 시 사람 검토
Screenshot QA상태와 Error Text 정확Crop 재시도 후 Review
Chart 분석Label과 해석 분리근거 없는 숫자 Reject
UI Agent위험한 부작용 없는 Action되돌릴 수 없는 Action은 확인

HTTP 성공률이 아니라 승인 결과율을 측정하세요. Retry와 수동 수정이 많으면 저렴한 Route가 더 비쌀 수 있습니다.

자주 발생하는 오류

증상원인대응
Model이 Enum에 없음ID 오류, 오래된 Cache, Account 권한ID/Access 확인, Text Flash로 대체 금지
Image 미지원Text Model/Protocol문서화된 Vision Route 사용
400 invalid content block다른 Protocol 구조image_url, image, input_image 맞춤
Image Fetch 실패Private, 만료, Redirect, Block접근 가능한 Signed URL/Base64
Request 과대Base64/여러 이미지 Limit 초과Resize, 압축, 분할, 문서화된 File Route
429/Timeout동시성/용량제한 Retry, 병렬 축소, Failover

RPM, TPM, File Size, Concurrency를 추정하지 말고 Route 문서와 Production Account로 검증하세요.

Production Rollout

  1. 선택 Protocol에서 URL/Base64 한 건 성공.
  2. Response, Usage, Billing, Error Log 확인.
  3. 고정 평가 Set으로 후보 모델(V4.1 Flash)과 Fallback 비교.
  4. 소량 Traffic에서 승인 결과 Cost 측정.
  5. 품질, Latency, Error, Cost가 기준을 충족하면 확대.

Model ID는 Config에서 관리하세요. EvoLink 통합 Gateway는 한 모델을 위해 Integration을 다시 만들지 않고 Route, Usage, Billing을 비교하게 합니다.

FAQ

정확한 Model ID는 무엇인가요?

원래 Model ID는 실험 버전으로 공개된 deepseek-v4-flash-vision-exp이며, 계속 호출한다면 -exp까지 정확히 입력하세요. EvoLink에서 이 ID는 이제 DeepSeek V4.1 Flash로 리디렉션되므로 새 연동은 deepseek-v4.1-flash를 사용해야 합니다.

EvoLink에서 사용할 수 있나요?

이 ID는 EvoLink에서 계속 작동하지만, deepseek-v4-flash-vision-exp로 보내는 Request는 이제 DeepSeek V4.1 Flash로 리디렉션됩니다. 새 연동은 deepseek-v4.1-flash를 사용하고, 이전 이미지 결과에 의존하기 전에 마이그레이션 가이드를 확인하세요.

deepseek-v4-flash에 이미지를 보낼 수 있나요?

이미지가 실제로 처리되지 않을 수 있습니다. 이미지 의존 Task는 deepseek-v4.1-flash나 다른 검증된 Vision 모델을 사용하세요.

URL과 Base64 중 무엇을 쓰나요?

큰 접근 가능 Asset은 Signed URL, 작은 Private 이미지는 Limit 내 Base64를 사용합니다.

Files API를 지원하나요?

Upstream 문서만으로 EvoLink 각 Route 지원을 증명할 수 없습니다. EvoLink가 명시한 경우만 사용합니다.

이미지 한 장 Cost는?

원래 Vision Exp 모델은 이미지당 최대 384 Input Token이었고, 현재 Vision 가이드는 직결 API에서 이미지당 최대 1024 Token을 상한으로 둡니다. 이 ID의 Request는 이제 V4.1 Flash에서 실행되므로 현재 규칙으로 계획하고 Text, Output, Retry, Agent Turn을 더한 뒤 제품 페이지 Rate를 적용합니다.

이미지 Format은?

Upstream은 JPEG, PNG, GIF, WebP입니다. EvoLink Size, URL, 다중 이미지 Limit도 확인하세요.

Production 전에 무엇을 Test하나요?

쉬운/어려운 이미지, 구조화 출력, 작은 글자, 누락 Field, Latency, Retry, Usage, Billing, Fallback입니다.

출처

이 ID 뒤의 모델, 이미지 Field, Route Limit이 바뀌면 예제와 Billing을 다시 검증하세요.

AI 비용을 89% 절감할 준비가 되셨나요?

오늘 EvoLink를 시작하고 지능형 API 라우팅의 힘을 경험해보세요.