
DeepSeek V4 Flash/Pro vs GPT-5.4 vs Claude Opus 4.6: 공식 가격 및 성능 비교

라이프사이클 업데이트(2026년 9월 10일): DeepSeek이 V4.1 Flash를 출시했습니다. DeepSeek 직결 API에서는deepseek-v4-flash와deepseek-v4-flash-vision-exp가 이미 V4.1 Flash로 라우팅되며,deepseek-v4-pro도 2026년 9월 14일 베이징 시간 12:00(한국 시간 13:00, UTC 04:00)부터 뒤따를 예정입니다. EvoLink에서는deepseek-v4-flash와deepseek-v4-pro가 영향을 받지 않으며 계속 DeepSeek V4 Flash와 V4 Pro를 제공합니다.deepseek-v4-flash-vision-exp는 이제 DeepSeek V4.1 Flash로 리디렉션됩니다. 자세한 내용은 공식 업데이트, V4.1 Flash 모델 페이지, 마이그레이션 가이드를 참고하세요.
이 글은 Claude Opus 4.6과의 역사적 비교 의도를 유지합니다. DeepSeek 부분은 2026년 8월 13일 확인 당시의 요청 ID, Flash 0731·Pro 0813 버전, 당시 공식 직결 가격을 기록한 것입니다. 현재 라우트 제공 여부와 과금은 링크된 모델 페이지에서 확인하세요.
4.6 비교 세트인 만큼 의도적으로 Claude Opus 4.6을 비교 대상으로 유지합니다. 최신 Claude 릴리스에 대한 최종 판단이 아니라, 지금도 참고 가치가 있는 비교 기준선으로 읽어주세요.deepseek-v4-flash**와 **deepseek-v4-pro**가 등록되어 있고, 공식 가격 페이지에 가격, 1M 컨텍스트, 384K 최대 출력이 공개되어 있습니다. DeepSeek API Docs DeepSeek Models & Pricing비교의 성격이 바뀌었습니다——"DeepSeek V4를 검증할 수 있는가?"에서 보다 실용적인 판단으로:
- DeepSeek V4 Flash가 더 적합한 경우는?
- DeepSeek V4 Pro에 추가 비용을 낼 가치가 있는 경우는?
- GPT-5.4나 Claude Opus 4.6을 선택해야 하는 경우는?
핵심 요약
- DeepSeek V4 Flash — 이 비교 세트에서 가장 저렴한 공식 옵션: 입력 $0.14 / 출력 $0.28 (100만 토큰당), 1M 컨텍스트, 384K 최대 출력. 대량 코딩, Agent 라우팅, 비용 민감 장기 컨텍스트 작업에 최적. DeepSeek Models & Pricing
- DeepSeek V4 Pro — 상위 지능 V4 라우트: 입력 $0.435 / 출력 $0.87 (100만 토큰당, 2026년 8월 16일 16:00 UTC까지 유효). 이후 공개된 피크/오프피크 새 요금이 적용됩니다(오프피크 $0.66 / $1.98, 피크는 2배). Claude Opus 4.6보다 훨씬 저렴하고 출력은 GPT-5.4보다 낮은 가격. 1M 컨텍스트와 384K 최대 출력 유지. DeepSeek Models & Pricing
- GPT-5.4 — OpenAI 공식 플래그십. 복잡한 전문 업무용: 1,050,000 컨텍스트, 128,000 최대 출력, $2.50 / $15.00. OpenAI Pricing OpenAI GPT-5.4 Model
- Claude Opus 4.6 — 코딩과 Agent 작업의 최상위 선택: $5 / $25 (100만 토큰당), 128K 출력, Claude 개발자 플랫폼에서 1M 컨텍스트(beta). Anthropic Claude Opus 4.6
현재 공식 검증 가능한 정보
아래 표는 각 벤더의 공식 문서에 현재 기재된 정보만 사용합니다.
| 항목 | DeepSeek V4 Flash | DeepSeek V4 Pro | GPT-5.4 | Claude Opus 4.6 |
|---|---|---|---|---|
| 제공사 | DeepSeek | DeepSeek | OpenAI | Anthropic |
| 현재 버전 | DeepSeek-V4-Flash-0731 | DeepSeek-V4-Pro-0813 | GPT-5.4 | Claude Opus 4.6 |
| 입력 가격 | $0.14 / 1M (캐시 미스) | $0.435 / 1M (캐시 미스) | $2.50 / 1M | $5.00 / 1M |
| 캐시 입력 가격 | $0.0028 / 1M | $0.003625 / 1M | $0.25 / 1M | 캐시·장기 컨텍스트 티어에 따라 상이 |
| 출력 가격 | $0.28 / 1M | $0.87 / 1M | $15.00 / 1M | $25.00 / 1M |
| 컨텍스트 | 1M | 1M | 1,050,000 | 1M (beta) |
| 최대 출력 | 384K | 384K | 128K | 128K |
| 사고 모드 | 지원 | 지원 | reasoning effort 경유 | adaptive/extended thinking 경유 |
| 도구 호출 | 지원 | 지원 | 지원 | 지원 |
| 포지셔닝 | V4 저비용 라우트 | V4 고지능 라우트 | OpenAI 공식 플래그십 | Anthropic 공식 플래그십 |
가격 실체 확인
세 벤더 모두 공식 가격을 공개하고 있어 비교가 명쾌합니다.
| 모델 | 입력 | 캐시 입력 | 출력 | 실용 포인트 |
|---|---|---|---|---|
| DeepSeek V4 Flash | $0.14 | $0.0028 | $0.28 | 큰 차이로 최저가 공식 라우트 |
| DeepSeek V4 Pro | $0.435 | $0.003625 | $0.87 | Claude Opus 4.6보다 훨씬 저렴, 출력은 GPT-5.4 이하 |
| GPT-5.4 | $2.50 | $0.25 | $15.00 | 복잡한 전문 업무용 OpenAI 프리미엄 라우트 |
| Claude Opus 4.6 | $5.00 | 티어 의존 | $25.00 | 가장 비싸지만 최상위 코딩·Agent 모델 |
바로 눈에 띄는 두 가지:
- DeepSeek V4 Flash가 큰 차이로 비용 리더.
- DeepSeek V4 Pro가 "미검증 관찰 리스트"에서 실질적인 가성비 프리미엄 옵션으로 격상.
출력 토큰 단가가 중요한 워크로드에서는 격차가 특히 큽니다:
- V4 Flash 출력은 GPT-5.4, Claude Opus 4.6보다 압도적으로 저렴
- V4 Pro 출력도 GPT-5.4, Claude Opus 4.6보다 확실히 저렴
가장 큰 실무 변화: DeepSeek V4는 이제 Flash vs Pro
이전 V4 비교 글은 V4를 하나의 가상 모델로 다뤘지만, 의사결정에는 더 이상 정확하지 않습니다.
오늘 더 유용한 프레이밍:
- Flash 선택 — 비용, 처리량, 광범위 배포가 가장 중요할 때
- Pro 선택 — 더 강한 추론 품질이 필요하지만 클로즈드 모델 가격은 피하고 싶을 때
DeepSeek V4는 GPT-5.4나 Opus 4.6에 대한 단일 경쟁자가 아니라 2단계 제품 군으로 봐야 합니다.
어떤 모델이 어떤 워크플로에 맞나
DeepSeek V4 Flash: 최고의 가성비를 원한다면
Flash가 최적인 경우:
- 대량 코딩 지원
- 비용 민감 Agent 파이프라인
- 대규모 컨텍스트 문서·리포지토리 처리
- 저비용 유지가 필요한 라우팅 기본값
DeepSeek V4 Pro: 클로즈드 모델 가격 없이 프리미엄 V4를 원한다면
Pro가 적합한 경우:
- 버짓 라우트보다 깊은 추론 필요
- 높은 난이도의 코딩·분석 작업
- 긴 구조화 출력
- Flash에서 업그레이드하되 Claude Opus 4.6 가격대까지는 점프하고 싶지 않을 때
많은 팀에게 Pro는 GPT-5.4나 Opus 4.6의 만능 대체가 아니라 나란히 평가할 가치가 있는 저비용 프리미엄 옵션입니다.
GPT-5.4: OpenAI 공식 플래그십이 필요하다면
GPT-5.4가 매력적인 경우:
- OpenAI 공식 플랫폼 지원 필요
- 문서화된 1,050,000 컨텍스트 윈도우
- 128,000 최대 출력
- 익숙한 OpenAI 개발자 워크플로
Claude Opus 4.6: Anthropic 최상위 코딩·Agent 능력이 최우선이라면
Claude Opus 4.6이 강한 경우:
- Anthropic 플래그십 코딩 모델
- extended thinking과 adaptive thinking 제어
- 장시간 Agent 워크플로
- 컨텍스트 압축, 1M 컨텍스트 beta 등 Claude 플랫폼 기능
컨텍스트와 출력 한도가 더 중요해졌다
DeepSeek V4 업데이트로 장기 컨텍스트 논의도 달라졌습니다.
이전에는 GPT-5.4나 Claude Opus 4.6을 선택하는 실무적 이유 중 하나가 "DeepSeek V4가 공식 문서화되지 않았다"였습니다. Flash와 Pro 모두 다음을 제공하는 지금, DeepSeek는 동일한 계획 대화에 정식으로 합류했습니다:
- 1M 컨텍스트
- 384K 최대 출력
이것이 중요한 장면:
- 리포지토리 규모 코드 이해
- 긴 법률·연구 문서
- 다단계 Agent 장기 루프
- 대량의 단일 응답 출력이 필요한 작업
순수 최대 출력 여유 면에서 공식 문서 기준 DeepSeek V4가 GPT-5.4와 Claude Opus 4.6을 확실히 앞섭니다.
유스케이스별 추천

| 유스케이스 | 최적 선택 | 이유 |
|---|---|---|
| 최저비용 공식 장기 컨텍스트 라우트 필요 | DeepSeek V4 Flash | 1M 컨텍스트+384K 출력으로 최저 공식 가격 |
| 더 강력한 프리미엄 DeepSeek 라우트 필요 | DeepSeek V4 Pro | GPT/Claude 수준 가격 없이 V4 고성능 옵션 |
| OpenAI 공식 플래그십 필요 | GPT-5.4 | OpenAI 문서화 플래그십, 1,050,000 컨텍스트+128K 출력 |
| Anthropic 최상위 코딩·Agent 모델 필요 | Claude Opus 4.6 | Anthropic 플래그십, 1M beta+128K 출력 |
| 광범위 프로덕션 라우팅용 모델 먼저 평가 | Flash → Pro | Flash로 비용 민감 라우팅, Pro로 고난이도 워크로드 |
2026년 3월 구버전 결론에서 달라진 점
구버전 결론:
- DeepSeek V4는 아직 관찰 리스트 단계
- V3.2가 DeepSeek의 실질 공식 기준선
- 팀은 V4로 예산을 잡으면 안 됨
이제 더 이상 맞지 않습니다.
- DeepSeek V4 Flash 0731과 Pro 0813이 현재 문서화된 버전
- DeepSeek V4 Flash와 Pro를 직접 평가해야 함
- V3.2는 V4 관련 비교의 올바른 계획 기준선이 아님
FAQ
1. DeepSeek V4가 공식적으로 사용 가능한가요?
deepseek-v4-flash와 deepseek-v4-pro가 각각 0731 및 0813 버전으로 표시됩니다. DeepSeek Models & Pricing2. DeepSeek V4와 GPT-5.4, Claude Opus 4.6의 가격을 책임감 있게 비교할 수 있나요?
3. Flash와 Pro 중 어느 것을 먼저 테스트해야 하나요?
대부분의 팀에게는 Flash가 먼저입니다. 1M 컨텍스트와 384K 최대 출력을 유지하면서 훨씬 저렴하기 때문입니다. 더 어려운 추론·코딩 작업이 있다면 다음으로 Pro를 테스트하세요.
4. GPT-5.4에 아직 우위가 있나요?
5. Claude Opus 4.6에 아직 우위가 있나요?
6. 이 비교에서 가장 저렴한 공식 옵션은?
7. DeepSeek-V3.2를 예산 기준선으로 계속 써야 하나요?
V4 계획에서는 아닙니다. DeepSeek V4가 대상이라면 V4 Flash와 V4 Pro가 현재의 올바른 기준선입니다.
8. 라우팅 세부 정보와 통합 가이드는 어디서?
출처
- DeepSeek API Docs
- DeepSeek Models & Pricing
- OpenAI API Pricing
- OpenAI GPT-5.4 Model
- Anthropic Claude Opus 4.6
- Anthropic Claude Opus 4.7
- China's AI darling DeepSeek previews new model | Reuters via Investing.com


