
Qwen3.8 Max Preview 기능, Token Plan 및 출시 상태
qwen3.8-max-preview, 1M 컨텍스트, 추론, 이미지 이해, Function Calling, 내장 도구와 세 가지 캐시 방식을 안내합니다. 표준 가격의 GA Backend API와 EvoLink Route는 아직 없습니다.이름 확인: Qwen3.8과 Qwen3-8B는 다른 모델입니다. 이전 80억 파라미터 모델의 가격, 다운로드, 로컬 배포 정보는qwen3.8-max-preview에 적용되지 않습니다.
2026년 7월 21일 현재 상태
| 질문 | 현재 답변 | 안전한 해석 |
|---|---|---|
| 공식 Preview가 있는가 | 예 | Token Plan에 qwen3.8-max-preview가 등록되어 있습니다. |
| GA인가 | 아니요 | 변경, 제거 또는 최종 모델로 대체될 수 있습니다. |
| 공개 ID가 있는가 | 예 | Qwen 채널용 ID이며 EvoLink ID를 의미하지 않습니다. |
| 개인 Plan Key를 Backend에 쓸 수 있는가 | 아니요 | 자동 스크립트, 커스텀 Backend, 비대화형 Batch가 금지됩니다. |
| 표준 Token 가격이 공개됐는가 | 아니요 | Credits는 Subscription 단위이지 일반 API 단가가 아닙니다. |
| Open Weights가 공개됐는가 | 아직 | 저장소, License, 구조, 일정이 확정되지 않았습니다. |
| EvoLink에서 사용할 수 있는가 | 아직 | 지원 경로에 필요한 사실을 검증 중입니다. |
Preview Client에서 사용할 수 있다는 것과 프로덕션 Backend에서 사용할 수 있다는 것은 다릅니다. 안정 ID, 과금, 지역, 제한, Lifecycle이 아직 확정되지 않았을 수 있습니다.
Token Plan은 표준 Qwen API가 아니다
확인된 Qwen3.8 기능
명시적인 추론 강도 제어
low, medium, xhigh를 문서화했으며 기본값은 xhigh입니다. 멀티턴 추론 기록을 보존하는 요구사항도 있습니다.좋은 단일 응답만으로 장시간 에이전트가 이전 결정, 도구 결과, 제약을 유지한다고 결론 내릴 수 없습니다.
복잡한 작업을 위한 텍스트 생성
Qwen은 고급 추론, 코딩, 데이터 분석, 전문 업무를 주요 사용 사례로 제시합니다. 이는 테스트해야 할 영역이지 프로덕션 측정 결과가 아닙니다. 정확성, 형식 준수, 반복 없는 완료, 재시도와 검토를 포함한 성공 작업 비용을 분리해서 기록해야 합니다.
시각 이해
Token Plan 목록은 시각 이해를 명시합니다. Screenshot, 문서, Chart, 텍스트와 이미지 혼합 입력을 평가할 수 있습니다. 다만 모든 형식, 크기, Media 길이 또는 EvoLink 경로 능력을 보장하지 않습니다.
Token Plan 내장 도구
Web Search, Code Interpreter, Web Extraction, Reverse-image Search, Text-based Image Search가 문서화되어 있습니다. 이는 이미지 생성 기능을 뜻하지 않습니다. 결과가 모델, 검색, Interpreter, Harness 중 어디에서 나왔는지 분리해야 합니다.

발표됐지만 아직 문서화되지 않은 항목
Qwen은 총 2.4조 파라미터, Open Weights 계획, Frontier에 가까운 포지셔닝을 발표했습니다. 중요한 신호지만 완전한 Model Card는 아닙니다.
| 발표 | 알 수 있는 것 | 아직 모르는 것 |
|---|---|---|
| 총 2.4조 파라미터 | 큰 규모 확장 | 활성 파라미터, Expert 구조, 학습, 추론 효율 |
| Open Weights 계획 | Self-host 가능성 | 저장소, 파일, License, 일정, Hardware |
| Frontier 포지셔닝 | 성능 향상 가설 | 전체 표, 방법, 독립 재현, Latency, 비용 |
총 파라미터만으로 수용 가능한 품질, Serving 비용, 출력량, Tool Recovery 또는 안정성을 판단할 수 없습니다.
프로덕션에서 중요한 Preview 제약
ID는 바뀔 수 있다
qwen3.8-max-preview는 Token Plan의 공식 ID입니다. 최종 모델은 다른 안정 Alias를 사용할 수 있으므로 모델 선택은 설정에 둡니다.Credits는 Token 단가가 아니다
Credits는 Subscription 소비 단위이며 임시 배율이 포함될 수 있습니다. 경로별 가격을 기다리고 성공 작업 비용을 측정해야 합니다.
Context 정보는 채널별이다
Qwen의 현재 모델 목록은 Token Plan Preview에 1M 컨텍스트를 문서화합니다. 이는 확인된 채널 한도이지만 모든 위치의 검색 품질이나 향후 EvoLink Route의 동일 제한을 보장하지 않습니다.
개인 Token Plan은 Backend API가 아니다
Route별 동작 확인이 필요하다
Rate Limit, 지역, Structured Output, Streaming, Cache, Batch, Tool, 실패 과금은 채널마다 다를 수 있습니다.
Qwen3.8의 세 가지 캐시 방식
| Cache | 생성 | Hit | 최소 길이 | 사용 방식 |
|---|---|---|---|---|
| 명시적 | 125% | 10% | 1,024 Token | cache_control 수동 지정 |
| 암시적 | 100% | 20% | 256 Token | 공통 Prefix 자동 탐지 |
| Session | 125% | 10% | 1,024 Token | Responses API 멀티턴 |
이는 Qwen 채널 조건이며 EvoLink 가격·Cache 조건은 아닙니다.
지금 Qwen3.8을 준비해야 하는 팀
Repository 규모 코딩과 장시간 Agent를 다루는 팀은 안정된 Baseline, 승인 기준, Preview 변경 시 Fallback을 지금 준비할 수 있습니다. API Test는 프로덕션 적격 Route 공개 후 수행합니다.
안정적인 Version ID, 예측 가능한 가격, 지역·Rate Limit 보장이 필요하거나 Silent Failure를 탐지하고 Rollback할 수 없다면 프로덕션 이용은 기다려야 합니다.
프로덕션 API 공개 전 준비
지금은 Prompt, 승인 기준, Baseline만 고정합니다. 명확한 가격과 이용 권한을 가진 프로덕션 API가 공개될 때까지 대규모 유료 평가는 실행하지 않습니다.
| Workload | 예시 | 지표 |
|---|---|---|
| Repository Coding | Test를 포함한 다중 파일 수정 | 합격률, 불필요한 변경, Retry, Review 시간 |
| Agent | 실패를 주입한 Tool Task | 정확성, 복구, Loop, 개입 |
| 시각 이해 | UI 또는 문서 | Grounding, 누락, Structured Extraction |
| 긴 Context | 대형 Repository·문서 | Recall, 지시 유지, 모순 |
| 데이터 분석 | 표에서 Report 생성 | 수치, 근거, 산출물 품질 |
| 일상 작업 | 작은 편집 | 저렴한 Route 대비 추가 가치 |
accepted_task_cost = model_usage + retries + fallback_usage + reviewer_time + defect_repairEvoLink 사용자가 준비할 것
- Qwen3.8 Early Access 페이지에 등록합니다.
- Kimi K3 등 이용 가능한 Route로 고정 테스트 세트를 만듭니다.
- Prompt, Tool Schema, 합격 기준, 산출물을 Provider와 분리합니다.
- Task 경계에서 모델을 설정 가능하게 합니다.
- Route 활성화 후 같은 작업을 재실행하고 합격률, Latency, 신뢰성, 비용을 비교합니다.
자주 묻는 질문
Qwen3.8은 정식 출시됐나요?
2026년 7월 21일 현재 Token Plan에 공식 등록된 Preview이며 최종 GA는 아닙니다.
Preview ID는 무엇인가요?
qwen3.8-max-preview입니다. 채널별 ID이며 최종 모델이나 EvoLink ID를 보장하지 않습니다.Qwen3.8과 Qwen3-8B는 같은 모델인가요?
아닙니다. Qwen3.8은 2026년 모델 제품군 버전이고 Qwen3-8B는 이전 Qwen3의 80억 파라미터 모델입니다.
Token Plan과 API 액세스의 차이는 무엇인가요?
Token Plan은 대화형 도구용 Credits 구독입니다. 표준 API는 자동화 애플리케이션용이며 Token 단위로 과금됩니다.
어떤 Qwen3.8 Cache를 선택해야 하나요?
암시적 Cache가 가장 간단하고, 명시적 Cache는 관리된 Prefix, Session Cache는 Responses API 대화에 적합합니다. 실제 Route 조건을 확인하세요.
EvoLink에서 사용할 수 있나요?
아직입니다. 지원 Route, 가격, Request ID가 공개되지 않았습니다.
이미지를 지원하나요?
Token Plan 목록은 시각 이해를 명시합니다. 형식, 크기, Route 동작은 Endpoint별로 확인해야 합니다.
Open Source 또는 Open Weight인가요?
Open Weights가 계획됐지만 저장소, 파일, License, 구조, 일정은 미확정입니다.
가격은 얼마인가요?
Token Plan 가격과 Credits는 있지만 표준 Token 가격과 EvoLink 가격은 공개되지 않았습니다.
Qwen3.7 Max보다 좋은가요?
Qwen은 성능 향상을 제시하지만 전체 근거와 실제 Workload Test가 필요합니다. Qwen3.7의 프로덕션 사양이 더 명확합니다.
출시까지 기다려야 하나요?
아닙니다. 지원 모델로 개발하면서 Fallback과 재현 가능한 평가를 준비하고, Route·가격·제한·결과를 확인한 뒤 이동하세요.
출처
- Qwen Token Plan 개요
- Qwen 텍스트 생성 모델 목록
- Qwen Context Cache
- Qwen Token Plan 개인용 개요
- Qwen 내장 도구
- Qwen Chat API
- Qwen Kilo CLI 설정
- Qwen Token Plan
- Qwen3.8 발표


