
Qwen3.8 Max 정식 출시: 기능, 1M 컨텍스트 및 API 상태
qwen3.8-max를 공식 플래그십으로 출시했습니다. 1M 컨텍스트, Thinking, Function Calling, 내장 도구, Structured Output이 확인됩니다. EvoLink는 프로덕션 Route qwen3.8-max를 제공하며 문서 URL은 과거 Preview slug를 유지합니다.2026년 8월 3일 상태
| 계층 | 상태 | 의미 |
|---|---|---|
| QwenCloud | qwen3.8-max 정식 | upstream 사실 확인 |
| Preview | qwen3.8-max-preview는 과거 평가 채널 | EvoLink 최종 ID로 가정 금지 |
| Open Weights/License | 예고됨, 아티팩트 미확인 | self-host 가능 단정 금지 |
| EvoLink | 프로덕션 Route qwen3.8-max 사용 가능 | 제품 페이지, Live 가격, Account Smoke Test를 프로덕션 전에 확인 |
이후 Preview 섹션은 마이그레이션 이력이며 충돌 시 8월 3일 상태가 우선합니다.
Token Plan은 표준 Qwen API가 아니다
확인된 Qwen3.8 기능
명시적인 추론 강도 제어
low, medium, xhigh를 문서화했으며 기본값은 xhigh입니다. 멀티턴 추론 기록을 보존하는 요구사항도 있습니다.좋은 단일 응답만으로 장시간 에이전트가 이전 결정, 도구 결과, 제약을 유지한다고 결론 내릴 수 없습니다.
복잡한 작업을 위한 텍스트 생성
Qwen은 고급 추론, 코딩, 데이터 분석, 전문 업무를 주요 사용 사례로 제시합니다. 이는 테스트해야 할 영역이지 프로덕션 측정 결과가 아닙니다. 정확성, 형식 준수, 반복 없는 완료, 재시도와 검토를 포함한 성공 작업 비용을 분리해서 기록해야 합니다.
시각 이해
Token Plan 목록은 시각 이해를 명시합니다. Screenshot, 문서, Chart, 텍스트와 이미지 혼합 입력을 평가할 수 있습니다. 다만 모든 형식, 크기, Media 길이 또는 EvoLink 경로 능력을 보장하지 않습니다.
Token Plan 내장 도구
Web Search, Code Interpreter, Web Extraction, Reverse-image Search, Text-based Image Search가 문서화되어 있습니다. 이는 이미지 생성 기능을 뜻하지 않습니다. 결과가 모델, 검색, Interpreter, Harness 중 어디에서 나왔는지 분리해야 합니다.

발표됐지만 아직 문서화되지 않은 항목
Qwen은 총 2.4조 파라미터, Open Weights 계획, Frontier에 가까운 포지셔닝을 발표했습니다. 중요한 신호지만 완전한 Model Card는 아닙니다.
| 발표 | 알 수 있는 것 | 아직 모르는 것 |
|---|---|---|
| 총 2.4조 파라미터 | 큰 규모 확장 | 활성 파라미터, Expert 구조, 학습, 추론 효율 |
| Open Weights 계획 | Self-host 가능성 | 저장소, 파일, License, 일정, Hardware |
| Frontier 포지셔닝 | 성능 향상 가설 | 전체 표, 방법, 독립 재현, Latency, 비용 |
총 파라미터만으로 수용 가능한 품질, Serving 비용, 출력량, Tool Recovery 또는 안정성을 판단할 수 없습니다.
프로덕션에서 중요한 Preview 제약
ID는 바뀔 수 있다
qwen3.8-max-preview는 Token Plan 시기의 ID이며 upstream 프로덕션 ID는 qwen3.8-max입니다. EvoLink 최종 ID는 설정 가능하게 유지하세요.Credits는 Token 단가가 아니다
Credits는 Subscription 소비 단위이며 임시 배율이 포함될 수 있습니다. 경로별 가격을 기다리고 성공 작업 비용을 측정해야 합니다.
Context 정보는 채널별이다
qwen3.8-max에 1M 컨텍스트를 문서화합니다. 모든 위치의 검색 품질이나 향후 EvoLink Route의 동일 제한을 보장하지는 않습니다.개인 Token Plan은 Backend API가 아니다
Route별 동작 확인이 필요하다
Rate Limit, 지역, Structured Output, Streaming, Cache, Batch, Tool, 실패 과금은 채널마다 다를 수 있습니다.
Qwen3.8의 세 가지 캐시 방식
| Cache | 생성 | Hit | 최소 길이 | 사용 방식 |
|---|---|---|---|---|
| 명시적 | 125% | 10% | 1,024 Token | cache_control 수동 지정 |
| 암시적 | 100% | 20% | 256 Token | 공통 Prefix 자동 탐지 |
| Session | 125% | 10% | 1,024 Token | Responses API 멀티턴 |
이는 Qwen 채널 조건이며 EvoLink 가격·Cache 조건은 아닙니다.
지금 Qwen3.8을 준비해야 하는 팀
Repository 규모 코딩과 장시간 Agent를 다루는 팀은 안정된 Baseline, 승인 기준, Preview 변경 시 Fallback을 지금 준비할 수 있습니다. API Test는 프로덕션 적격 Route 공개 후 수행합니다.
안정적인 Version ID, 예측 가능한 가격, 지역·Rate Limit 보장이 필요하거나 Silent Failure를 탐지하고 Rollback할 수 없다면 프로덕션 이용은 기다려야 합니다.
프로덕션 API 공개 전 준비
지금은 Prompt, 승인 기준, Baseline만 고정합니다. 명확한 가격과 이용 권한을 가진 프로덕션 API가 공개될 때까지 대규모 유료 평가는 실행하지 않습니다.
| Workload | 예시 | 지표 |
|---|---|---|
| Repository Coding | Test를 포함한 다중 파일 수정 | 합격률, 불필요한 변경, Retry, Review 시간 |
| Agent | 실패를 주입한 Tool Task | 정확성, 복구, Loop, 개입 |
| 시각 이해 | UI 또는 문서 | Grounding, 누락, Structured Extraction |
| 긴 Context | 대형 Repository·문서 | Recall, 지시 유지, 모순 |
| 데이터 분석 | 표에서 Report 생성 | 수치, 근거, 산출물 품질 |
| 일상 작업 | 작은 편집 | 저렴한 Route 대비 추가 가치 |
accepted_task_cost = model_usage + retries + fallback_usage + reviewer_time + defect_repairEvoLink 사용자가 준비할 것
- Qwen3.8 Max 제품 페이지에서 현재 Route,
qwen3.8-maxModel ID, Live 가격을 확인합니다. - 긴 컨텍스트 추론, 대규모 Repository, Tool 중심 Agent에 Frontier Route가 필요한지 판단합니다.
- Kimi K3 등 기존 Route로 고정 테스트 세트와 합격 기준을 만듭니다.
- API 연동 가이드로 최소 Smoke Test를 실행하고 같은 Task를 Replay합니다.
- 합격률, Latency, Retry, Human Correction, Accepted Task Cost를 비교하고 Fallback을 유지합니다.
정식 출시 후에도 Preview 용어와 기술 질문은 남는다
과거 설정, 평가 및 검색 결과에는 이전 명칭이 계속 남습니다.
프로덕션, Preview, 이전 Checkpoint를 구분한다
| 용어 | 현재 의미 | 추론하면 안 되는 내용 |
|---|---|---|
qwen3.8-max | QwenCloud 프로덕션 ID | EvoLink도 같은 ID 사용 |
qwen3.8-max-preview | Token Plan 시기와 EvoLink Draft 식별자 | upstream이 아직 Preview뿐임 |
| Qwen3.8 Token Plan | 지원되는 대화형 Coding/Agent 도구 구독 | 일반 Backend Key 또는 EvoLink 요금 계약 |
| Qwen3-8B | 이전 8B Checkpoint | Qwen3.8의 다른 표기 |
| Open Weights | 예고된 향후 Artifact | License, Checkpoint, Hardware가 확인됨 |
Cache도 프로덕션 비용에 영향을 줍니다. 공통 Prefix 안정성, 유효 시간, 생성과 Hit 비용, Thinking 기록이 다음 Turn Input을 늘리는지 확인하세요. 32K, 128K, 256K와 실제 상한을 시험하고 1M만으로 Retrieval이나 경제성을 판단하지 마세요.
| 테스트 | 필요한 증거 |
|---|---|
| 암시적/명시적 Cache | 통제된 반복의 Usage와 청구 비교 |
| Session 재사용 | Multi-turn State, Tools, Latency |
| Structured Output | Strict Schema, Error, Repair 비율 |
| Vision | 형식, Grounding, 조작된 세부 정보 |
| EvoLink Route | 대상 Account에서 Endpoint, Field, Limit, Error, Live Price 확인 |
프로덕션 적격성은 Route 속성입니다. upstream 기능만으로 Media 형식, Rate Limit, Region, Billing, Error Semantics, Latency 분포와 Lifecycle을 증명할 수 없습니다.
출시 소식에서 근거 있는 API 테스트로
출시 소식만 보고 바로 가입하지 마세요. 다섯 항목을 먼저 확인하고 워크로드에 맞을 때만 API 키를 만드세요.
- 01
출시됐나요?
예. Qwen3.8 Max가 정식 모델이며 Preview는 과거 채널 정보입니다.
- 02
사용할 수 있나요?
EvoLink에서 사용할 수 있습니다. 제품 페이지에서 활성 라우트와 모델 ID를 확인하세요.
- 03
내 작업에 맞나요?
긴 컨텍스트 추론, 대규모 저장소, 도구 중심 Agent에 적합하며 단순 작업은 더 작은 라우트에 유지합니다.
- 04
가격은 얼마인가요?
제품 페이지의 실시간 가격을 확인하고 upstream 또는 Preview 요금을 재사용하지 마세요.
- 05
어떻게 호출하나요?
Chat Completions, Responses, Messages 중 하나를 선택하고 연동 가이드와 파라미터 문서를 확인하세요.
다섯 항목을 모두 확인했나요? API 키 만들기.
자주 묻는 질문
Qwen3.8은 정식 출시됐나요?
qwen3.8-max를 릴리스 로그와 프로덕션 카탈로그에 추가했습니다. EvoLink는 프로덕션 Route를 과거 Preview 문서와 분리해 관리합니다.Preview ID는 무엇인가요?
qwen3.8-max를 사용합니다. qwen3.8-max-preview는 과거 Token Plan 및 문서 ID입니다.Qwen3.8과 Qwen3-8B는 같은 모델인가요?
아닙니다. Qwen3.8은 2026년 모델 제품군 버전이고 Qwen3-8B는 이전 Qwen3의 80억 파라미터 모델입니다.
Token Plan과 API 액세스의 차이는 무엇인가요?
Token Plan은 대화형 도구용 Credits 구독입니다. 표준 API는 자동화 애플리케이션용이며 Token 단위로 과금됩니다.
EvoLink에서 사용할 수 있나요?
qwen3.8-max를 사용합니다. 제품 페이지와 Live 가격을 확인하고 프로덕션 Traffic 전에 계정에서 Smoke Test를 실행하세요.이미지를 지원하나요?
Qwen은 프로덕션 모델을 네이티브 비전-언어 모델로 설명합니다. 이미지 형식, 크기, 미디어 제한과 EvoLink 동작은 Route별 확인이 필요합니다.
Open Source 또는 Open Weight인가요?
Open Weights는 예고됐지만 8월 3일 기준 저장소, Checkpoint, License, 배포 가이드는 확인되지 않았습니다.
가격은 얼마인가요?
QwenCloud upstream 가격과 EvoLink Route 가격을 구분하세요. Token Plan Credits가 아니라 실제 Route의 live 가격과 성공 작업 비용으로 예산을 계산해야 합니다.
Qwen3.7 Max보다 좋은가요?
Qwen은 성능 향상을 제시하지만 전체 근거와 실제 Workload Test가 필요합니다. Qwen3.7의 프로덕션 사양이 더 명확합니다.
출시까지 기다려야 하나요?
아닙니다. 지원 모델로 개발하면서 Fallback과 재현 가능한 평가를 준비하고, Route·가격·제한·결과를 확인한 뒤 이동하세요.
출처
- QwenCloud 모델 릴리스 로그
- Qwen3.8 Max 기술 릴리스 및 Benchmark
- Qwen Token Plan 개요
- Qwen 텍스트 생성 모델 목록
- Qwen Context Cache
- Qwen Token Plan 개인용 개요
- Qwen 내장 도구
- Qwen Chat API
- Qwen Kilo CLI 설정
- Qwen Token Plan
- Qwen3.8 발표


