Kimi K3가 출시되었습니다Kimi K3 살펴보기
코딩, 시각 이해 및 에이전트 워크플로를 위한 Qwen3.8 Max Preview 평가 환경의 추상 이미지
model-release

Qwen3.8 Max Preview 기능, Token Plan 및 출시 상태

Jacey
Jacey
Founder
2026년 7월 21일
13분 소요
핵심 요약: Qwen3.8 Max Preview는 Token Plan에서 사용할 수 있습니다. 공식 문서는 qwen3.8-max-preview, 1M 컨텍스트, 추론, 이미지 이해, Function Calling, 내장 도구와 세 가지 캐시 방식을 안내합니다. 표준 가격의 GA Backend API와 EvoLink Route는 아직 없습니다.
개발자는 변화 중인 Preview에 프로덕션 의존성을 만들기보다 통제된 평가를 준비해야 합니다. Qwen3.8 Max 모델 페이지는 EvoLink 제공 상태를 추적하며, 이 글은 확인된 사실과 보류해야 할 결정을 구분합니다.
이름 확인: Qwen3.8과 Qwen3-8B는 다른 모델입니다. 이전 80억 파라미터 모델의 가격, 다운로드, 로컬 배포 정보는 qwen3.8-max-preview에 적용되지 않습니다.

2026년 7월 21일 현재 상태

질문현재 답변안전한 해석
공식 Preview가 있는가Token Plan에 qwen3.8-max-preview가 등록되어 있습니다.
GA인가아니요변경, 제거 또는 최종 모델로 대체될 수 있습니다.
공개 ID가 있는가Qwen 채널용 ID이며 EvoLink ID를 의미하지 않습니다.
개인 Plan Key를 Backend에 쓸 수 있는가아니요자동 스크립트, 커스텀 Backend, 비대화형 Batch가 금지됩니다.
표준 Token 가격이 공개됐는가아니요Credits는 Subscription 단위이지 일반 API 단가가 아닙니다.
Open Weights가 공개됐는가아직저장소, License, 구조, 일정이 확정되지 않았습니다.
EvoLink에서 사용할 수 있는가아직지원 경로에 필요한 사실을 검증 중입니다.

Preview Client에서 사용할 수 있다는 것과 프로덕션 Backend에서 사용할 수 있다는 것은 다릅니다. 안정 ID, 과금, 지역, 제한, Lifecycle이 아직 확정되지 않았을 수 있습니다.

Token Plan은 표준 Qwen API가 아니다

Token Plan은 대화형 코딩·에이전트 도구를 위한 전용 Key, Credits, Quota의 구독입니다. 공식 구매 페이지는 현재 월 6·18·68달러 한정 가격을 안내합니다. 이는 Token 종량 가격이 아니며 Key를 자동화 Backend에 사용할 수 없습니다.

확인된 Qwen3.8 기능

명시적인 추론 강도 제어

Qwen은 Preview를 추론 모델로 분류하고 Chat API에서 low, medium, xhigh를 문서화했으며 기본값은 xhigh입니다. 멀티턴 추론 기록을 보존하는 요구사항도 있습니다.

좋은 단일 응답만으로 장시간 에이전트가 이전 결정, 도구 결과, 제약을 유지한다고 결론 내릴 수 없습니다.

복잡한 작업을 위한 텍스트 생성

Qwen은 고급 추론, 코딩, 데이터 분석, 전문 업무를 주요 사용 사례로 제시합니다. 이는 테스트해야 할 영역이지 프로덕션 측정 결과가 아닙니다. 정확성, 형식 준수, 반복 없는 완료, 재시도와 검토를 포함한 성공 작업 비용을 분리해서 기록해야 합니다.

시각 이해

Token Plan 목록은 시각 이해를 명시합니다. Screenshot, 문서, Chart, 텍스트와 이미지 혼합 입력을 평가할 수 있습니다. 다만 모든 형식, 크기, Media 길이 또는 EvoLink 경로 능력을 보장하지 않습니다.

Token Plan 내장 도구

Web Search, Code Interpreter, Web Extraction, Reverse-image Search, Text-based Image Search가 문서화되어 있습니다. 이는 이미지 생성 기능을 뜻하지 않습니다. 결과가 모델, 검색, Interpreter, Harness 중 어디에서 나왔는지 분리해야 합니다.

모델 추론, 도구, 경로 동작 및 프로덕션 승인 기준을 분리한 Qwen3.8 Max Preview 평가 워크플로
모델 추론, 도구, 경로 동작 및 프로덕션 승인 기준을 분리한 Qwen3.8 Max Preview 평가 워크플로

발표됐지만 아직 문서화되지 않은 항목

Qwen은 총 2.4조 파라미터, Open Weights 계획, Frontier에 가까운 포지셔닝을 발표했습니다. 중요한 신호지만 완전한 Model Card는 아닙니다.

발표알 수 있는 것아직 모르는 것
총 2.4조 파라미터큰 규모 확장활성 파라미터, Expert 구조, 학습, 추론 효율
Open Weights 계획Self-host 가능성저장소, 파일, License, 일정, Hardware
Frontier 포지셔닝성능 향상 가설전체 표, 방법, 독립 재현, Latency, 비용

총 파라미터만으로 수용 가능한 품질, Serving 비용, 출력량, Tool Recovery 또는 안정성을 판단할 수 없습니다.

프로덕션에서 중요한 Preview 제약

ID는 바뀔 수 있다

qwen3.8-max-preview는 Token Plan의 공식 ID입니다. 최종 모델은 다른 안정 Alias를 사용할 수 있으므로 모델 선택은 설정에 둡니다.

Credits는 Token 단가가 아니다

Credits는 Subscription 소비 단위이며 임시 배율이 포함될 수 있습니다. 경로별 가격을 기다리고 성공 작업 비용을 측정해야 합니다.

Context 정보는 채널별이다

Qwen의 현재 모델 목록은 Token Plan Preview에 1M 컨텍스트를 문서화합니다. 이는 확인된 채널 한도이지만 모든 위치의 검색 품질이나 향후 EvoLink Route의 동일 제한을 보장하지 않습니다.

개인 Token Plan은 Backend API가 아니다

대화형 Coding 및 Agent 도구용입니다. 평가 접근승인된 프로덕션 API를 구분해야 합니다.

Route별 동작 확인이 필요하다

Rate Limit, 지역, Structured Output, Streaming, Cache, Batch, Tool, 실패 과금은 채널마다 다를 수 있습니다.

Qwen3.8의 세 가지 캐시 방식

Cache생성Hit최소 길이사용 방식
명시적125%10%1,024 Tokencache_control 수동 지정
암시적100%20%256 Token공통 Prefix 자동 탐지
Session125%10%1,024 TokenResponses API 멀티턴

이는 Qwen 채널 조건이며 EvoLink 가격·Cache 조건은 아닙니다.

지금 Qwen3.8을 준비해야 하는 팀

Repository 규모 코딩과 장시간 Agent를 다루는 팀은 안정된 Baseline, 승인 기준, Preview 변경 시 Fallback을 지금 준비할 수 있습니다. API Test는 프로덕션 적격 Route 공개 후 수행합니다.

안정적인 Version ID, 예측 가능한 가격, 지역·Rate Limit 보장이 필요하거나 Silent Failure를 탐지하고 Rollback할 수 없다면 프로덕션 이용은 기다려야 합니다.

프로덕션 API 공개 전 준비

지금은 Prompt, 승인 기준, Baseline만 고정합니다. 명확한 가격과 이용 권한을 가진 프로덕션 API가 공개될 때까지 대규모 유료 평가는 실행하지 않습니다.

Workload예시지표
Repository CodingTest를 포함한 다중 파일 수정합격률, 불필요한 변경, Retry, Review 시간
Agent실패를 주입한 Tool Task정확성, 복구, Loop, 개입
시각 이해UI 또는 문서Grounding, 누락, Structured Extraction
긴 Context대형 Repository·문서Recall, 지시 유지, 모순
데이터 분석표에서 Report 생성수치, 근거, 산출물 품질
일상 작업작은 편집저렴한 Route 대비 추가 가치
accepted_task_cost = model_usage + retries + fallback_usage + reviewer_time + defect_repair
  1. Qwen3.8 Early Access 페이지에 등록합니다.
  2. Kimi K3 등 이용 가능한 Route로 고정 테스트 세트를 만듭니다.
  3. Prompt, Tool Schema, 합격 기준, 산출물을 Provider와 분리합니다.
  4. Task 경계에서 모델을 설정 가능하게 합니다.
  5. Route 활성화 후 같은 작업을 재실행하고 합격률, Latency, 신뢰성, 비용을 비교합니다.

자주 묻는 질문

Qwen3.8은 정식 출시됐나요?

2026년 7월 21일 현재 Token Plan에 공식 등록된 Preview이며 최종 GA는 아닙니다.

Preview ID는 무엇인가요?

qwen3.8-max-preview입니다. 채널별 ID이며 최종 모델이나 EvoLink ID를 보장하지 않습니다.

Qwen3.8과 Qwen3-8B는 같은 모델인가요?

아닙니다. Qwen3.8은 2026년 모델 제품군 버전이고 Qwen3-8B는 이전 Qwen3의 80억 파라미터 모델입니다.

Token Plan과 API 액세스의 차이는 무엇인가요?

Token Plan은 대화형 도구용 Credits 구독입니다. 표준 API는 자동화 애플리케이션용이며 Token 단위로 과금됩니다.

어떤 Qwen3.8 Cache를 선택해야 하나요?

암시적 Cache가 가장 간단하고, 명시적 Cache는 관리된 Prefix, Session Cache는 Responses API 대화에 적합합니다. 실제 Route 조건을 확인하세요.

EvoLink에서 사용할 수 있나요?

아직입니다. 지원 Route, 가격, Request ID가 공개되지 않았습니다.

이미지를 지원하나요?

Token Plan 목록은 시각 이해를 명시합니다. 형식, 크기, Route 동작은 Endpoint별로 확인해야 합니다.

Open Source 또는 Open Weight인가요?

Open Weights가 계획됐지만 저장소, 파일, License, 구조, 일정은 미확정입니다.

가격은 얼마인가요?

Token Plan 가격과 Credits는 있지만 표준 Token 가격과 EvoLink 가격은 공개되지 않았습니다.

Qwen3.7 Max보다 좋은가요?

Qwen은 성능 향상을 제시하지만 전체 근거와 실제 Workload Test가 필요합니다. Qwen3.7의 프로덕션 사양이 더 명확합니다.

출시까지 기다려야 하나요?

아닙니다. 지원 모델로 개발하면서 Fallback과 재현 가능한 평가를 준비하고, Route·가격·제한·결과를 확인한 뒤 이동하세요.

출처

이 글은 2026년 7월 21일 공개 문서를 기준으로 합니다. Preview 사양, 가격 및 제공 상태는 변경될 수 있습니다.

AI 비용을 89% 절감할 준비가 되셨나요?

오늘 EvoLink를 시작하고 지능형 API 라우팅의 힘을 경험해보세요.