
Qwen3.8 Max veröffentlicht: Funktionen, 1M Kontext und API-Status
qwen3.8-max am 3. August 2026 als offizielles Flaggschiff veröffentlicht. Bestätigt sind 1M Kontext, Thinking, Function Calling, integrierte Tools und Structured Output. EvoLink stellt die Produktionsroute als qwen3.8-max bereit; die Dokumentations-URL behält den historischen Preview-Slug.Status am 3. August 2026
| Ebene | Status | Konsequenz |
|---|---|---|
| QwenCloud | qwen3.8-max offiziell; 1M, Thinking, Tools, Structured Output | Upstream-Fakten sind bestätigt |
| Preview | qwen3.8-max-preview bleibt der historische Token-Plan-Kanal | Nicht als finale EvoLink-ID übernehmen |
| Open Weights / Lizenz | angekündigt; Artefakte und Lizenz noch nicht verifiziert | Noch keine Self-Hosting-Aussage |
| EvoLink | Produktionsroute qwen3.8-max verfügbar | Vor Produktion Produktseite, Live-Preis und Account-Smoke-Test prüfen |
Die folgenden Preview-Abschnitte bleiben als Migrationshistorie erhalten. Bei Widersprüchen gilt der Status vom 3. August.
Token Plan ist nicht die Standard-Qwen-API
Bestätigte Funktionen von Qwen3.8 Max Preview
Reasoning mit expliziter Steuerung
low, medium und xhigh als Reasoning-Stufen; xhigh ist die dokumentierte Voreinstellung. Zudem gelten besondere Regeln für die Reasoning-Historie in mehrstufigen Gesprächen.Darum muss eine Evaluierung nicht nur eine gute Einzelantwort prüfen, sondern auch, ob ein Agent frühere Entscheidungen, Tool-Ergebnisse und Einschränkungen über viele Turns korrekt beibehält.
Textgenerierung für komplexe Arbeit
Qwen nennt Textgenerierung sowie schwieriges Reasoning, Coding, Datenanalyse und Produktivitätsaufgaben. Das sind sinnvolle Testfelder, aber keine gemessenen Produktionsergebnisse. Teams sollten vier Ergebnisse getrennt erfassen:
- sachliche Korrektheit;
- Einhaltung von Format und Umfang;
- Abschluss ohne Schleifen oder unnötige Ausgabe;
- Kosten des akzeptierten Ergebnisses inklusive Wiederholungen und Review.
Bildverständnis
Die Token-Plan-Liste markiert die Preview für Bildverständnis. Damit sind Screenshots, Dokumente, Diagramme und gemischte Text-Bild-Aufgaben relevante Testfälle. Daraus folgen aber noch keine garantierten Dateiformate, Größenlimits, Medienlängen oder EvoLink-Routenfunktionen.
Integrierte Tools im Token Plan
Qwen dokumentiert Websuche, Code Interpreter, Web-Extraktion, umgekehrte Bildsuche und textbasierte Bildsuche. Gute Resultate können daher vom Modell, Retrieval, Interpreter oder gesamten Harness stammen. Modell-Reasoning und toolgestützte Workflows müssen getrennt gebenchmarkt werden.

Angekündigt, aber noch nicht vollständig dokumentiert
Qwen beschreibt Qwen3.8 als Modell mit 2,4 Billionen Gesamtparametern, plant Open Weights und positioniert es nahe der Modellspitze. Das sind wichtige Signale, aber noch keine vollständige technische Model Card.
| Ankündigung | Aussage für Entwickler | Was noch fehlt |
|---|---|---|
| 2,4 Billionen Parameter | Qwen signalisiert einen großen Skalensprung | Aktive Parameter, Expert-Layout, Training und Inferenz-Effizienz |
| Open-Weight-Plan | Eine selbst gehostete Route könnte folgen | Repository, Dateien, Lizenz, Termin, Hardware und Varianten |
| Frontier-Positionierung | Qwen erwartet einen Leistungssprung | Vollständige Tabellen, Methodik, Replikation, Latenz und Kosten |
Parameterzahl allein bestimmt weder Aufgabenqualität noch Serving-Kosten, Tokenmenge, Tool-Recovery oder Preview-Stabilität.
Produktionsrelevante Preview-Grenzen
Die Modell-ID kann sich ändern
qwen3.8-max-preview ist eine offizielle Token-Plan-ID. Eine finale Version kann einen stabilen Alias oder Snapshot erhalten. Speichern Sie die Modellauswahl in Konfiguration statt in Logik, Analytics, Prompts oder Verträgen.Credits sind keine Tokenpreise
Token-Plan-Credits messen Subscription-Verbrauch und können temporäre Multiplikatoren enthalten. Leiten Sie daraus keine Produktionskosten ab. Warten Sie auf routenspezifische Preise und messen Sie Kosten pro akzeptierter Aufgabe.
Kontextangaben sind kanalspezifisch
Qwens aktuelle Modellliste dokumentiert 1M Kontext für die Token-Plan-Preview. Das bestätigt ein Kanallimit, aber weder zuverlässiges Retrieval an jeder Position noch identische Limits einer künftigen EvoLink-Route.
Persönlicher Token Plan ist keine Backend-Route
Routenverhalten muss geprüft werden
Rate Limits, Regionen, strukturierte Ausgabe, Streaming, Caching, Batching, Tool Calls und Abrechnung fehlgeschlagener Requests können sich je Kanal unterscheiden. Übertragen Sie keine Angaben von Qwen3.7 oder anderen Providern.
Qwen3.8 unterstützt drei Cache-Modi
| Cache | Erstellung | Treffer | Minimum | Nutzung |
|---|---|---|---|---|
| Explizit | 125 % | 10 % | 1.024 Tokens | cache_control manuell |
| Implizit | 100 % | 20 % | 256 Tokens | Präfix automatisch erkennen |
| Sitzung | 125 % | 10 % | 1.024 Tokens | Responses-API-Mehrturnsitzung |
Das sind Qwen-Kanalregeln, noch keine EvoLink-Preise oder Cache-Bedingungen.
Wer sollte sich jetzt auf Qwen3.8 vorbereiten?
Starten Sie jetzt, wenn Ihr Team schwierige Repository-Aufgaben oder lange Agent-Läufe hat, wiederholte Tests gegen eine stabile Baseline durchführen kann, objektive Akzeptanzkriterien besitzt und Preview-Änderungen mit Fallback toleriert.
Warten Sie mit Produktionsverkehr, wenn Sie eine stabile versionierte ID, vorhersehbare Kosten, garantierte Regionen oder Rate Limits benötigen, stille Fehler nicht erkennen können oder keinen Rollback-Pfad besitzen.
Vorbereitung vor einer Produktions-API
Frieren Sie Prompts, Akzeptanzkriterien und Baselines ein. Führen Sie keine große kostenpflichtige API-Evaluierung durch, bevor eine produktionsfähige Route mit klaren Preisen und Nutzungsrechten existiert.
| Workload | Beispiel | Messgröße |
|---|---|---|
| Repository-Coding | Multi-File-Bugfix mit Tests | Akzeptanz, unnötige Änderungen, Wiederholungen, Review-Zeit |
| Agent-Workflow | Tool-Aufgabe mit injiziertem Fehler | Tool-Genauigkeit, Recovery, Schleifen, Eingriffe |
| Bildverständnis | UI-Screenshot oder Dokument | Grounding, übersehene Details, strukturierte Extraktion |
| Long Context | Großes Repository oder Dokumentset | Recall, Anweisungsbindung, Widersprüche |
| Datenanalyse | Tabelle-zu-Bericht | Zahlenkorrektheit, Evidenz, Artefaktqualität |
| Routinearbeit | Kleine Änderung oder Zusammenfassung | Mehrwert gegenüber einer günstigeren Route |
accepted_task_cost = model_usage + retries + fallback_usage + reviewer_time + defect_repairVorbereitung für EvoLink-Nutzer
- Auf der Qwen3.8-Max-Produktseite Route, Modell-ID
qwen3.8-maxund Live-Preis prüfen. - Entscheiden, ob Long-Context-Reasoning, große Repositories oder tool-intensive Agents eine Frontier-Route rechtfertigen.
- Mit einer bestehenden Route wie Kimi K3 ein festes Testset aufbauen und Akzeptanzkriterien sichern.
- Mit dem API-Leitfaden einen minimalen Smoke Test ausführen und dieselben Aufgaben wiederholen.
- Akzeptanz, Latenz, Retries, Korrekturzeit und Kosten pro erfolgreicher Aufgabe vergleichen; Fallback beibehalten.
Preview-Begriffe und technische Fragen bleiben relevant
Ein Produktionsrelease löscht ältere Suchbegriffe nicht. Gespeicherte Konfigurationen, Evaluationen und Suchergebnisse enthalten weiterhin frühere Namen.
Produktion, Preview und ältere Checkpoints trennen
| Begriff | Heutige Bedeutung | Keine zulässige Schlussfolgerung |
|---|---|---|
qwen3.8-max | QwenCloud-Produktions-ID | EvoLink muss dieselbe ID verwenden |
qwen3.8-max-preview | Historische Token-Plan-ID und EvoLink-Draft-Bezeichner | Upstream sei weiterhin nur Preview |
| Qwen3.8 Token Plan | Subscription für unterstützte interaktive Coding-/Agent-Tools | Allgemeiner Backend-Key oder EvoLink-Preisvertrag |
| Qwen3-8B | Älterer 8B-Checkpoint | Andere Schreibweise von Qwen3.8 |
| Open Weights | Angekündigtes künftiges Artefakt | Bereits bestätigte Lizenz, Checkpoints oder Hardwarewerte |
Auch Cache bleibt produktionsrelevant. Prüfen Sie Stabilität des gemeinsamen Präfixes, Gültigkeitsdauer, Kosten von Erstellung und Treffern sowie den zusätzlichen Input durch erhaltene Thinking-Historie. Testen Sie 32K, 128K, 256K und die reale Obergrenze; 1M Kontext garantiert weder Retrieval noch wirtschaftlichen Betrieb.
| Test | Nachweis |
|---|---|
| Impliziter/Expliziter Cache | Usage und Rechnung bei kontrollierten Wiederholungen |
| Session-Wiederverwendung | Zustand, Tool-Historie und Latenz über mehrere Turns |
| Structured Output | Striktes Schema, Fehler- und Repair-Rate |
| Vision | Akzeptierte Formate, Grounding und erfundene Details |
| EvoLink-Route | Endpunkt, Felder, Limits, Fehler und Live-Preis im Zielkonto prüfen |
Produktionsreife ist eine Routeneigenschaft. Upstream-Funktionen reichen nicht ohne bestätigte Medienformate, Rate Limits, Regionen, Billing-Felder, Fehlersemantik, Latenzverteilung und Lifecycle-Policy.
Von der Meldung zum begründeten API-Test
Registrieren Sie sich nicht allein wegen einer Release-Meldung. Prüfen Sie zuerst diese Punkte und erstellen Sie erst dann einen API-Key.
- 01
Veröffentlicht?
Ja. Qwen3.8 Max ist das Produktionsmodell; Preview bleibt historischer Kanalkontext.
- 02
Verfügbar?
Ja, auf EvoLink. Live-Route und Modell-ID stehen auf der Produktseite.
- 03
Für mich geeignet?
Für Long-Context-Reasoning, große Repositories und tool-intensive Agents; einfache Aufgaben gehören auf kleinere Routen.
- 04
Was kostet es?
Maßgeblich ist das Live-Preismodul der Produktseite, nicht ein Upstream- oder Preview-Preis.
- 05
Wie aufrufen?
Wählen Sie Chat Completions, Responses oder Messages und folgen Sie Integrationsleitfaden und Parameterreferenz.
Alle fünf Punkte geklärt? API-Key erstellen.
FAQ
Ist Qwen3.8 offiziell veröffentlicht?
qwen3.8-max am 3. August 2026 in Release-Log und Produktionskatalog aufgenommen. EvoLink führt die Produktionsroute getrennt von der historischen Preview-Dokumentation.Wie lautet die Preview-Modell-ID?
qwen3.8-max; qwen3.8-max-preview ist die historische Token-Plan- und Dokumentations-ID.Ist Qwen3.8 dasselbe wie Qwen3-8B?
Nein. Qwen3.8 ist die Modellfamilien-Version von 2026; Qwen3-8B ist ein älteres Modell mit acht Milliarden Parametern.
Was unterscheidet Token Plan von API-Zugang?
Token Plan ist ein Credits-Abonnement für interaktive Tools. Eine Standard-API ist für automatisierte Anwendungen gedacht und wird pro Token abgerechnet.
Ist Qwen3.8 auf EvoLink verfügbar?
qwen3.8-max. Prüfen Sie Produktseite und Live-Preis und führen Sie vor Produktionsverkehr einen Smoke Test im eigenen Konto aus.Unterstützt Qwen3.8 Bilder?
Qwen beschreibt das Produktionsmodell als natives Vision-Language-Modell. Formate, Größen, Medienlimits und EvoLink-Verhalten müssen pro Route bestätigt werden.
Ist Qwen3.8 Open Source oder Open Weight?
Open Weights sind angekündigt; Repository, Checkpoints, Lizenz und Deployment-Anleitung waren bei der Prüfung am 3. August noch nicht verifiziert.
Wie viel kostet Qwen3.8?
QwenCloud-Upstream- und EvoLink-Routenpreise sind getrennt. Budgetieren Sie mit dem Live-Preis des tatsächlich genutzten Kanals und Kosten pro erfolgreicher Aufgabe, nicht mit Token-Plan-Credits.
Ist Qwen3.8 besser als Qwen3.7 Max?
Qwen positioniert die Preview als Fortschritt; Teams sollten jedoch vollständige Evidenz abwarten und dieselben Workloads testen. Qwen3.7 Max bleibt die besser dokumentierte Produktionsbaseline.
Sollten Entwickler vor dem Versand auf Qwen3.8 warten?
Nein. Nutzen Sie ein unterstütztes Modell, behalten Sie einen Fallback und bereiten Sie reproduzierbare Tests vor. Verschieben Sie Verkehr erst nach Prüfung von Route, Preis, Limits und Ergebnissen.
Quellen
- QwenCloud Modell-Release-Log
- Qwen3.8 Max: technischer Release und Benchmarks
- Qwen Token Plan – Übersicht
- Qwen-Modelle für Textgenerierung
- Qwen Context Cache
- Qwen Token Plan – persönlicher Plan
- Integrierte Tools im Qwen Token Plan
- Qwen OpenAI Chat API
- Qwen Kilo CLI Token-Plan-Konfiguration
- Qwen Token Plan
- Qwen3.8-Ankündigung


