
GLM-5.3 Release: Was ausgeliefert ist und was sich für Entwickler ändert
glm-5.3 hinter demselben einheitlichen API-Key und stellt sowohl Chat-Completions- als auch Anthropic-Messages-Endpoints bereit. Der gestaffelte Stand weiter unten bleibt als Release-Historie nützlich – die aktuelle API-Antwort ist er nicht mehr. Aktuelle Routenpreise und Code stehen auf der GLM-5.3-API-Seite.glm-5.3-flash, ergänzt Bild-, Video- und Datei-Input und liegt im Routenpreis deutlich darunter. Der Vergleich GLM-5.3 Flash vs. GLM-5.3 hilft bei der Entscheidung, ob eine Workload auf der Volumen-Stufe startet oder direkt auf das reine Text-Flaggschiff geht.Was Z.ai tatsächlich angekündigt hat
| Punkt | Bestätigter Wert (14. August 2026) |
|---|---|
| Offizieller Name / API-Modell-ID | GLM-5.3 / glm-5.3 (aus Z.ais eigenem API-Beispiel) |
| Basismodell | Identisch mit GLM-5.2; alle Zugewinne aus dem Post-Training |
| Kontextfenster / max. Ausgabe | 1M Tokens / 128K Tokens |
| Modalitäten | Text rein, Text raus – kein Vision-Support; der vor dem Release vielfach berichtete Community-Wunsch wurde nicht ausgeliefert |
| Thinking | Immer aktiv: thinking.type: "disabled" wird nicht mehr unterstützt |
| Reasoning-Steuerung | Neuer Parameter reasoning_effort: low / high / max (max für Coding empfohlen) |
| Tooling | Function Calling, MCP, Streaming, Context Caching, Structured Outputs (laut offizieller Dokumentation) |
| Parameterzahl | Nicht veröffentlicht (der Schluss aus der gleichen Basis ist keine offizielle Angabe) |
| Positionierung | „Built to Code. Ready for Cyber Defense." |
Wie sich der Zugang seit dem Release-Tag verändert hat
| Kanal | Status am 14. August 2026 | Beleg |
|---|---|---|
| GLM Coding Plan (Abo) | ✅ Live in allen Plan-Stufen; GLM-5.2/5.1-Requests werden automatisch auf GLM-5.3 umgeleitet | Z.ai-Devpack-Dokumentation |
| ZCode (Z.ais Coding-Agent) | ✅ Live, mit einer 1,5×-Kontingent-Aktion bis zum 31. August | Z.ai-Ankündigung |
| Internationale Z.ai-API | ⚠️ Uneindeutig – der Blog zeigt ein Request-Beispiel mit "model": "glm-5.3", aber die offizielle Preisseite führt keinen GLM-5.3-Eintrag und die Modell-Doku-URL liefert 404 | Geprüft am 14. August 2026 |
| BigModel-API (China) | ❌ „GLM-5.3 模型 API 即将上线" – „coming soon", in Z.ais eigenen Worten | BigModel-Dokumentation |
| Open Weights (Hugging Face) | ❌ Versprochen für ~zwei Wochen nach dem Launch, nach Sicherheitsevaluierung und Härtung; Lizenz noch nicht genannt | Z.ai-Ankündigung |
| API-Aggregatoren | ❌ Keine von neun großen Plattformen konnte GLM-5.3 am Release-Tag bedienen; Together AI listet nur einen „Coming soon"-Platzhalter | Plattform-Modell-APIs, geprüft am 14. August 2026 |

Die Benchmark-Angaben – und ihre Vorbehalte
| Benchmark | GLM-5.3 | GLM-5.2 | Anmerkung |
|---|---|---|---|
| Terminal Bench 3.0 | 28.3 | 4.6 | Laut Z.ai Platz 1 unter offenen Modellen; Claude Fable 5 = 33.7 |
| DeepSWE v1.1 | 66.9 | 46.2 | |
| FrontierSWE | 78.1 | 67.5 | |
| SWE-Marathon v1.1 | 42.5 | 19.4 | |
| CyberGym | 84.5 | 77.2 | Z.ais chinesische Doku nennt im Fließtext 83.5 % – zwei offizielle Zahlen kursieren |
| ExploitBench | 54.4 | 24.4 | Z.ai selbst merkt an, dass geschlossene Modelle vorn bleiben (Mythos 5 = 78) |
| Agents' Last Exam (CLI) | 28.5 | 23.8 | Laut Z.ai Platz 1 unter offenen Modellen |
Z.ai berichtet zudem eine „50-Prozent-Verbesserung gegenüber GLM-5.2" auf seinem internen Code Bench – einem privaten Benchmark – und räumt offen ein, dass GLM-5.3 auch bei maximalem Effort „hinter Claude Fable 5 bleibt". Die Community-Reaktion am ersten Tag auf Hacker News zeigte beide Pole: „nur um Haaresbreite" hinter den geschlossenen Frontier-Modellen – und „Ist die Post-Training-Magie nur Overfitting auf Benchmarks?" Beide Zitate lohnt es im Kopf zu behalten, bis Drittevaluierungen vorliegen.
GLM-5.3, GLM 5.5, GLM-6 – was ist was?
Zwei Monate lang kursierten drei Namen rund um Z.ais Roadmap. So steht jeder nach dem heutigen Release da:
- GLM-5.3 – das Label aus Entwicklerdiskussionen seit Juli. Das ist, was heute erschienen ist.
- GLM 5.5 – ein separates Analysten- und Medienlabel (JPMorgan-Prognose via Reuters), oft mit einem gerüchteweise >1T-Parameter-Flaggschiff verknüpft. Weiterhin unangekündigt – falls es kommt, wäre es ein späterer Release, möglicherweise der nächste nach GLM-5.3. Unser GLM-5.5-Release-Watch verfolgt es weiter als eigenständige Entität.
- GLM-6 – eine Spekulationsspur ohne offiziellen Status.
Ein Gerüchtedetail ist noch abzuschließen: Die vielgeteilte GitHub-URL zum angeblichen „glm-5.3-Branch" war nie ein Release-Beleg (die Seite zeigte bei der Prüfung keine Commit-Historie, und das Repository verschwand später aus dem öffentlichen Zugriff). Der Release kam trotzdem – über eine offizielle Ankündigung, also genau das Artefakt, auf das dieser Tracker zu warten empfahl.
Was sich für Entwickler ändert: der API-Vertrag
Zwei Änderungen auf API-Ebene sind in der Ankündigung bestätigt und vor jeder Migration relevant:
- Thinking lässt sich nicht mehr deaktivieren. GLM-5.2 akzeptierte
thinking.type: "disabled"; GLM-5.3 nicht. Pipelines, die für Latenz- oder Kostenkontrolle auf Non-Thinking-Aufrufe setzen, haben einen Breaking Change zu behandeln. reasoning_effortist die neue Steuerfläche –low/high/max, wobei Z.aimaxfür Coding-Aufgaben empfiehlt.
Z.ais offizielles Request-Beispiel:
{
"model": "glm-5.3",
"thinking": { "type": "enabled" },
"reasoning_effort": "max"
}So nutzen Sie GLM-5.3 heute
Es gibt inzwischen zwei unterschiedliche Bezugswege: ein punktebasiertes Coding-Abo und eine Token-API. Vergleichen Sie deren Einheiten nicht direkt miteinander.
| Ihre Situation | Realistische Option heute | Worauf achten |
|---|---|---|
| Sie nutzen Claude Code / OpenCode / einen Coding-Agent | GLM-Coding-Plan-Abo (ab $18/Monat, punktebasiertes Kontingent; GLM-5.3 rechnet mit den höchsten Punkt-Multiplikatoren der Familie ab) | Nebenzeiten kosten 50 % der Punkte |
| Sie rechnen per API pro Token ab | Rufen Sie glm-5.3 über die EvoLink-Modellseite auf; für Routinearbeit mit reasoning_effort: "low" starten | Kosten pro akzeptierter Aufgabe, Cache-Treffer, Wachstum der Output-Tokens |
| Sie hosten selbst | Auf die Gewichte (~28. August) und die Lizenzbedingungen warten | Die Hugging-Face-Organisation zai-org; die Lizenz muss nicht der von GLM-5.2 entsprechen |
| Sie brauchen Vision | GLM-5.3 hat keins; nutzen Sie eine multimodale Route | Ob die GLM-V-Linie mit der GLM-Hauptlinie zusammengeführt wird |
EvoLink stellt GLM-5.3 jetzt über ein einziges Gateway bereit, neben den übrigen produktiven Modelloptionen. Halten Sie die Modell-ID in der Konfiguration, prüfen Sie Streaming- und Tool-Verhalten an Ihren eigenen Payloads und behalten Sie einen getesteten Fallback: Die Verfügbarkeit einer Route ersetzt keine Abnahmetests an Ihrer Workload.
Was wir weiterhin nicht wissen
Auch wenn der Preis inzwischen öffentlich ist, bleiben mehrere produktionsrelevante Fakten offen und müssen an der eigenen Workload geprüft werden:
- Rate Limits und Nebenläufigkeit. Keine RPM/TPM-Zahlen veröffentlicht.
- Open-Weight-Lizenz. GLM-5.2 war MIT-artig; Kimi und Qwen sind zuletzt zu restriktiveren Lizenzen gewechselt, und die Community beobachtet, ob Z.ai folgt. Zwei Wochen Sicherheitsprüfung bedeuten auch: Die Bedingungen können abweichen.
- Parameterzahl. „Gleiche Basis wie GLM-5.2" legt einen Schluss nahe; Z.ai hat keine Zahl veröffentlicht.
- Unabhängige Benchmarks. Alle Release-Tag-Zahlen sind vendor-claimed.
Diese Signale lösen das nächste Update aus
- GLM-5.3-Gewichte erscheinen unter huggingface.co/zai-org, samt expliziter Lizenzbedingungen.
- Veröffentlichte Angaben zu Rate Limits oder Nebenläufigkeit für die Produktionsdimensionierung.
- Unabhängige Evaluierungen mit vergleichbarem Harness, die die Vendor-Benchmark-Tabelle reproduzieren oder widerlegen.
- Wesentliche Änderungen an Preisen oder API-Vertrag bei Z.ai oder EvoLink.
FAQ
Ist GLM-5.3 veröffentlicht?
Ja. Z.ai hat GLM-5.3 am 14. August 2026 offiziell angekündigt. Am Release-Tag war der Zugang zunächst Abo-first; die Token-Preise der API sind inzwischen veröffentlicht.
Wie kann ich GLM-5.3 heute konkret nutzen?
glm-5.3 auf der EvoLink-API-Route – oder über Z.ais Abo-Produkte GLM Coding Plan und ZCode. Ersteres rechnet pro Token ab, letztere folgen der Plan-Ökonomie.Was kostet die GLM-5.3-API?
Wie lautet die GLM-5.3-Modell-ID?
glm-5.3. Verifizieren Sie die ID gegen die offizielle API-Dokumentation, bevor Sie sie in eine Produktionskonfiguration übernehmen.Was bedeutet „gleiche Basis, alle Zugewinne aus dem Post-Training"?
Z.ai hat kein neues Modell vortrainiert. GLM-5.3 ist das Basisnetz von GLM-5.2 mit deutlich skaliertem Post-Training (Fine-Tuning, RL und verwandte Stufen). Deshalb gibt es keine neue Parameterzahl – und deshalb fragen manche Entwickler, ob die Benchmark-Zugewinne generalisieren.
Ist GLM-5.3 genauso groß wie GLM-5.2?
Vermutlich, da die Basis identisch ist – aber Z.ai hat für GLM-5.3 keine Parameterzahl veröffentlicht, also sollte keine Zahl als offiziell gelten.
Hat GLM-5.3 Vision?
Wann erscheinen die Open Weights, und unter welcher Lizenz?
Z.ai verspricht die Gewichte etwa zwei Wochen nach dem Launch (um den 28. August 2026), nach Sicherheitsevaluierung und Härtung. Die Lizenz wurde nicht genannt – gehen Sie nicht davon aus, dass die Bedingungen von GLM-5.2 übernommen werden.
Ist das dasselbe wie GLM 5.5?
Sind die Benchmark-Zahlen vertrauenswürdig?
Es sind Z.ais eigene Ergebnisse – inklusive Vergleichen, in denen GLM-5.3 hinter geschlossenen Modellen liegt, was für die Offenheit des Herstellers spricht. Aber es gibt noch keine unabhängige Replikation, und eine Zahl (CyberGym) erscheint in verschiedenen offiziellen Dokumenten als 84.5 wie auch als 83.5. Behandeln Sie sie als Herstellerangaben, bis Dritt-Tests vorliegen.
Was bricht, wenn ich eine GLM-5.2-Integration auf GLM-5.3 umstelle?
reasoning_effort wird Ihr Steuerhebel. Die vollständige Migrations-Checkliste steht im Leitfaden GLM-5.3 vs GLM-5.2.Sollte ich jetzt von GLM-5.2 wechseln?
glm-5.3, entfernen Sie thinking.type: "disabled", vergleichen Sie die Kosten pro akzeptierter Aufgabe und behalten Sie GLM-5.2 als Rollback-Route, bis Ihre Gates bestehen.Quellen und Änderungsprotokoll
- Z.ai – GLM-5.3-Ankündigung
- BigModel – GLM-5.3-Modelldokumentation
- Z.ai – offizielle GLM-5.3-Preise
- Z.ai – GLM Coding Plan / Devpack-Dokumentation
- Hacker News – Diskussion am Release-Tag
- Unite.AI – Release-Berichterstattung
- Hugging Face – zai-org (noch keine GLM-5.3-Gewichte)
glm-5.3 und zeigt aktuelle Preise, beide unterstützten API-Protokolle, Migrationsprüfungen und Codebeispiele. Alle Aussagen im Präsens zur nicht verfügbaren API wurden zurückgezogen; der Release-Tag-Stand bleibt ausschließlich als datierte Historie stehen.glm-5.3 (laut offiziellem Beispiel), 1M/128K-Limits, reine Textmodalität, dauerhaft aktives Thinking mit reasoning_effort, die Vendor-Benchmark-Tabelle, Coding-Plan-Verfügbarkeit mit Auto-Routing von GLM-5.2/5.1 sowie der ~2-Wochen-Zeitplan für die Open Weights. Zu diesem Zeitpunkt noch offen: Token-Preise, API-Öffnungstermine, Rate Limits, Lizenz, Parameterzahl, unabhängige Evaluierungen.

