GPT Image 2.5 Flare & Sunburst sind jetzt auf EvoLink verfügbarGPT Image 2.5 testen
GLM-5.3-Release-Tracker, der ausgelieferte Kanäle vom gestaffelten API- und Open-Weight-Zugang trennt
model-release

GLM-5.3 Release: Was ausgeliefert ist und was sich für Entwickler ändert

Jessie
Jessie
COO
3. August 2026
Aktualisiert am 27. August 2026
12 Min. Lesezeit
GLM-5.3 ist offiziell veröffentlicht. Z.ai kündigte das Modell am 14. August 2026 im Blogbeitrag "GLM-5.3: Frontier Coding with Emergent Cyber Capabilities" an. Zur Präzisierung der Namen: Dieser Release ist GLM-5.3. Die Labels „GLM 5.5" und „GLM-6", die während der Gerüchtephase kursierten, stehen für mögliche spätere Modelle – GLM 5.5 bleibt unangekündigt und wird separat verfolgt.
Update vom 26. August: Der Release hat seinen Abo-exklusiven Startzustand hinter sich gelassen. Z.ais offizielle Preisseite führt GLM-5.3 inzwischen mit $1,40 Input, $0,26 gecachtem Input und $4,40 Output pro Million Tokens. EvoLinks Route nutzt die Modell-ID glm-5.3 hinter demselben einheitlichen API-Key und stellt sowohl Chat-Completions- als auch Anthropic-Messages-Endpoints bereit. Der gestaffelte Stand weiter unten bleibt als Release-Historie nützlich – die aktuelle API-Antwort ist er nicht mehr. Aktuelle Routenpreise und Code stehen auf der GLM-5.3-API-Seite.
Familien-Update vom 27. August: GLM-5.3 Flash ist ebenfalls live, unter glm-5.3-flash, ergänzt Bild-, Video- und Datei-Input und liegt im Routenpreis deutlich darunter. Der Vergleich GLM-5.3 Flash vs. GLM-5.3 hilft bei der Entscheidung, ob eine Workload auf der Volumen-Stufe startet oder direkt auf das reine Text-Flaggschiff geht.
Am Release-Tag sah das noch anders aus, und diese Etappe bleibt als Historie lehrreich: GLM-5.3 lief zunächst nur im GLM-Coding-Plan-Abo und in Z.ais Coding-Agent ZCode, Preise pro Token waren unveröffentlicht, Z.ais eigene Preisseite endete bei GLM-5.2, und die BigModel-API-Seite (China) meldete für die GLM-5.3-API „coming soon". Die Open Weights sind weiterhin für etwa zwei Wochen nach dem Launch versprochen, sobald Z.ai die Sicherheitsevaluierung abgeschlossen hat. Deshalb verfolgt diese Seite jeden Zugangskanal einzeln – nur steht der aktuelle Stand jetzt vorne.

Was Z.ai tatsächlich angekündigt hat

GLM-5.3 nutzt dieselbe Basis wie GLM-5.2 – Z.ai schreibt ausdrücklich, dass „jeder Zugewinn aus dem Post-Training stammt". Das macht diesen Release ungewöhnlich: kein neuer Pretraining-Lauf, keine Angabe zur Parameterzahl, und eine Reihe sehr großer Benchmark-Sprünge, die vollständig auf skaliertes Post-Training zurückgeführt werden.
PunktBestätigter Wert (14. August 2026)
Offizieller Name / API-Modell-IDGLM-5.3 / glm-5.3 (aus Z.ais eigenem API-Beispiel)
BasismodellIdentisch mit GLM-5.2; alle Zugewinne aus dem Post-Training
Kontextfenster / max. Ausgabe1M Tokens / 128K Tokens
ModalitätenText rein, Text raus – kein Vision-Support; der vor dem Release vielfach berichtete Community-Wunsch wurde nicht ausgeliefert
ThinkingImmer aktiv: thinking.type: "disabled" wird nicht mehr unterstützt
Reasoning-SteuerungNeuer Parameter reasoning_effort: low / high / max (max für Coding empfohlen)
ToolingFunction Calling, MCP, Streaming, Context Caching, Structured Outputs (laut offizieller Dokumentation)
ParameterzahlNicht veröffentlicht (der Schluss aus der gleichen Basis ist keine offizielle Angabe)
Positionierung„Built to Code. Ready for Cyber Defense."

Wie sich der Zugang seit dem Release-Tag verändert hat

GLM-5.3 ist ein lehrreiches Beispiel für einen Launch, bei dem Ankündigung, Abo-Produkt, API und Gewichte nicht am selben Tag erschienen. Die folgende Tabelle hält den Stand pro Kanal am Release-Tag als Historie fest – der heutige Stand ist ein anderer:
KanalStatus am 14. August 2026Beleg
GLM Coding Plan (Abo)✅ Live in allen Plan-Stufen; GLM-5.2/5.1-Requests werden automatisch auf GLM-5.3 umgeleitetZ.ai-Devpack-Dokumentation
ZCode (Z.ais Coding-Agent)✅ Live, mit einer 1,5×-Kontingent-Aktion bis zum 31. AugustZ.ai-Ankündigung
Internationale Z.ai-API⚠️ Uneindeutig – der Blog zeigt ein Request-Beispiel mit "model": "glm-5.3", aber die offizielle Preisseite führt keinen GLM-5.3-Eintrag und die Modell-Doku-URL liefert 404Geprüft am 14. August 2026
BigModel-API (China)❌ „GLM-5.3 模型 API 即将上线" – „coming soon", in Z.ais eigenen WortenBigModel-Dokumentation
Open Weights (Hugging Face)❌ Versprochen für ~zwei Wochen nach dem Launch, nach Sicherheitsevaluierung und Härtung; Lizenz noch nicht genanntZ.ai-Ankündigung
API-Aggregatoren❌ Keine von neun großen Plattformen konnte GLM-5.3 am Release-Tag bedienen; Together AI listet nur einen „Coming soon"-PlatzhalterPlattform-Modell-APIs, geprüft am 14. August 2026
GLM-5.3-Release-Verifikationsstufen von der Ankündigung bis zur produktionsgetesteten Route
GLM-5.3-Release-Verifikationsstufen von der Ankündigung bis zur produktionsgetesteten Route
Die praktische Konsequenz ist heute das Gegenteil der Warnung vom Release-Tag: Der Preis ist inzwischen ein bestätigter Eingangswert für die Adoptionsentscheidung. Die offiziellen Tarife entsprechen denen von GLM-5.2 ($1,40 Input / $0,26 gecacht / $4,40 Output pro Million Tokens) – gleiche Token-Preise garantieren aber keine gleichen Kosten pro Aufgabe, weil GLM-5.3 immer denkt und dieses Reasoning innerhalb der Output-Tokens abrechnet.

Die Benchmark-Angaben – und ihre Vorbehalte

Alle folgenden Zahlen sind Z.ais eigene Ergebnisse (vendor-claimed, also „laut Z.ai"). Am Release-Tag existierte keine unabhängige Replikation.
BenchmarkGLM-5.3GLM-5.2Anmerkung
Terminal Bench 3.028.34.6Laut Z.ai Platz 1 unter offenen Modellen; Claude Fable 5 = 33.7
DeepSWE v1.166.946.2
FrontierSWE78.167.5
SWE-Marathon v1.142.519.4
CyberGym84.577.2Z.ais chinesische Doku nennt im Fließtext 83.5 % – zwei offizielle Zahlen kursieren
ExploitBench54.424.4Z.ai selbst merkt an, dass geschlossene Modelle vorn bleiben (Mythos 5 = 78)
Agents' Last Exam (CLI)28.523.8Laut Z.ai Platz 1 unter offenen Modellen

Z.ai berichtet zudem eine „50-Prozent-Verbesserung gegenüber GLM-5.2" auf seinem internen Code Bench – einem privaten Benchmark – und räumt offen ein, dass GLM-5.3 auch bei maximalem Effort „hinter Claude Fable 5 bleibt". Die Community-Reaktion am ersten Tag auf Hacker News zeigte beide Pole: „nur um Haaresbreite" hinter den geschlossenen Frontier-Modellen – und „Ist die Post-Training-Magie nur Overfitting auf Benchmarks?" Beide Zitate lohnt es im Kopf zu behalten, bis Drittevaluierungen vorliegen.

Die Cybersecurity-Ergebnisse kommen mit einem ungewöhnlichen Begleitartefakt: Z.ai startete gleichzeitig ein öffentliches Security Disclosure Ledger für Schwachstellen, die das Modell findet – mit ein Grund, warum API und Gewichte diesmal hinter einer Sicherheitsprüfung liegen. Das ist ein echter Bruch mit GLM-5.2, dessen Gewichte am Release-Tag offen waren.

GLM-5.3, GLM 5.5, GLM-6 – was ist was?

Zwei Monate lang kursierten drei Namen rund um Z.ais Roadmap. So steht jeder nach dem heutigen Release da:

  • GLM-5.3 – das Label aus Entwicklerdiskussionen seit Juli. Das ist, was heute erschienen ist.
  • GLM 5.5 – ein separates Analysten- und Medienlabel (JPMorgan-Prognose via Reuters), oft mit einem gerüchteweise >1T-Parameter-Flaggschiff verknüpft. Weiterhin unangekündigt – falls es kommt, wäre es ein späterer Release, möglicherweise der nächste nach GLM-5.3. Unser GLM-5.5-Release-Watch verfolgt es weiter als eigenständige Entität.
  • GLM-6 – eine Spekulationsspur ohne offiziellen Status.

Ein Gerüchtedetail ist noch abzuschließen: Die vielgeteilte GitHub-URL zum angeblichen „glm-5.3-Branch" war nie ein Release-Beleg (die Seite zeigte bei der Prüfung keine Commit-Historie, und das Repository verschwand später aus dem öffentlichen Zugriff). Der Release kam trotzdem – über eine offizielle Ankündigung, also genau das Artefakt, auf das dieser Tracker zu warten empfahl.

Was sich für Entwickler ändert: der API-Vertrag

Zwei Änderungen auf API-Ebene sind in der Ankündigung bestätigt und vor jeder Migration relevant:

  1. Thinking lässt sich nicht mehr deaktivieren. GLM-5.2 akzeptierte thinking.type: "disabled"; GLM-5.3 nicht. Pipelines, die für Latenz- oder Kostenkontrolle auf Non-Thinking-Aufrufe setzen, haben einen Breaking Change zu behandeln.
  2. reasoning_effort ist die neue Steuerflächelow / high / max, wobei Z.ai max für Coding-Aufgaben empfiehlt.

Z.ais offizielles Request-Beispiel:

{
  "model": "glm-5.3",
  "thinking": { "type": "enabled" },
  "reasoning_effort": "max"
}
Innerhalb des Coding Plans ist die Migration faktisch schon ohne Zutun der Nutzer passiert: GLM-5.2- und GLM-5.1-Requests werden automatisch auf GLM-5.3 geroutet. Die vollständige Wechselentscheidung – was sich verbessert hat, was das Auto-Routing bedeutet und wann Bleiben auf GLM-5.2 richtig ist – steht im eigenen Vergleich: GLM-5.3 vs GLM-5.2: Was sich wirklich geändert hat – und lohnt der Wechsel?

So nutzen Sie GLM-5.3 heute

Es gibt inzwischen zwei unterschiedliche Bezugswege: ein punktebasiertes Coding-Abo und eine Token-API. Vergleichen Sie deren Einheiten nicht direkt miteinander.

Ihre SituationRealistische Option heuteWorauf achten
Sie nutzen Claude Code / OpenCode / einen Coding-AgentGLM-Coding-Plan-Abo (ab $18/Monat, punktebasiertes Kontingent; GLM-5.3 rechnet mit den höchsten Punkt-Multiplikatoren der Familie ab)Nebenzeiten kosten 50 % der Punkte
Sie rechnen per API pro Token abRufen Sie glm-5.3 über die EvoLink-Modellseite auf; für Routinearbeit mit reasoning_effort: "low" startenKosten pro akzeptierter Aufgabe, Cache-Treffer, Wachstum der Output-Tokens
Sie hosten selbstAuf die Gewichte (~28. August) und die Lizenzbedingungen wartenDie Hugging-Face-Organisation zai-org; die Lizenz muss nicht der von GLM-5.2 entsprechen
Sie brauchen VisionGLM-5.3 hat keins; nutzen Sie eine multimodale RouteOb die GLM-V-Linie mit der GLM-Hauptlinie zusammengeführt wird

EvoLink stellt GLM-5.3 jetzt über ein einziges Gateway bereit, neben den übrigen produktiven Modelloptionen. Halten Sie die Modell-ID in der Konfiguration, prüfen Sie Streaming- und Tool-Verhalten an Ihren eigenen Payloads und behalten Sie einen getesteten Fallback: Die Verfügbarkeit einer Route ersetzt keine Abnahmetests an Ihrer Workload.

Was wir weiterhin nicht wissen

Auch wenn der Preis inzwischen öffentlich ist, bleiben mehrere produktionsrelevante Fakten offen und müssen an der eigenen Workload geprüft werden:

  • Rate Limits und Nebenläufigkeit. Keine RPM/TPM-Zahlen veröffentlicht.
  • Open-Weight-Lizenz. GLM-5.2 war MIT-artig; Kimi und Qwen sind zuletzt zu restriktiveren Lizenzen gewechselt, und die Community beobachtet, ob Z.ai folgt. Zwei Wochen Sicherheitsprüfung bedeuten auch: Die Bedingungen können abweichen.
  • Parameterzahl. „Gleiche Basis wie GLM-5.2" legt einen Schluss nahe; Z.ai hat keine Zahl veröffentlicht.
  • Unabhängige Benchmarks. Alle Release-Tag-Zahlen sind vendor-claimed.

Diese Signale lösen das nächste Update aus

  1. GLM-5.3-Gewichte erscheinen unter huggingface.co/zai-org, samt expliziter Lizenzbedingungen.
  2. Veröffentlichte Angaben zu Rate Limits oder Nebenläufigkeit für die Produktionsdimensionierung.
  3. Unabhängige Evaluierungen mit vergleichbarem Harness, die die Vendor-Benchmark-Tabelle reproduzieren oder widerlegen.
  4. Wesentliche Änderungen an Preisen oder API-Vertrag bei Z.ai oder EvoLink.

FAQ

Ist GLM-5.3 veröffentlicht?

Ja. Z.ai hat GLM-5.3 am 14. August 2026 offiziell angekündigt. Am Release-Tag war der Zugang zunächst Abo-first; die Token-Preise der API sind inzwischen veröffentlicht.

Wie kann ich GLM-5.3 heute konkret nutzen?

Über die Modell-ID glm-5.3 auf der EvoLink-API-Route – oder über Z.ais Abo-Produkte GLM Coding Plan und ZCode. Ersteres rechnet pro Token ab, letztere folgen der Plan-Ökonomie.

Was kostet die GLM-5.3-API?

Z.ais offizielle Tarife lauten $1,40 Input, $0,26 gecachter Input und $4,40 Output pro Million Tokens. Der aktuelle EvoLink-Routenpreis samt Rechner steht auf der GLM-5.3-API-Seite.

Wie lautet die GLM-5.3-Modell-ID?

Z.ais eigenes API-Beispiel verwendet glm-5.3. Verifizieren Sie die ID gegen die offizielle API-Dokumentation, bevor Sie sie in eine Produktionskonfiguration übernehmen.

Was bedeutet „gleiche Basis, alle Zugewinne aus dem Post-Training"?

Z.ai hat kein neues Modell vortrainiert. GLM-5.3 ist das Basisnetz von GLM-5.2 mit deutlich skaliertem Post-Training (Fine-Tuning, RL und verwandte Stufen). Deshalb gibt es keine neue Parameterzahl – und deshalb fragen manche Entwickler, ob die Benchmark-Zugewinne generalisieren.

Ist GLM-5.3 genauso groß wie GLM-5.2?

Vermutlich, da die Basis identisch ist – aber Z.ai hat für GLM-5.3 keine Parameterzahl veröffentlicht, also sollte keine Zahl als offiziell gelten.

Hat GLM-5.3 Vision?

Nein. Es ist ein reines Textmodell. Vision war vor dem Launch ein vielfach berichteter Community-Wunsch (TechTimes und explainx berichteten beide über den Entwickler-Umfrage-Thread) – ausgeliefert wurde es nicht; Z.ais multimodale Arbeit bleibt in der separaten GLM-V-Linie.

Wann erscheinen die Open Weights, und unter welcher Lizenz?

Z.ai verspricht die Gewichte etwa zwei Wochen nach dem Launch (um den 28. August 2026), nach Sicherheitsevaluierung und Härtung. Die Lizenz wurde nicht genannt – gehen Sie nicht davon aus, dass die Bedingungen von GLM-5.2 übernommen werden.

Ist das dasselbe wie GLM 5.5?

Nein – es sind zwei getrennte Entitäten. GLM 5.5 bleibt unangekündigt: Analysten nutzten das Label in der Gerüchtephase für ein mögliches größeres Flaggschiff, das weiterhin als späterer Release kommen kann. Der heutige Release ist GLM-5.3, und der separate GLM-5.5-Watch läuft weiter.

Sind die Benchmark-Zahlen vertrauenswürdig?

Es sind Z.ais eigene Ergebnisse – inklusive Vergleichen, in denen GLM-5.3 hinter geschlossenen Modellen liegt, was für die Offenheit des Herstellers spricht. Aber es gibt noch keine unabhängige Replikation, und eine Zahl (CyberGym) erscheint in verschiedenen offiziellen Dokumenten als 84.5 wie auch als 83.5. Behandeln Sie sie als Herstellerangaben, bis Dritt-Tests vorliegen.

Was bricht, wenn ich eine GLM-5.2-Integration auf GLM-5.3 umstelle?

Der bestätigte Breaking Change: Thinking lässt sich nicht mehr deaktivieren. Latenz- oder kostensensible Non-Thinking-Pfade müssen neu entworfen werden, und reasoning_effort wird Ihr Steuerhebel. Die vollständige Migrations-Checkliste steht im Leitfaden GLM-5.3 vs GLM-5.2.

Sollte ich jetzt von GLM-5.2 wechseln?

Wenn Sie im Coding Plan sind, ist es bereits passiert – Requests werden automatisch auf GLM-5.3 geroutet. Für Token-Traffic gilt: Fahren Sie eine kontrollierte Challenger-Spur auf glm-5.3, entfernen Sie thinking.type: "disabled", vergleichen Sie die Kosten pro akzeptierter Aufgabe und behalten Sie GLM-5.2 als Rollback-Route, bis Ihre Gates bestehen.

Quellen und Änderungsprotokoll

26. August 2026 – Überarbeitung zur API-Aktivierung. Z.ais Preisseite führt GLM-5.3 jetzt mit $1,40 / $0,26 gecacht / $4,40 pro Million Tokens. EvoLinks Produktroute nutzt glm-5.3 und zeigt aktuelle Preise, beide unterstützten API-Protokolle, Migrationsprüfungen und Codebeispiele. Alle Aussagen im Präsens zur nicht verfügbaren API wurden zurückgezogen; der Release-Tag-Stand bleibt ausschließlich als datierte Historie stehen.
14. August 2026 – Release-Tag-Überarbeitung. GLM-5.3 wurde an diesem Tag offiziell angekündigt; diese Seite ist von Gerücht-Tracking auf Release-Tracking umgestellt. Bestätigt: Name, Modell-ID glm-5.3 (laut offiziellem Beispiel), 1M/128K-Limits, reine Textmodalität, dauerhaft aktives Thinking mit reasoning_effort, die Vendor-Benchmark-Tabelle, Coding-Plan-Verfügbarkeit mit Auto-Routing von GLM-5.2/5.1 sowie der ~2-Wochen-Zeitplan für die Open Weights. Zu diesem Zeitpunkt noch offen: Token-Preise, API-Öffnungstermine, Rate Limits, Lizenz, Parameterzahl, unabhängige Evaluierungen.
3. August 2026 – Erstveröffentlichung. Dokumentiert wurde die Beweislage der Gerüchtephase: die GitHub-Commits-URL ohne Commit-Historie (archivierter Snapshot; das Repository verschwand später aus dem öffentlichen Zugriff – korrekt als Signal behandelt, nicht als Release-Beleg), die ungeklärte Namensfrage GLM-5.3 / GLM 5.5 / GLM-6 und die Empfehlung, auf einer verifizierten GLM-5.2-Route auszuliefern und den Nachfolger als Evaluationskandidaten zu führen. Diese Empfehlung hat sich am Release-Tag bestätigt: Damals war die Token-API der Teil, der noch nicht ausgeliefert war.
Beweislage zuletzt geprüft am 26. August 2026. Diese Seite wird aktualisiert, sobald sich Preise, API-Verhalten, Gewichte, Lizenz oder unabhängige Evaluierungen ändern.

Bereit, Ihre KI-Kosten um 89 % zu senken?

Starten Sie noch heute mit EvoLink und erleben Sie die Vorteile intelligenter API-Routing.