Modell-ID und API-Format
Z.ais offizielle Ankündigung verwendet die Request-Modell-ID glm-5.3, mit dauerhaft aktivem Thinking und einem neuen Parameter reasoning_effort (low/high/max).
GLM-5.3 erschien am 14. August 2026 — die tokenbasierte API wird jedoch gestaffelt freigegeben, ohne veröffentlichte Preise. Die eigentliche Frage ist, wann Sie sie tatsächlich aufrufen können. Tragen Sie sich ein, um benachrichtigt zu werden, sobald EvoLink eine aufrufbare Route verifiziert.
Wir schreiben Ihnen, sobald EvoLink eine aufrufbare GLM-5.3-Route, die Request-Modell-ID, Live-Preise und das unterstützte API-Verhalten verifiziert hat.
Wir schreiben Ihnen nur zur GLM-5.3-Verfügbarkeit. Kein Spam.
Sie möchten schnellere Updates? EvoLink Discord beitreten
Sobald der Zugang öffnet, erhalten Sie von uns eine Launch-Benachrichtigung, und diese Seite wird mit der verifizierten Modell-ID, Live-Preisen, API-Kompatibilität, Regionen und Limits aktualisiert – plus dem Weg zur Integration über EvoLinks einheitliche API bei gleichzeitig erhaltenem Fallback-Modell.
Der Release vom 14. August hat einige Integrationsfelder geklärt und andere offengelassen. EvoLink aktualisiert jedes Feld erst nach offizieller Veröffentlichung und Verifikation auf Routenebene.
Z.ais offizielle Ankündigung verwendet die Request-Modell-ID glm-5.3, mit dauerhaft aktivem Thinking und einem neuen Parameter reasoning_effort (low/high/max).
Token-Preise sind unveröffentlicht – Z.ais eigene Preisseite endet weiterhin bei GLM-5.2. Nach dem Launch ist das Live-Preismodul von EvoLink die maßgebliche Quelle.
Die offizielle Dokumentation nennt für GLM-5.3 ein 1M-Token-Kontextfenster und bis zu 128K Output-Tokens.
Regionen, Nebenläufigkeit, Kontingente, Rate Limits und 429-Verhalten erfordern eine aufrufbare Produktionsroute; noch ist nichts davon veröffentlicht.
Am Release-Tag konnte kein Aggregator GLM-5.3 bedienen, und die BigModel-API-Seite meldet „coming soon". Die Open Weights sind für etwa zwei Wochen nach dem Launch versprochen.
Nur echte Workloads auf einer echten API-Route können die Produktionsfrage beantworten. Diese sechs nutzergetriebenen Metriken verifiziert EvoLink nach Öffnung des Zugangs; Hersteller-Benchmarks sind kein Ersatz.
Messen, ob Bugfixes, Multi-File-Refactorings und Testaufgaben tatsächlich bestehen, statt eine einzelne Antwort zu beurteilen.
Argumentfehler, wiederholte Aufrufe, unproduktive Schleifen und die Häufigkeit menschlicher Übernahme verfolgen.
Testen, ob das Modell Vorgaben behält, Belege findet und Arbeit tief in großen Repositories und Dokumenten abschließt.
GLM-5.3 entfernt die Option, Thinking zu deaktivieren. Latenz und Output-Token-Overhead je reasoning_effort-Stufe gegen Ihre bisherigen Non-Thinking-Pfade messen.
Time-to-First-Token, End-to-End-Geschwindigkeit, Kapazität, Fehlerrate und 429-Antworten zu Spitzenzeiten bewerten.
Tokenverbrauch, Retries, fehlgeschlagene Runs und menschliche Korrektur einrechnen, statt nur Listenpreise zu vergleichen.
GLM-5.3 ist noch nicht pro Token aufrufbar, und seine Preise sind unveröffentlicht – Teams sollten deshalb kein Projekt verzögern, das heute mit GLM-5.2 liefern kann.
Wenn die Lieferung jetzt zählt, etablieren Sie eine echte Baseline auf der dokumentierten und aufrufbaren GLM-5.2-Route.
Wechseln Sie erst, wenn Ihre Workloads auf einer echten Route eine verifizierte Verbesserung zeigen – und beachten Sie den Breaking Change: Thinking lässt sich nicht mehr deaktivieren.
Behalten Sie das aktuelle Modell hinter EvoLinks einheitlicher API und fügen Sie GLM-5.3 nach der Validierung hinzu, ohne eine weitere Anbieterintegration zu bauen.
Der Release ist gestaffelt: was ausgeliefert ist, was aussteht und ob sich der Wechsel lohnt.
Was am 14. August ausgeliefert wurde, was noch aussteht und der Open-Weight-Zeitplan – aktualisiert bei jedem Statuswechsel.
Was sich wirklich geändert hat, der Breaking Change rund um dauerhaft aktives Thinking und wann Sie bei GLM-5.2 bleiben.
Ein separates, weiterhin unangekündigtes Modell – möglicherweise der Release nach GLM-5.3 – verfolgt auf seiner eigenen Seite.
Nicht pro Token. Am Release-Tag war GLM-5.3 nur über das GLM-Coding-Plan-Abo und ZCode nutzbar; Z.ais Preisseite hat keinen glm-5.3-Eintrag, und die BigModel-API-Seite meldet „coming soon".
Z.ais offizielle Ankündigung verwendet glm-5.3 im API-Beispiel. Verifizieren Sie die ID vor dem Produktionseinsatz gegen die offizielle API-Dokumentation.
Unveröffentlicht. Z.ais Preisseite listet weiterhin nur GLM-5.2 ($1,40/$0,26/$4,40 pro Million Tokens – die eigenen Preise von GLM-5.2). Diese Seite nutzt EvoLinks Live-Preismodul erst, nachdem Route und SKUs freigegeben sind.
Noch nicht verifiziert. EvoLink veröffentlicht eine aufrufbare Route, Modell-ID und Preise erst, nachdem echte Request-, Abrechnungs- und Verhaltensprüfungen bestanden sind. Abonnieren Sie den Alert, um benachrichtigt zu werden.
Dasselbe Basismodell – alle Verbesserungen stammen aus dem Post-Training. Der bestätigte Breaking Change: Thinking lässt sich nicht mehr deaktivieren, und reasoning_effort (low/high/max) wird zur Steuerungsoberfläche.
Nein. GLM-5.3 ist ein reines Textmodell; Z.ais multimodale Arbeit bleibt in der separaten GLM-V-Linie.
Z.ai verspricht die Gewichte etwa zwei Wochen nach dem Launch (um den 28. August 2026), nach einer Sicherheitsevaluierung. Die Lizenz wurde noch nicht genannt.
Nein – es sind zwei getrennte Modelle. GLM 5.5 bleibt unangekündigt; falls es kommt, wird es als späterer Release erwartet und auf seiner eigenen Verfügbarkeitsseite verfolgt.
GLM-5.2 – live, bepreist, 1M Kontext, heute über EvoLink aufrufbar. Halten Sie die Modell-ID konfigurierbar, damit der Wechsel auf eine verifizierte GLM-5.3-Route nur eine Konfigurationsänderung ist.
Eine Benachrichtigung, sobald EvoLink die GLM-5.3-Route verifiziert hat: offizieller Release-Status, Modell-ID, Preise, Routenverhalten und Zugangsstatus.