Preise+7% Bonus

Was ist GLM-5.3? Der stille Start von Z.ais Coding Plan, Preise und bestätigte Verbesserungen

GLM-5.3 ist im Coding Plan von Z.ai verfügbar. Erfahre mehr über Veröffentlichungsstatus, 1-Mio.-Kontext, Reasoning-Modi, Preise, Verbesserungen und offene Fragen.

Was ist GLM-5.3? Der stille Start von Z.ais Coding Plan, Preise und bestätigte Verbesserungen

Suchergebnisse beschreiben GLM-5.3 weiterhin als unveröffentlichtes Gerücht. Die eigene Dokumentation von Z.ai sagt inzwischen etwas anderes – allerdings nur teilweise.

Am 14. August 2026 ist GLM-5.3 im Z.ai GLM Coding Plan verfügbar. Die offizielle Einrichtungsanleitung nennt glm-5.3 als aktuelles Modell, unterstützt optional einen Kontext von 1 Million Tokens und dokumentiert die Reasoning-Stufen „low“, „high“ und „max“. Z.ai hat jedoch weder eine datierte Startankündigung noch eine vollständige Model Card, offene Gewichte, standardmäßige API-Preise pro Token oder Benchmark-Ergebnisse für diese Version veröffentlicht.

Dieser Unterschied ist wichtig. GLM-5.3 ist kein bloßer Community-Spitzname mehr, aber auch noch kein vollständig dokumentierter öffentlicher Release.

Ich habe den Coding-Plan-Leitfaden, den allgemeinen Modellkatalog, die Preisseite, die Release Notes und öffentliche Modell-Repositories separat geprüft. Sie sind noch nicht vollständig synchronisiert – deshalb ist eine einfache Antwort wie „veröffentlicht oder unveröffentlicht“ irreführend.

Inhaltsverzeichnis

Was ist GLM-5.3?

GLM-5.3 ist das neueste coding-orientierte Modell, das über Z.ais abonnementbasierten GLM Coding Plan verfügbar ist. Z.ai, früher bekannt als Zhipu AI, entwickelt die chinesische GLM-Familie aus Sprach-, Vision-, Bild-, Video- und Agentenmodellen.

Die aktuelle offizielle Dokumentation positioniert GLM-5.3 für Coding-Agenten und nicht für gewöhnliche Browser-Chats. Entwickler können es in Tools auswählen, die benutzerdefinierte Modelle unterstützen, darunter Claude Code, Goose, Codex und Cline. Z.ai erklärt außerdem, dass Coding-Plan-Anfragen an die früheren Routen glm-5.2 und glm-5.1 nun automatisch an GLM-5.3 weitergeleitet werden.

Folgendes lässt sich heute bestätigen:

Punkt Bestätigter Status von GLM-5.3
Entwickler Z.ai, früher Zhipu AI
Aktuelle Verfügbarkeit Im Z.ai GLM Coding Plan verfügbar
Modell-ID glm-5.3
ID für erweiterten Kontext glm-5.3[1m]
Kontextoption Bis zu 1 Million Tokens über die Konfiguration [1m]
Reasoning-Aufwand Low, high und max; max ist die Standardeinstellung
Direkte Bildeingabe In der aktuellen Cline-Konfiguration deaktiviert
Standard-API-Preis Nicht veröffentlicht
Offene Gewichte und Lizenz Nicht veröffentlicht
Offizielle oder unabhängige Benchmarks Nicht veröffentlicht
GPT Proto-Verfügbarkeit Derzeit nicht verfügbar

Diese Tabelle ist bewusst kürzer als die spekulativen GLM-5.3-Datenblätter, die online kursieren. Architektur, Parameteranzahl, Benchmark-Ergebnisse und eine Lizenz für offene Gewichte sind weiterhin unbekannt. Diese Angaben aus GLM-5.2 zu übernehmen, würde die Tabelle zwar eindrucksvoller machen, aber auch falsch.

Ist GLM-5.3 veröffentlicht? Erscheinungsdatum und Preview-Status

GLM-5.3 wurde innerhalb eines Produkts veröffentlicht: des GLM Coding Plan. Z.ais Leitfaden zum Modellwechsel zeigt nun „GLM-5.3 jetzt verfügbar“ und erklärt, dass Lite-, Pro- und Max-Abonnenten darauf wechseln können.

Ein genaues Veröffentlichungsdatum für GLM-5.3 gibt es weiterhin nicht. Z.ais allgemeine Release Notes enthalten noch keinen datierten GLM-5.3-Eintrag, während die Standard-Modellübersicht und die Seiten mit Tokenpreisen weiterhin GLM-5.2 hervorheben. Die sicherste Beschreibung lautet daher: ein stiller Start im Coding Plan und kein vollständiger öffentlicher Rollout.

Damit ändert sich auch das Verständnis des Begriffs „GLM-5.3 Preview“. Vor der Aktualisierung der Dokumentation war GLM-5.3 im Wesentlichen ein Suchbegriff zur Release-Beobachtung, gestützt durch Diskussionen in der Community. Jetzt ist es ein aufrufbares Coding-Plan-Modell mit offizieller ID. Unvollständig ist weiterhin die Dokumentation rund um das Modell – nicht seine Existenz innerhalb des Plans.

Für Produktionsteams ist diese Lücke wichtig. Eine Route kann aufrufbar sein, bevor Architektur, Abrechnung außerhalb eines Abonnements, Kapazitätsgrenzen, unabhängige Qualität und Bedingungen für Self-Hosting bekannt sind. Die Verfügbarkeit beantwortet die Frage „Kann ich es testen?“, aber noch nicht „Sollte ich damit ein Produktionsmodell ersetzen?“

Welche GLM-5.3-Funktionen sind bestätigt?

Optionaler Kontext mit 1 Million Tokens

Z.ai dokumentiert glm-5.3[1m] für Entwickler, die einen Kontext von 1 Million Tokens benötigen. In Claude Code muss bei der Einrichtung außerdem CLAUDE_CODE_AUTO_COMPACT_WINDOW auf 1000000 gesetzt werden.

Der Suffix ist relevant. Entwickler sollten nicht annehmen, dass jede Anfrage mit der einfachen Zeichenfolge glm-5.3 automatisch dieselbe Kontextkonfiguration erhält. Das lange Kontextfenster ist für große Repositories, lange Agentenverläufe, Migrationspläne und Debugging-Aufgaben über mehrere Dateien hinweg relevant. Der Preis dafür ist ein höherer Kontextverbrauch und möglicherweise längere Reasoning-Zyklen.

Eine Million Tokens garantiert außerdem nicht, dass sich ein Modell an jede Abhängigkeit gleich gut erinnert. Die Kontextkapazität misst, wie viel übermittelt werden kann. Abrufgenauigkeit, Beibehaltung von Einschränkungen und Stabilität von Tool-Schleifen müssen weiterhin auf Aufgabenebene getestet werden.

Niedriger, hoher und maximaler Reasoning-Aufwand

Der GLM Coding Plan ordnet verschiedene Tool-Einstellungen drei tatsächlichen Aufwandsstufen zu:

Angeforderte Einstellung Verwendeter GLM-5.3-Aufwand
minimal, light oder low Low
medium oder high High
xhigh, max oder ultra Max
Fehlende oder unbekannte Einstellung Standardmäßig Max

Für kleine Änderungen und einfache Fragen ist ein niedriger Aufwand der sinnvollste Ausgangspunkt. High bildet die mittlere Stufe. Max ist für komplexe Programmier- und Agentenaufgaben gedacht, bei denen tieferes Reasoning wichtiger ist als Antwortkosten oder Latenz.

Derzeit misst kein offizieller GLM-5.3-Benchmark den Unterschied zwischen diesen Einstellungen. Betrachte den Aufwand als Testvariable und nicht als Qualitätsgarantie. Die aussagekräftigere Produktionskennzahl sind die Kosten pro akzeptierter Aufgabe nach Wiederholungen – nicht die Frage, ob jede Anfrage mit Max ausgeführt wurde.

Kompatibilität mit Coding-Agenten

Der offizielle Wechsel-Leitfaden listet drei Zugriffsmuster auf:

  • Claude Code und Goose verwenden den Anthropic-kompatiblen Endpunkt.

  • Codex verwendet den Endpunkt /api/v1 von Z.ai.

  • Cline und andere kompatible Tools können den OpenAI-ähnlichen Coding-Endpunkt verwenden.

Dies ist das deutlichste Signal für den aktuellen Zweck von GLM-5.3. Es wird als Modell für Codegenerierung, Debugging, Fragen zu Repositories und lang laufende Agentenaufgaben bereitgestellt – nicht als neuer multimodaler Assistent für Endverbraucher.

Textbasierter Zugriff, Vision bleibt getrennt

Z.ai weist Cline-Nutzer an, „Bilder unterstützen“ bei der Konfiguration von glm-5.3 zu deaktivieren. Der Coding Plan bietet Vision Understanding separat über einen Vision-MCP-Dienst an.

Einfach gesagt: Die aktuelle direkte GLM-5.3-Route sollte als Eingabe für Text und Code behandelt werden. Ein Screenshot kann zwar über einen anderen Dienst in einen umfassenderen Z.ai-Workflow gelangen, doch das belegt nicht, dass das zugrunde liegende Modell glm-5.3 Bilder nativ akzeptiert.

Dies ist eine der größten Lücken in der frühen Berichterstattung über GLM-5.3. Die Nachfrage der Community nach Vision-Funktionen ist real. Eine Feature-Anfrage ist jedoch keine ausgelieferte Modalität.

GLM-5.3 vs. GLM-5.2: Was wurde tatsächlich verbessert?

Die sichtbarste bestätigte Verbesserung betrifft das Routing: GLM-5.3 ist jetzt das standardmäßige aktuelle Modell innerhalb des Coding Plans, und frühere GLM-5.2-/5.1-Anfragen werden automatisch dorthin weitergeleitet. Z.ai hat noch nicht genügend technische Belege veröffentlicht, um die zugrunde liegende Qualitätsverbesserung zu quantifizieren.

Bereich GLM-5.2 GLM-5.3
Position im Coding Plan Vorheriges Modell Aktuelles Modell
Modell-ID glm-5.2 glm-5.3
Kontext 1 Mio. dokumentiert 1-Mio.-Option dokumentiert
Reasoning-Konfiguration Flexibler Aufwand Low, High und Max dokumentiert
Architektur 744B gesamt, 40B aktives MoE Nicht offengelegt
Offene Gewichte Unter MIT auf Hugging Face verfügbar Nicht veröffentlicht
Standardpreis der Z.ai-API $1,40 Eingabe / $4,40 Ausgabe pro 1 Mio. Tokens Nicht veröffentlicht
Veröffentlichte Coding-Ergebnisse Von Z.ai verfügbar Keine für 5.3 veröffentlicht
Direkte Bildkonfiguration Textorientiert Bildunterstützung in der aktuellen Einrichtung deaktiviert

Z.ais GLM-5-Repository berichtet, dass GLM-5.2 im Terminal-Bench 2.1 81,0 und im SWE-bench Pro 62,1 Punkte erreicht hat. Außerdem wird berichtet, dass IndexShare die FLOPs pro Token bei einem Kontext von 1 Million Tokens um das 2,9-Fache reduziert und Änderungen am Speculative Decoding die Akzeptanzlänge um bis zu 20 % erhöht haben.

Das sind von Anbietern gemeldete Ergebnisse für GLM-5.2. Sie liefern eine Ausgangsbasis, aber keine Belege für GLM-5.3. Wir wissen noch nicht, ob 5.3 die Architektur verändert, neue Trainingsdaten hinzufügt, den Tool-Aufruf verbessert, Reasoning-Spuren verkürzt oder lediglich eine neuere Post-Training-Version derselben Familie darstellt.

Eine weitere Korrektur ist angebracht: In einigen frühen Artikeln wird GLM-5.2 als Modell mit 753 Milliarden Parametern bezeichnet. Z.ais aktuelles Repository und die Download-Tabelle führen es als 744B-A40B auf. Für einen Vergleich mit dem Vorgänger ist die offizielle Zahl die sicherere Angabe.

Entwickler, die ein dokumentiertes und derzeit zugängliches Mitglied derselben Familie benötigen, können die GLM-5.2-API auf GPT Proto verwenden, während sie auf eine verifizierte GLM-5.3-Route warten.

GLM-5.3-Preise: Was kostet es?

Auf die Frage nach den GLM-5.3-Preisen gibt es zwei unterschiedliche Antworten – je nachdem, ob mit „Preis“ das Coding-Plan-Abonnement oder eine standardmäßige Pay-per-Token-API gemeint ist.

GLM-Coding-Plan-Abonnement

Die Plan-Dokumentation von Z.ai nennt den Abonnementzugang ab 18 $ pro Monat. Zum Zeitpunkt der Prüfung zeigte die öffentliche Abonnementseite Aktionspreise von 12,60 $ für Lite, 56 $ für Pro und 117,60 $ für Max – gegenüber Listenpreisen von 18 $, 80 $ und 168 $. Aktionen können sich ändern; Teams sollten daher vor der Budgetplanung den Preis beim Checkout überprüfen.

Plan Fünf-Stunden-Guthaben Wöchentliches Guthaben
Lite 2.000 10.000
Pro 12.000 60.000
Max 28.000 140.000

Alle drei Pläne unterstützen GLM-5.3. Max kauft kein anderes Modell namens „GLM-5.3 Max“, sondern ein höheres Nutzungslimit.

Verbrauch von GLM-5.3-Guthaben

Die Übersicht des Coding Plans nennt für GLM-5.3 folgende Guthabenmultiplikatoren:

Nutzungstyp Guthabenmultiplikator
Eingabetokens 6,9
Gecachte Eingabetokens 1,7
Ausgabetokens 24

Z.ai berechnet während der dokumentierten Nebenzeiten die Hälfte des normalen Guthabensatzes. Das kann die von einem Abonnement unterstützte Arbeitsmenge erheblich verändern, aber Guthaben sind keine Dollar. Die Umrechnung dieser Multiplikatoren in einen erfundenen Preis pro Million Tokens würde zwei Abrechnungssysteme vermischen.

Standardpreis pro API-Token

Z.ai hat GLM-5.3 nicht auf seiner Standard-API-Preisseite aufgeführt. Die Seite bepreist GLM-5.2 derzeit mit 1,40 $ pro Million Eingabetokens, 0,26 $ pro Million gecachter Eingabetokens und 4,40 $ pro Million Ausgabetokens.

Diese Preise dürfen nicht auf GLM-5.3 angewendet werden. Sie dienen lediglich als Vergleichsbasis für den Vorgänger.

Ist „GLM-5.3 Max“ ein separates Modell?

Keine offizielle Quelle nennt derzeit ein separates Modell namens GLM-5.3 Max.

Das Wort „Max“ erscheint an zwei verschiedenen Stellen. Erstens ist Max die höchste Abonnementstufe des GLM Coding Plans mit 28.000 Guthaben pro Fünfstundenzeitraum und 140.000 Guthaben pro Woche. Zweitens ist max die tiefste dokumentierte Reasoning-Stufe für glm-5.3.

Eine Suche wie „GLM-5.3 Max vs. GLM-5.2 Max“ meint daher meist den Vergleich beider Versionen bei maximalem Reasoning-Aufwand. Sie belegt nicht die Existenz zweier separater, mit Max gekennzeichneter Modelle.

Dieser Vergleich lässt sich derzeit nicht zuverlässig durchführen. Für GLM-5.2 gibt es veröffentlichte Anbieter- und unabhängige Ergebnisse, für GLM-5.3 nicht. Ein fairer Test würde dasselbe Agenten-Setup, denselben Aufgabensatz, Kontext, dieselbe Aufwandsstufe, Wiederholungsrichtlinie und Akzeptanzkriterien erfordern. Eine aufpolierte Demo von 5.3 mit einem alten 5.2-Benchmark zu vergleichen, würde wenig aussagen.

GLM-5.3 vs. Kimi K3 vs. Claude Fable 5

GLM-5.3 wird bereits neben Kimi K3 und Claude Fable 5 diskutiert, weil alle drei anspruchsvolle Programmier- oder Langkontextaufgaben adressieren. Die verfügbare Evidenz ist jedoch nicht gleichwertig.

Deshalb gibt es für Suchanfragen wie „GLM-5.3 vs. Kimi K3“ oder „GLM-5.3 vs. Fable 5“ noch keinen evidenzbasierten Sieger.

Modell Veröffentlichungsstatus Kontext Bildeingabe Standardpreis pro 1 Mio. Tokens Öffentliche unabhängige Ergebnisse
GLM-5.3 Im Coding Plan verfügbar; vollständige Release-Details unvollständig 1-Mio.-Option In der aktuellen direkten Konfiguration deaktiviert Nicht veröffentlicht Noch nicht verfügbar
GLM-5.2 Vollständig veröffentlicht, mit offenen Gewichten 1 Mio. Nein $1,40 Eingabe / $4,40 Ausgabe Verfügbar
Kimi K3 Vollständig veröffentlicht 1 Mio. Ja $3 Eingabe / $15 Ausgabe Verfügbar
Claude Fable 5 Vollständig veröffentlicht, proprietär 1 Mio. Ja $10 Eingabe / $50 Ausgabe Verfügbar

Unabhängige Tests geben Kimi K3 derzeit einen Wert von 60 im Artificial Analysis Intelligence Index. Dieselbe Quelle verzeichnet Text- und Bildeingabe, einen Kontext von 1 Million Tokens und eine MoE-Architektur mit 2,8 Billionen Parametern und 104 Milliarden aktiven Parametern. Die offizielle Dokumentation von Anthropic nennt für Claude-Fable-5-Preise 10 $ pro Million Eingabetokens und 50 $ pro Million Ausgabetokens sowie einen Kontext von 1 Million Tokens.

Das aktuelle LMArena-Code-Ranking enthält ebenfalls Kimi K3 und Fable 5. GLM-5.3 wurde noch nicht aufgenommen. Bis es in reproduzierbaren Bewertungen erscheint, sind Behauptungen, GLM-5.3 übertreffe eines der beiden Modelle, Vorhersagen und keine Vergleiche.

Für Entwickler, die heute eine Entscheidung treffen:

  • Wähle GLM-5.2, wenn offene Gewichte und niedrigere dokumentierte Tokenkosten am wichtigsten sind.

  • Wähle Kimi K3, wenn du einen Kontext von 1 Mio. Tokens, Bildeingabe und eine starke, unabhängig gemessene Programmierleistung benötigst.

  • Wähle Fable 5, wenn die höchste dokumentierte Anthropic-Stufe wichtiger ist als die Tokenkosten.

  • Teste GLM-5.3, wenn du bereits einen Z.ai Coding Plan hast, behalte aber eine Ausweichlösung bei, bis Verhalten und Abrechnung zu deinem Arbeitsaufkommen passen.

GPT Proto bietet derzeit Kimi-K3-API-Zugriff für 2,70 $ Eingabe und 13,50 $ Ausgabe pro Million Tokens. Claude Fable 5 ist ebenfalls verfügbar für 8 $ Eingabe und 40 $ Ausgabe pro Million Tokens. Dies sind einsetzbare Alternativen, solange GLM-5.3 noch nicht im GPT Proto-Katalog verfügbar ist.

Kann man über GPT Proto auf GLM-5.3 zugreifen?

Nein. GLM-5.3 ist derzeit nicht auf GPT Proto verfügbar.

Sende glm-5.3 nicht an den GPT Proto-Endpunkt und bezeichne GPT Proto nicht als Anbieter von GLM-5.3. Entwickler, die heute eine GLM-Route benötigen, können stattdessen GLM-5.2 aufrufen. Die folgende Anfrage verwendet GPTPros bestehende OpenAI-kompatible API und die echte glm-5.2-Modell-ID:

curl "https://gptproto.com/v1/chat/completions" \
  --header "Authorization: Bearer $GPTPROTO_API_KEY" \
  --header "Content-Type: application/json" \
  --data '{
    "model": "glm-5.2",
    "messages": [
      {
        "role": "user",
        "content": "Review this implementation plan and identify the three highest-risk dependencies."
      }
    ]
  }'

Wenn GLM-5.3 verfügbar wird, sollte seine Live-Modellseite – nicht ein Gerüchtebeitrag – die maßgebliche Quelle für GPT Proto-Modellstring, Modalitäten, Kontext und Preis sein.

Du kannst auch die GPT Proto AI Model Gallery durchsuchen, um derzeit verfügbare Text-, Reasoning-, Bild-, Video- und multimodale Routen mit einem API-Schlüssel und einem Guthaben zu vergleichen.

Sollten Entwickler jetzt zu GLM-5.3 wechseln?

Wenn du bereits den Z.ai Coding Plan abonniert hast, ist GLM-5.3 jetzt einen Test wert. Durch das automatische Routing erhältst du es möglicherweise bereits, wenn du über dieses Produkt GLM-5.2 oder GLM-5.1 anforderst. Erfasse das aufgelöste Modell, die Aufwandsstufe, die Kontexteinstellung, den Tokenverbrauch, die Latenz, Wiederholungen und ob das Ergebnis die Prüfung bestanden hat.

Betrachte die Routing-Aktualisierung nicht als Beweis dafür, dass sich jede Arbeitslast verbessert hat. Ein neueres Coding-Modell kann Anweisungen besser befolgen und gleichzeitig mehr Ausgabe-Guthaben verbrauchen. Es kann schwierigere Aufgaben erledigen, aber bei maximalem Aufwand langsamer antworten. Die relevante Frage lautet nicht „Ist die Versionsnummer gestiegen?“, sondern „Ist akzeptierte Arbeit günstiger oder zuverlässiger geworden?“

Warte mit GLM-5.3 als Produktionsabhängigkeit, wenn du eines der folgenden Dinge benötigst:

  • Einen stabilen Pay-per-Token-API-Preis

  • Öffentliche Rate-Limits und Kapazitätszusagen

  • Herunterladbare Gewichte und eine bestätigte Lizenz

  • Native Bildeingabe über dieselbe Modellroute

  • Unabhängige Ergebnisse zu Coding, Agenten, Latenz und Durchsatz

  • Eine verifizierte GPT Proto-Modellseite und einen Endpunkt

Für ein Projekt, das heute ausgeliefert werden muss, solltest du ein dokumentiertes Modell verwenden und die Modell-ID konfigurierbar machen. So kannst du GLM-5.3 später bewerten, ohne die umgebende Anwendung neu zu schreiben.

Fazit

GLM-5.3 ist real und aufrufbar, aber sein Release ist begrenzter, als der Modellname vermuten lässt. Es ist derzeit das neueste Modell im GLM Coding Plan von Z.ai – mit einer dokumentierten Kontextoption von 1 Mio. Tokens, den Aufwandsstufen Low/High/Max und Kompatibilität mit mehreren Coding-Agenten.

Ebenso wichtig ist, was wir nicht haben: keinen datierten Startbeitrag, keine GLM-5.3-Model-Card, keinen Standardpreis pro Token, keine offenen Gewichte und keinen Benchmark-Bericht. Damit ist GLM-5.3 ein glaubwürdiger Kandidat für Evaluierungen, aber noch kein Modell, das sich fair nach den Kosten pro erfolgreicher Aufgabe gegen Kimi K3, Fable 5 oder sogar GLM-5.2 einordnen lässt.

Wenn du bereits für den Coding Plan zahlst, teste es. Wenn du jetzt eine dokumentierte API-Route benötigst, beginne mit GLM-5.2, Kimi K3 oder Claude Fable 5 und halte das Modell austauschbar.

Häufig gestellte Fragen

Was ist GLM-5.3?

GLM-5.3 ist das neueste coding-orientierte Modell von Z.ai innerhalb des GLM Coding Plans. Es unterstützt die Modell-ID `glm-5.3`, eine optionale Konfiguration für 1 Million Tokens sowie niedrigen, hohen und maximalen Reasoning-Aufwand.

Ist GLM-5.3 offiziell veröffentlicht?

Es ist offiziell im GLM Coding Plan verfügbar. Z.ai hat die vollständige Model Card, den standardmäßigen API-Eintrag, offene Gewichte und einen datierten Release-Notes-Eintrag, der normalerweise zu einem vollständigen Release gehört, noch nicht veröffentlicht.

Wann ist das Veröffentlichungsdatum von GLM-5.3?

Z.ai hat kein genaues Veröffentlichungsdatum für GLM-5.3 bekannt gegeben. Am 14. August 2026 identifiziert die Einrichtungsdokumentation das Modell als für Coding-Plan-Nutzer verfügbar.

Ist GLM-5.3 das neue Flaggschiff von Z.ai?

Es ist das neueste dokumentierte Coding-Plan-Modell, aber Z.ai hat noch keinen GLM-5.3-Modellleitfaden veröffentlicht, der seine umfassendere Flaggschiff-Position formell definiert. Die Standard-Modellübersicht hebt weiterhin GLM-5.2 hervor.

Wie viel kostet GLM-5.3?

GLM-5.3 ist in den Coding-Plan-Stufen Lite, Pro und Max enthalten. Z.ai dokumentiert Abonnements ab einem monatlichen Listenpreis von 18 $ und verwendet Guthabenmultiplikatoren von 6,9 für Eingaben, 1,7 für gecachte Eingaben und 24 für Ausgaben. Ein standardmäßiger GLM-5.3-API-Preis pro Million Tokens wurde nicht veröffentlicht.

Unterstützt GLM-5.3 einen Kontext von 1 Mio. Tokens?

Ja. Z.ai dokumentiert die Konfiguration `glm-5.3[1m]` für einen Kontext von 1 Million Tokens. Entwickler müssen außerdem die entsprechende Kontext- oder Komprimierungseinstellung in ihrem Coding-Tool konfigurieren.

Unterstützt GLM-5.3 Bildeingabe?

Die aktuelle direkte Cline-Konfiguration weist Nutzer an, die Bildunterstützung zu deaktivieren. Z.ai bietet Vision Understanding separat über einen MCP-Dienst an. Dies sollte nicht als Beleg für native Bildeingabe über die Route `glm-5.3` dargestellt werden.

Ist GLM-5.3 Open Source?

Zum Zeitpunkt der Erstellung nicht. Z.ai hat keine offiziellen GLM-5.3-Gewichte oder eine Lizenz veröffentlicht. Die MIT-Veröffentlichung der GLM-5.2-Gewichte gilt nicht automatisch für GLM-5.3.

Ist GLM-5.3 Max ein separates Modell?

Es wurde kein separates GLM-5.3-Max-Modell angekündigt. Max kann sich auf die höchste Coding-Plan-Abonnementstufe oder auf die maximale Reasoning-Stufe beziehen.

Ist GLM-5.3 besser als Kimi K3 oder Claude Fable 5?

Dafür gibt es noch nicht genügend Belege. Kimi K3 und Fable 5 verfügen über veröffentlichte Preise, Spezifikationen und unabhängige Ergebnisse. Für GLM-5.3 gibt es noch keine vergleichbare öffentliche Evaluierung.

Verwandte Artikel

Weitere Blogbeiträge
DeepSeek V4 Pro vs. Kimi K3: Was hat sich nach dem 0813-Update geändert?

DeepSeek V4 Pro vs. Kimi K3: Was hat sich nach dem 0813-Update geändert?

Der Vergleich zwischen DeepSeek V4 Pro und Kimi K3 hat sich am 13. August 2026 verändert. DeepSeek hat die V4-Pro-Vorschau hinter dem bestehenden API-Alias durch DeepSeek V4 Pro 0813 ersetzt und dabei den Modellnamen beibehalten, den Entwickler bereits verwenden. Hier die kurze Antwort: Kimi K3 führt weiterhin bei der insgesamt gemessenen Intelligenz und unterstützt visuelle Eingaben. DeepSeek V4 Pro 0813 ist schneller und für textbasiertes Codieren sowie Agent-Workloads erheblich günstiger. Für die meisten Teams, die Repositories verarbeiten, Code-Reviews durchführen oder Agents mit hohem Volumen betreiben, ist DeepSeek jetzt die bessere Standardwahl. Kimi rechtfertigt seinen höheren Preis, wenn multimodale Eingaben oder die höchstmögliche verfügbare Reasoning-Leistung wichtiger sind als die Kosten. Ein Implementierungsdetail wird leicht übersehen: Auf GPTProto benötigen Sie kein 0813 -Suffix. Rufen Sie weiterhin deepseek-v4-pro auf; die Route verwendet automatisch die aktuelle Version.

Tiffany Layne | 2026-08-13

Grok 4.6 vs. DeepSeek V4 Pro: Programmierung, Preise und welches Modell besser ist

Grok 4.6 vs. DeepSeek V4 Pro: Programmierung, Preise und welches Modell besser ist

rok 4.6 und DeepSeek V4 Pro wurden beide für anspruchsvolle Reasoning- und Programmieraufgaben entwickelt, sind jedoch nicht austauschbar. Grok 4.6 ist die bessere Wahl, wenn eine Aufgabe Screenshots, Interface-Mockups, visuelles Debugging oder besonders schwierige agentische Programmierprobleme umfasst. DeepSeek V4 Pro ist attraktiver, wenn Kosten, langer Kontext und umfangreiche textbasierte Programmierung im Vordergrund stehen. Die kurze Antwort ist einfach: Grok 4.6 ist das bessere Allround-Modell, während DeepSeek V4 Pro das kosteneffizientere Programmiermodell ist. Dieser Vergleich von Grok 4.6 und DeepSeek V4 Pro behandelt Programmierung, Frontend-Entwicklung, Kontextfenster, öffentliche Benchmark-Ergebnisse, API-Preise und das aktuelle Upgrade von DeepSeek V4 Pro. Außerdem wird erklärt, welches Modell für verschiedene Entwickler-Workloads sinnvoller ist. Kurzes Fazit: Wählen Sie Grok 4.6 für visuelle Frontend-Arbeit, schwieriges Debugging und anspruchsvolle Programmieraufgaben. Wählen Sie DeepSeek V4 Pro für große Repositories, textlastige Workflows und niedrigere API-Kosten. Für das Routing in Produktionsumgebungen kann DeepSeek V4 Pro den Standard-Workload übernehmen, während Grok 4.6 visuelle oder besonders schwierige Aufgaben bearbeitet.

Tiffany Layne | 2026-08-13

Grok 4.6 vs. Kimi K3: Welches Modell passt zu Ihrem Projekt?

Grok 4.6 vs. Kimi K3: Welches Modell passt zu Ihrem Projekt?

Zwei Frontier-Releases sind innerhalb von vier Wochen erschienen, beide klar auf denselben Käufer ausgerichtet: den Entwickler, der Agenten statt Chatbots betreibt. Moonshot AI hat Kimi K3 am 16. Juli 2026 veröffentlicht. xAI legte am 12. August mit Grok 4.6 nach. Wenn Sie heute nach "Grok 4.6 vs Kimi K3" suchen, finden Sie Launch-Berichte aus beiden Lagern sowie eine Fülle von Datenblättern – aber kaum jemand hat die beiden aus der Perspektive eines Entwicklers direkt gegenübergestellt. Genau diese Lücke schließt dieser Artikel. Hier die Kurzfassung, denn Sie sind wegen einer Entscheidung hier, nicht wegen einer Zusammenfassung. Grok 4.6 gewinnt bei der Effizienz agentischer Abläufe und beim vollständig verwalteten Hosting. Lange, mehrstufige Aufgaben werden mit weniger Schleifen und weniger Tokens abgeschlossen, und Sie müssen sich nie um die Infrastruktur kümmern. Kimi K3 gewinnt bei Kontext, nativer Videoverarbeitung und Kontrolle – mit einem Fenster von 1 Mio. Tokens, Bild- und Videoeingabe sowie herunterladbaren Open Weights, falls Sie das Modell selbst hosten oder vollständig isoliert betreiben müssen. Bei der einen Zahl, die alle zitieren, liegen sie fast gleichauf: Artificial Analysis setzt die Kosten pro Aufgabe für beide auf ungefähr $0.84 . Der Unterschied von einem Punkt beim Intelligence Index ist also nicht ausschlaggebend. Die beiden Modelle erreichen dieselben Kosten auf völlig unterschiedlichen Wegen – und das ist die eigentliche Entscheidung, die Sie treffen müssen. Wenn Sie kostensensible Agenten-Workflows mit hohem Volumen betreiben und einen verwalteten Endpunkt möchten: Grok 4.6. Wenn Sie ein ganzes Repository oder ein Video in ein einziges Kontextfenster laden müssen – oder aus Compliance-Gründen die Gewichte selbst verwalten wollen: Kimi K3. Der restliche Artikel zeigt, wie diese Entscheidung zustande kommt.

Schuyler Stacy | 2026-08-13

Was ist OpenAIs neuestes Modell Astra? Erscheinungsdatum, Benchmarks & Vergleich (2026)

Was ist OpenAIs neuestes Modell Astra? Erscheinungsdatum, Benchmarks & Vergleich (2026)

Kurzantwort: OpenAIs neuestes Modell, vorläufig Astra genannt, ist ein in der Forschungsphase befindliches Multi-Agenten-KI-System , das am 1. August 2026 vorgestellt wurde. Statt in einem einzigen Durchgang zu antworten, zerlegt Astra ein Problem in Teile und koordiniert über Stunden oder Tage ein Team von Sub-Agenten. Sein wichtigster Erfolg: Eine interne Version löste zehn offene mathematische und theoretisch-informatische Probleme , die menschlichen Forschern mindestens ein Jahrzehnt lang widerstanden hatten – bei Gesamt-Computerkosten von ungefähr 2.000 $ . Zum Zeitpunkt dieses Artikels hat Astra kein öffentliches Erscheinungsdatum und keine angekündigte Preisgestaltung . Dieser Leitfaden beantwortet die Fragen, nach denen Menschen tatsächlich suchen: Was ist Astra und was hat es wirklich getan? Wann ist das Erscheinungsdatum von Astra und kannst du es jetzt nutzen? Wie hoch ist der Preis von Astra? Ist Astra OpenAIs neues Flaggschiff – oder GPT-6? Wie schneidet Astra im Vergleich zu GPT-5.6, Kimi K3 und Fable 5 ab? Was sind die Risiken und offenen Fragen? Im gesamten Artikel kennzeichnen wir ✅ Bestätigt Fakten und ⚠️ Gerücht / Unbestätigt Behauptungen, damit du Signal von Hype unterscheiden kannst.

Michael Johnson | 2026-08-13