
GLM 5.5: Veröffentlichungsdatum, was berichtet wird und was zu erwarten ist
- DeepSeekNEUDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 pro 1 Mio. Tokens
- z-aiNEUZ.ai: GLM 5.32026-08-1860Intelligenz75Coding
- obsidianNEUQwen3.8 27B2026-08-1552Intelligenz68Coding
- qwenNEUQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNEUDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligenz69Coding
- grokNEUSpaceXAI: Grok 4.62026-08-1261Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0557Intelligenz72Coding
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligenz72Coding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligenz69Coding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligenz78Coding
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligenz69Coding
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligenz49Coding
- metaMeta: Muse Spark 1.12026-07-1653Intelligenz71Coding
- kimiMoonshotAI: Kimi K32026-07-1560Intelligenz76Coding
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligenz71Coding
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligenz77Coding
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligenz77Coding
Zhipu AI (jetzt unter dem Namen Z.ai auftretend) hat eine der am genauesten beobachteten Open-Weight-Roadmaps in der KI, und der nächste Schritt – weithin als GLM 5.5 – sorgt für echte Vorfreude. Aber es gibt einen wichtigen Vorbehalt gleich vorweg: Stand Ende Juli 2026 hat Z.ai GLM 5.5 noch nicht offiziell angekündigt. Es gibt keine Model Card, keine Benchmarks, keine Preisgestaltung und nicht einmal einen bestätigten Namen. Was wir haben, ist eine glaubwürdige Berichterstattung über ein Veröffentlichungsfenster im August 2026 und eine sehr starke, gut dokumentierte Basis in GLM-5.2. Dieser Leitfaden trennt das tatsächlich Berichtete von Spekulationen und nutzt GLM-5.2, um realistische Erwartungen zu setzen.
Jede folgende Abbildung ist mit der Quelle gekennzeichnet. GLM 5.5 hat keine offiziellen Spezifikationen; die konkreten Zahlen hier stammen von GLM-5.2 (dem Vorgänger) und sind, sofern nicht anders angegeben, vom Anbieter gemeldet. Die Berichterstattung über GLM 5.5 basiert auf Analystenprognosen und Presseberichten, nicht von Z.ai. Details können sich ändern – bei der Veröffentlichung überprüfen.
TL;DR. GLM 5.5 wird voraussichtlich um August 2026 erwartet, ein von JPMorgan-Analysten berichtetes und von Reuters und CGTN übernommenes Zeitfenster – keine Z.ai-Verpflichtung. Gerüchte deuten auf ein offenes Gewichtsmodell mit über einer Billion Parametern, das sich auf Programmieragenten konzentriert und auf dem 1-Millionen-Token-Kontext von GLM-5.2 aufbaut, aber nichts davon ist bestätigt (der Name könnte sogar GLM-5.3 oder GLM-6 lauten). Der sichere Grund ist GLM-5.2: ein 753B MoE, MIT-lizenziertes Modell mit 1-Millionen-Kontext, das bereits zu den führenden offenen Gewichtssystemen für Programmierung gehört. Verwenden Sie heute GLM-5.2; die Übernahme von GLM 5.5 später ist auf einem anbieterneutralen Endpunkt trivial.
Wichtige Erkenntnisse
Noch nicht offiziell. Stand Ende Juli 2026 hat Z.ai weder eine GLM‑5.5‑Modellkarte, Spezifikationen oder Preise veröffentlicht – und den Namen auch nicht bestätigt.
• Gemeldetes Zeitfenster: August 2026. Quelle: JPMorgan-Analysten über Reuters und CGTN (Ende Juni 2026) — ein „Beobachtungsfenster“, kein Verkaufsdatum.
• Gerüchte über Spezifikationen (nicht bestätigt): 1T+ Parameter, 1M-Token-Kontext von GLM-5.2 übernommen, offene Gewichte und ein Fokus auf langlebige Codierungsagenten.
• Das einzige direkte Signal: Zhipus Tang Jie beschrieb ein bevorstehendes Modell in chinesischen Medien als 'epic plus' – ermutigend, aber kein Datenblatt.
• Solide Grundlage: GLM-5.2 (753B MoE, 1M Kontext, MIT-Lizenz) ist ein führendes Open-Weight-Coding-Modell, das Sie sofort nutzen können.
Was wird tatsächlich berichtet (und von wem)
Der zeitliche Rahmen August 2026 lässt sich auf eine klare Quellenkette zurückführen: JPMorgan-Analysten prognostizieren Berichten zufolge ein weiteres Z.ai-Modell für August 2026, über das Reuters berichtete und CGTN Ende Juni 2026 erneut veröffentlichte. Das ist glaubwürdige Berichterstattung, jedoch eine Analystenprognose und keine Z.ai-Veröffentlichungsnotiz – daher sollte der August eher als Beobachtungsfenster denn als Versprechen betrachtet werden. Das einzige direkte Signal von Unternehmensseite ist ein Kommentar von Zhipu-Mitgründer Tang Jie, der eine bevorstehende Verbesserung in chinesischen Medien als „epic plus“ beschrieb. Das deutet auf bedeutende laufende Arbeit hin, aber es nennt weder das Modell, bestätigt den Zeitplan noch gibt es Spezifikationen preis.
Was gemunkelt wird – und warum man es nicht zu ernst nehmen sollte.
Im Juli 2026 kursierende Community-Leaks beschreiben ein Modell mit mehr als einer Billion Gesamtparametern, einem auf eine Million Token erweiterten Kontextfenster, das von GLM-5.2 übernommen wurde, offenen Gewichten und einem starken Fokus auf langlaufende Coding-Agenten. Angesichts der Entwicklung von Zhipu sind diese Angaben plausibel – jedoch unbestätigt, und Analysten selbst warnen, dass eine Zahl wie „1T+ Parameter“ noch nicht für Hardware-Planung, Preisgestaltung oder Leistungsbehauptungen verwendet werden kann. Selbst das Branding ist unsicher: Berichte haben GLM-5.3, GLM 5.5 und GLM-6 als mögliche Namen genannt. Jeder, der heute harte GLM-5.5-Benchmarks zitiert, spekuliert nur.
Die wahre Baseline: was GLM-5.2 tatsächlich ist
Da GLM 5.5 direkt darauf aufbauen wird, ist GLM-5.2 der beste Weg, um Erwartungen zu setzen. GLM-5.2 wurde im Juni 2026 unter einer MIT-Lizenz veröffentlicht und ist ein Mixture-of-Experts-Modell mit insgesamt etwa 753 Milliarden Parametern (etwa 40 Milliarden aktiv pro Token), einem Kontextfenster von 1.000.000 Token und bis zu 131.072 Ausgabe-Token, das Zhipus „IndexShare“-Sparse-Attention-Design verwendet. Es ist vollständig offen gewichtet und selbst hostbar.

Bei herstellerberichteten Benchmarks ist GLM-5.2 stark, insbesondere beim Programmieren: etwa 62,1 % bei SWE-bench Pro, 81,0 % bei Terminal-Bench 2.1, 91,2 % bei GPQA Diamond und ein nahezu gesättigter Wert von 99,2 % bei AIME 2026, sowie 77,8 % bei SWE-bench Verified (am besten unter den Open-Source-Modellen). Es ist auch günstig – etwa 1,20 $ pro Million Input-Token und 4,10 $ pro Million Output – und Zhipu behauptet, dass es GPT-5.5 bei mehreren langfristigen Programmier-Benchmarks zu einem Bruchteil der Kosten übertrifft. Das ehrliche Gegengewicht: Unabhängige Zusammensetzungen tendieren dazu, niedriger zu punkten als die Herstellerzahlen, und bei den schwierigsten allgemeinen Denkaufgaben liegt GLM-5.2 hinter der geschlossenen Spitzenklasse und sogar hinter einigen offenen Mitbewerbern. Dennoch ist es als Open-Weight-Programmierarbeitstier heute eine echte Spitzenoption.
Was man vernünftigerweise von GLM 5.5 erwarten kann (als Erwartung bezeichnet)
Ohne offizielle Spezifikationen ist jede Erwartung eine Vermutung. Aber fundierte Vermutungen basierend auf der Entwicklung von GLM-5.1 zu GLM-5.2 und den Leaks: Erwarten Sie, dass GLM 5.5 noch weiter in Richtung agentischer und langfristiger Codierung vorstößt (Zhipus klare Priorität), wahrscheinlich den 1M-Token-Kontext beibehält, sehr wahrscheinlich offene Gewichte behält (GLM-5.2 war MIT, obwohl eine Lizenz für einen Nachfolger nie garantiert ist), und wahrscheinlich die Parameter hochskaliert – vielleicht in den Billionenbereich. Was wirnichtannehmen: spezifische Benchmark-Ergebnisse, bestätigte Preise, native Bildverarbeitung oder sogar den endgültigen Namen. Behandeln Sie „größer, agentischer, weiterhin offen, weiterhin günstig“ als eine bei der Markteinführung zu überprüfende Hypothese, nicht als Tatsache.
Wie man sich vorbereitet — und was man heute verwendet
Halten Sie ein Projekt nicht auf, nur um auf ein Modell zu warten, das noch nicht erschienen ist. GLM-5.2 ist jetzt verfügbar und ein hervorragendes Open-Weight-Coding-Modell. Wenn Sie gegen einen anbieterneutralen, OpenAI-kompatiblen Endpunkt entwickeln, ist die Übernahme von GLM 5.5, sobald es erscheint, eine Konfigurationsänderung und keine Re-Integration. OrcaRouter stellt GLM-5.2 heute über einen einzigen OpenAI-kompatiblen Endpunkt neben vielen anderen Modellen bereit, sodass Sie jetzt mit GLM-5.2 ausliefern und GLM 5.5 in dem Moment A/B-testen können, in dem es live geht — und dann lassen Sie unabhängige Benchmarks und Ihre eigenen Tests entscheiden, ob Sie wechseln.

Wie man den Start liest, wenn er stattfindet
Wenn GLM 5.5 (oder wie auch immer es letztendlich heißen wird) erscheint, gibt es ein paar Dinge, die man eher beobachten sollte, anstatt sie für bare Münze zu nehmen. Überprüfen Sie die Lizenz zuerst – offene Gewichte sind zentral für die Attraktivität von GLM, und die Bedingungen eines Nachfolgers sind nicht garantiert. Beobachten Sie unabhängige Programmier- und Agentik-Zahlen (SWE-bench Pro/Verified, Terminal-Bench) anstatt nur Verkaufsfolien, da Zhipus eigene Ergebnisse tendenziell hoch sind. Bestätigen Sie die Kontextfenster und Preisgestaltung , die beide den realen Wert bestimmen. Und führen Sie, wie immer, Ihre eigenen repräsentativen Programmieraufgaben durch: Eine Spitzenposition auf der Rangliste ist eine Ausgangshypothese, keine Garantie für Ihre Arbeitslast.

FAQ
Wann erscheint GLM 5.5?
Berichte (JPMorgan-Analysten via Reuters und CGTN, Ende Juni 2026) deuten auf ein August‑2026‑Fenster hin, aber Z.ai hat kein Datum bestätigt. Behandle es als Beobachtungsfenster.
Gibt es offizielle GLM 5.5 Spezifikationen oder Benchmarks?
Nein. Stand Ende Juli 2026 gibt es keine offizielle Modellkarte, Benchmark, Preisgestaltung oder sogar einen bestätigten Namen. Harte Zahlen, die derzeit kursieren, sind Spekulation.
Wird GLM 5.5 Open-Weight sein?
Wahrscheinlich, da GLM-5.2 unter einer MIT-Lizenz ausgeliefert wurde — aber die Lizenz eines Nachfolgers ist bis zur Veröffentlichung nie garantiert. Überprüfen Sie die Bedingungen bei der Veröffentlichung.
Wie viele Parameter wird GLM 5.5 haben?
Leaks deuten darauf hin, dass es mehr als eine Billion Gesamtparameter gibt, gegenüber den ~753B von GLM-5.2, aber dies ist eine unbestätigte Analysten-/Community-Zahl.
Was ist GLM-5.2, der Vorgänger?
Zhipus Open-Weight-Flaggschiff vom Juni 2026: ein ~753B MoE (etwa 40B aktiv), 1M-Token-Kontext, MIT-lizenziert, stark im Bereich Coding (z. B. ~62,1% SWE-bench Pro, 81,0% Terminal-Bench 2.1, herstellerberichtet) zu etwa 1,20 $ / 4,10 $ pro Million Token.
Kann ich GLM 5.5 jetzt verwenden?
Noch nicht — es ist unveröffentlicht. Verwenden Sie heute GLM-5.2, auch über den OpenAI-kompatiblen Endpunkt von OrcaRouter, und wechseln Sie, wenn GLM 5.5 startet.
Fazit
GLM 5.5 ist eine der am meisten erwarteten Open-Weight-Veröffentlichungen des Jahres 2026, aber es ist noch nicht so weit – der Zeitrahmen August 2026 stammt von Analystenberichten, die Spezifikationen zu einer Billion Parametern und 1M-Kontext sind unbestätigte Leaks, und selbst der Name ist noch nicht endgültig. Was feststeht, ist die Entwicklung und die Basis: GLM-5.2 ist bereits ein führendes Open-Weight-Coding-Modell, MIT-lizenziert und günstig, und von GLM 5.5 wird erwartet, dass es agentisches Coding weiter vorantreibt. Bauen Sie noch heute auf GLM-5.2 über einen anbieterneutralen Endpunkt wie OrcaRouter auf, achten Sie auf die offizielle Modellkarte, und lassen Sie unabhängige Benchmarks sowie Ihre eigenen Tests entscheiden, wie schnell Sie GLM 5.5 übernehmen, sobald es echt ist. Wir werden diesen Beitrag aktualisieren, wenn es startet.
In diesem Artikel verglichen3
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
