Einsteiger 7 minNeuigkeiten

GLM-5.5: Wie glaubwürdig sind die Gerüchte über eine Veröffentlichung im August 2026 ?

Eine Analystennotiz von J.P. Morgan und mehrere Community-Leaks sprechen von einem GLM-5.5 mit offenen Modellgewichten und mehr als einer Billion Parametern, das im August 2026 erscheinen soll. Bis heute hat Zhipu AI nichts bestätigt: weder das Datum noch die Größe noch überhaupt die Existenz des Modells unter diesem Namen. Dieser Leitfaden trennt tatsächlich belegte Informationen von Spekulationen, skizziert realistische Szenarien und zeigt Ihnen, wie Sie selbst nachprüfen können, sobald „glm 5.5“ mehr als nur ein Gerücht ist. Er wird aktualisiert, sobald eine offizielle Information vorliegt.

Von Mohamed Meguedmi·Aktualisierung 2026-08-29·Unter Windows, macOS und Linux getestet
!
GERÜCHT — keine offizielle Bestätigung
Zum Zeitpunkt der Abfassung dieser Zeilen (29. August 2026) hatte Zhipu AI GLM-5.5 noch nicht angekündigt. Alles Folgende beruht auf einer Notiz von Finanzanalysten und Leaks aus der Community, die sich nicht unabhängig überprüfen lassen. Treffen Sie auf Grundlage dieses Textes keine Kaufentscheidung für Hardware: Betrachten Sie ihn als Beobachtung aktueller Entwicklungen, nicht als gesicherte Tatsache.

#Das Wichtigste in einer Minute

Wenn Sie auf der Suche nach einem Ollama-Tag für GLM-5.5 hier gelandet sind, lautet die kurze Antwort: Es gibt keinen. Weder Modellgewichte noch ein Befehl noch eine offizielle Modellkarte tragen heute diesen Namen. Es gibt lediglich schwache Hinweise – eine Analystennotiz und Gerüchte –, die auf einen möglichen Marktstart im August 2026 hindeuten. Hier das Wichtigste, bevor wir ins Detail gehen.

Der Status
GLM-5.5 ist ein Gerücht, kein Produkt. Zhipu AI hat weder den Namen noch das Datum oder die Eigenschaften bestätigt.
Hauptquelle
Eine J.P. Morgan zugeschriebene Forschungsnotiz, die ein Open-Weights-Modell mit mehr als 1.000 Milliarden Parametern erwähnt und von Community-Accounts weiterverbreitet und anschließend verstärkt wurde.
Was tatsächlich existiert
Die GLM-Linie ist real und aktiv: GLM-5, GLM 5.1 und GLM-5.2 sind heute lokal installierbar. Die Version « 5.5 » ist spekulativ.
Darauf sollten Sie achten
Ein Modell ist erst dann verfügbar, wenn sich seine Gewichte mit einem Befehl und ohne Warteliste herunterladen lassen. Solange dieser Test fehlschlägt, handelt es sich um eine Ankündigung oder ein Gerücht, nicht um eine Veröffentlichung.

#Woher das Gerücht über GLM-5.5 stammt

Das Kit Lokale KI

Ihr privates, kostenloses ChatGPT auf Ihrem Rechner in einer Stunde – mit LM Studio, Ollama, Open WebUI und Ihren Dokumenten, ganz ohne Cloud.

  • Lebenslanger Online-Zugang
  • PDF + Dateien
  • Lebenslange Updates

Das Suchinteresse an „glm 5.5“ ist innerhalb weniger Tage sprunghaft gestiegen, angetrieben von zwei Arten von Quellen, die klar voneinander unterschieden werden müssen, da sie weder dasselbe Gewicht noch dieselbe Absicht haben.

Die Research-Notiz von J.P. Morgan
Eine Forschungsnote von Finanzanalysten, indirekt über soziale Netzwerke zitiert, würde einen nächsten offenen Modell von Zhipu mit über 1T Parametern im August 2026 erwähnen. Eine Analysten-Note bewertet einen Markt und ein Unternehmen; es ist weder ein Labor-Communique noch eine Produkt-Roadmap.
Community-Leaks
Screenshots ohne Quellenangabe, Forenbeiträge, Threads auf X/Reddit und Discord-Diskussionen, die die ursprüngliche Zahl aufgreifen, verzerren und aufblähen. Bei jeder Weiterverbreitung kommt tendenziell ein erfundenes Detail hinzu (exakte Größe, Benchmark, auf den Tag genaues Datum), das in der ursprünglichen Quelle nicht enthalten war.
Echo-Effekt
Artikel tragen diese Gerüchte anschließend zusammen und stellen sie als „erwartet“ oder „bestätigt“ dar. Das ist der klassische Mechanismus, durch den eine Analystenhypothese nach dreimaliger Weitergabe zu einem „bestätigten Leak“ wird – ohne dass neue Fakten hinzugekommen wären.
i
Warum ein Analystenbericht keine Ankündigung ist
Eine Investmentbank modelliert Szenarien für ihre Kunden: „Wenn Zhipu in Q3 ein 1T+-Modell veröffentlicht, sind dies die Auswirkungen.“ Wird dieser bedingte Satz ohne das „Wenn“ übernommen, wird daraus: „Zhipu veröffentlicht in Q3 ein 1T+-Modell.“ Die Nuance verschwindet, die Behauptung bleibt. Genau das ist hier passiert.

#Zhipu sagt offiziell nichts

Der wichtigste Punkt dieses gesamten Leitfadens lässt sich in einem Wort zusammenfassen: nichts. Zum Zeitpunkt der Veröffentlichung hat Zhipu AI – der Anbieter hinter der GLM-Familie – weder eine Mitteilung noch einen Teaser, eine Modellkarte oder ein Repository veröffentlicht, in dem „GLM-5.5“ erwähnt wird. Die maßgeblichen Kanäle schweigen zu diesem Namen.

Hugging Face
Die offizielle Organisation von Zhipu auf huggingface.co führt kein GLM-5.5-Repository auf. Dort würden die Gewichte zuerst erscheinen, wie bei den vorherigen Versionen.
Die Ollama-Bibliothek
In der Registry gibt es keinen Tag „glm-5.5“. Die Tags für die früheren Versionen (GLM-5, 5.1, 5.2) sind dort vorhanden, was das Fehlen von 5.5 umso aussagekräftiger macht.
Die offiziellen Kanäle von Zhipu
Blog, Entwicklerkonto und API-Dokumentation erwähnen dieses Modell nicht. Eine bedeutende Veröffentlichung geht immer mit einer Modellkarte und einem Blogbeitrag einher – hier gibt es weder das eine noch das andere.
→
Die Verfügbarkeit mit einer einzigen Frage prüfen
Bevor Sie glauben, dass ein Modell „bald erscheint“, fragen Sie sich: Gibt es ein offizielles, vom Labor unterzeichnetes Modellprofil mit einem Namen, einer Lizenz und einer Größenangabe? Für GLM-5.5 lautet die Antwort nein. Alles andere ist Kaffeesatzleserei – hilfreich, um Entwicklungen vorauszusehen, aber gefährlich als Entscheidungsgrundlage.

#Was heute wirklich existiert

Das Gerücht um GLM-5.5 ist spekulativ, doch die GLM-Familie ist real und gehört zu den aktivsten im chinesischen Open-Weight-Bereich. Wenn Sie heute lokal „GLM“ ausprobieren möchten, müssen Sie nicht auf eine hypothetische Version 5.5 warten: Mehrere Versionen lassen sich bereits installieren und sind auf dieser Website dokumentiert.

GLM-5
Der Herausforderer von Zhipu mit offenen Modellgewichten, über Ollama in den Varianten 9B und 32B verfügbar. Guter Kompromiss zwischen logischem Schlussfolgern, Französisch und Code; auf einer handelsüblichen Grafikkarte installierbar.
GLM 5.1
Die nächste Iteration, positioniert als ernstzunehmende Open-Weight-Alternative zu Qwen und Llama. Moderater VRAM-Bedarf, ordentliche Qualität auf Französisch.
GLM-5.2
Das Schwergewicht der Modellfamilie: ein MoE mit rund 753 Milliarden Parametern unter MIT-Lizenz, mit bestätigten GGUF-Quantisierungen für Ollama und LM Studio. Sehr großen Konfigurationen vorbehalten (Mac mit 256 GB, aggressives Offloading), aber dieses Modell gibt es tatsächlich.

Anders gesagt ist die Entwicklung der Modellfamilie klar: Mit jeder Version nehmen Größe und Anspruch zu. Ein „GLM-5.5“, das größer als Version 5.2 wäre, würde diese Entwicklung fortsetzen – das macht das Gerücht plausibel, aber noch nicht wahr. Plausibel und bestätigt sind zwei verschiedene Dinge.

#Drei realistische Szenarien

Da wir nichts mit Sicherheit sagen können, ist es am ehrlichsten, die möglichen Szenarien und ihre relativen Wahrscheinlichkeiten darzustellen, statt auf ein einziges zu setzen. So schätzen wir die Lage ein.

  1. 01
    Szenario 1 — Das Gerücht bewahrheitet sich ungefähr so wie beschrieben
    Zhipu veröffentlicht tatsächlich ein Modell mit offenen Gewichten über 1 Tera-Parameter im Sommer oder Herbst 2026 unter einem ähnlichen Namen (5.5, 6 oder ein anderes). Das ist konsistent mit der Entwicklung der GLM-Familie und der Konkurrenz um große MoE-Modelle in China. Prinzipiell wahrscheinlich, aber der genaue Name und die genaue Datum sind ungewiss.
  2. 02
    Szenario 2 — Das Modell erscheint, entspricht aber nicht den Gerüchten
    Das Modell wird veröffentlicht, aber Größe, Lizenz oder Positionierung entsprechen nicht der verbreiteten Zahl. Ein angekündigtes „1T+“-Modell kann sich als MoE herausstellen, bei dem pro Token nur ein Bruchteil aktiv ist, oder als proprietäre API-Variante, die nicht heruntergeladen werden kann. Durchaus möglich: Das ist das häufigste Schicksal durchgesickerter Zahlen.
  3. 03
    Szenario 3 — Überhaupt kein GLM-5.5
    Zhipu überspringt diese Nummer, verschiebt die Veröffentlichung um mehrere Monate oder nennt seine nächste Version anders. Der Analystenbericht erweist sich als Prognose, die sich im angekündigten Zeitfenster nicht bewahrheitet hat. Das ist nicht auszuschließen: Die Zeitpläne von Forschungslaboren verschieben sich ständig.
i
Unsere Einschätzung, mit Vorbehalt zu lesen
Angesichts der bisherigen Entwicklung der Modellfamilie erscheint es uns wahrscheinlich, dass irgendwann ein größeres GLM-Modell als Version 5.2 veröffentlicht wird. Dass es sich dabei genau um ein „5.5 mit 1T+ im August 2026“ handeln wird, ist hingegen eine konkrete Vorhersage, die durch keine offizielle Quelle gestützt wird. Daher halten wir den Termin August 2026 bis zum Beweis des Gegenteils für nicht verlässlich.

#Ein „1T+“-Modell: wirklich lokal installierbar?

Angenommen, ein spektakulärer Szenario – ein GLM-5.5 mit über einem Trillionen Parametern, veröffentlicht in Open-Weights. Eine praktische Frage stellt sich sofort: Könnte man ihn überhaupt lokal ausführen? Die Antwort hängt vollständig von der Architektur ab und mildert den Enthusiasmus ab.

Dichtes Modell mit 1T+ Parametern
Für den lokalen Betrieb auf Consumer-Hardware undenkbar. Keine Grafikkarte für den Heimgebrauch und nicht einmal eine leistungsstarke Workstation kann ein dichtes Modell dieser Größe laden. Das wäre ein Rechenzentrumsmodell, das mit Cloud-Angeboten zu vergleichen wäre, nicht mit Self-Hosting.
1T+ in MoE
Realistischer. Wie bei GLM-5.2 (753B MoE) oder den großen DeepSeek-Modellen ist pro Token nur ein Bruchteil der Experten aktiv. Mit sehr aggressiver Quantisierung (2 Bit) gelingt das einigen bereits auf Macs mit 256 GB vereinheitlichtem Speicher oder Multi-GPU-Systemen – allerdings bei bescheidenen Geschwindigkeiten.
Eine hilfreiche Erinnerung zum VRAM
Zur Orientierung anhand überschaubarer Modellgrößen in Q4_K_M: Ein 32B benötigt etwa 19 GB VRAM, ein 70B etwa 40 GB. Ein Modell mit 1T+ Parametern gehört selbst als MoE und mit starker Quantisierung zu einer Kategorie, die insgesamt Hunderte von GB Speicher erfordert.
!
„Open weights“ bedeutet nicht „ausführbar auf Ihrem Gerät“
Das ist die Lehre aus den jüngsten sehr großen Modellen: Selbst unter einer freien Lizenz veröffentlichte Modellgewichte können die Möglichkeiten von Consumer-Hardware übersteigen. Falls GLM-5.5 mit 1T+ erscheint, rechnen Sie damit, dass die eigentliche Frage nicht „Welcher Ollama-Tag?“ lautet, sondern „Welcher Rechner kann es überhaupt laden?“ – und für die meisten Leser wird die ehrliche Antwort sein: keiner der Rechner, die sie besitzen.

#Am Tag der Veröffentlichung selbst überprüfen

Das beste Mittel gegen Gerüchte ist, selbst überprüfen zu können, was stimmt. Wenn „GLM-5.5“ wieder auftaucht, verlassen Sie sich nicht auf Artikel: Gehen Sie zur Quelle. Hier sind die beiden Befehle, die in zehn Sekunden klären, ob es sich um eine tatsächliche Veröffentlichung oder nur um ein weiteres Gerücht handelt.

Auf Hugging Face prüfen
pip install -U "huggingface_hub[cli]"

# Lister les dépôts de l'organisation Zhipu contenant "5.5"
huggingface-cli repo list zai-org --limit 200 | grep -i "5.5"

# Tant que cette commande ne renvoie rien, il n'y a pas de poids officiels.

Bei Ollama gilt dieselbe Logik: Ein tatsächlich veröffentlichtes Modell erscheint in der Registry mit direkt nutzbaren Quantisierungs-Tags. Kein Suchergebnis bedeutet, dass kein Modell vorhanden ist, ganz gleich, was die kursierenden Screenshots suggerieren.

In Ollama prüfen
# Le daemon répond ? (port 11434 par défaut)
curl http://localhost:11434/api/tags

# Tenter de récupérer le modèle : si le tag n'existe pas,
# Ollama renvoie une erreur "model not found".
ollama pull glm-5.5   # échoue tant que rien n'est publié
→
Drei Anzeichen für eine echte Veröffentlichung
Eine authentische Veröffentlichung erfüllt fast immer diese Kriterien: (1) ein Repository auf dem offiziellen Hugging-Face-Konto des Herausgebers mit einer datierten Modellkarte; (2) eine ausdrücklich angegebene Lizenz (MIT, Apache 2.0 …); (3) tatsächlich herunterladbare Modellgewichte. Wenn eines dieser drei Kriterien fehlt, bleiben Sie vorsichtig.

#Soll man auf GLM-5.5 warten, um zu beginnen?

Bei einem verlockenden Gerücht ist die Versuchung groß, das eigene Projekt aufzuschieben, „für den Fall“, dass in wenigen Wochen ein deutlich besseres Modell erscheint. Das ist fast immer eine schlechte Idee, aus einem einfachen Grund: Bei lokaler KI kommt im nächsten Monat immer ein besseres Modell. Auf das nächste zu warten bedeutet, niemals anzufangen.

Wenn Sie GLM heute testen möchten
Installieren Sie GLM-5 (9B oder 32B) oder GLM 5.1: Die Modelle sind verfügbar und dokumentiert, und Sie sammeln damit praktische Erfahrung im Zhipu-Ökosystem. Ein späterer Wechsel zu einer möglichen Version 5.5 wird ganz einfach sein — es genügt, den Tag zu ändern.
Wenn Sie das beste installierbare Open-Weight-Modell suchen
Schauen Sie sich je nach Ihrer Hardware Qwen 3.8 27B oder Varianten von GLM-5.2 an, statt auf ein Phantommodell zu warten, dessen Größe Ihre Hardware womöglich ohnehin nicht bewältigen könnte.
Wenn Sie eine GPU kaufen möchten
Richten Sie die Dimensionierung eines Kaufs niemals nach einem noch nicht angekündigten Modell aus. Kaufen Sie für das, was heute existiert und läuft; ein hypothetisches 1T+-Modell passt ohnehin nicht in den Speicher einer Grafikkarte für den Verbrauchermarkt.

#Aktualisierung zum Release geplant

Dieser Leitfaden ist bewusst mit einem Datum versehen und wird mit der Zeit veralten. Er erfüllt einen klaren Zweck: als ehrliche Orientierung zu dienen, solange GLM-5.5 ein Gerücht bleibt, und neu geschrieben zu werden, sobald eine offizielle Tatsache bekannt wird. Hier erfahren Sie, was wir aktualisieren werden und wann.

Ab einer offiziellen Ankündigung von Zhipu
Wir werden den Abschnitt „Gerüchte“ durch die tatsächlichen technischen Daten ersetzen: genauer Name, Größe, Architektur (dicht oder MoE), Lizenz, Kontext.
Ab der Veröffentlichung der Gewichte
Wir werden den genauen Installationsbefehl (Hugging Face + Ollama-Tag), die VRAM-Anforderungen je Quantisierung und einen Verweis auf einen eigenen Installationsleitfaden ergänzen.
Wenn das Gerücht widerlegt wird oder nicht mehr aktuell ist
Wir werden dies klar und mit Datumsangabe mitteilen, statt eine falsche Vorhersage stehen zu lassen.
i
Zusammenfassung
GLM-5.5 existiert derzeit noch nicht außer als Gerücht: Analystenberichte und unbestätigte Leaks erwähnen ein Modell mit 1T+ für August 2026, ohne jegliche Bestätigung von Zhipu. Die GLM-Familie ist jedoch real und bereits einsetzbar (GLM-5, 5.1, 5.2). Prüfen Sie immer quellenbezogen, bevor Sie eine Veröffentlichung glauben – und warten Sie nicht auf ein Phantommodell, um zu beginnen.

#Weiterführende Informationen

Statt auf GLM-5.5 zu warten, ermöglichen diese Anleitungen es Ihnen, GLM zu testen und zu verstehen, was bereits jetzt tatsächlich installierbar ist:

GLM-5.2 lokal
„GLM-5.2 lokal: Der MIT-lizenzierte Riese, der wirklich läuft“ beschreibt realistische Konfigurationen, um das größte existierende GLM-Modell (753B MoE) auszuführen – ein guter Einblick in die Anforderungen, die ein künftiges, noch größeres Modell mit sich bringen würde.
GLM 5.1 lokal
„GLM 5.1 lokal: die Open-Weight-Alternative, die Sie kennen sollten“ behandelt die Installation, den VRAM-Bedarf je nach Quantisierung und die Positionierung gegenüber Qwen und Llama auf Consumer-Hardware.
Quantisierung wählen
„Die passende Quantisierung wählen (Q4, Q5, Q8, FP16)“ erklärt den Kompromiss zwischen Qualität und Speicherbedarf – unverzichtbar, um zu verstehen, warum ein Modell mit 1T+ ohne extreme Quantisierung außer Reichweite bleibt.
Hat Ihnen dieser Guide geholfen?

Haben Sie Feedback, einen Fehler entdeckt oder möchten Sie etwas präzisieren? Geben Sie uns Bescheid – so wird der Guide für alle besser.