Alle Modelle

GLM 5 von Z.ai

GLM 5 ist ein Sprachmodell des chinesischen Anbieters Z.ai aus Peking, veroeffentlicht im Februar 2026. Der technische Bericht dazu ist am 17. Februar 2026 erschienen. Das Modell hat 744 Milliarden Parameter, von denen pro Anfrage rund 40 Milliarden rechnen, es liest ein Kontextfenster von 200.000 Token, es verarbeitet nur Text und keine Bilder, und die Gewichte stehen unter der MIT-Lizenz oeffentlich zum Download. Parameter sind die trainierten Zahlen im Modell. Token sind die Einheiten, in die Text zerlegt wird, ein Token entspricht ungefaehr einem halben bis einem ganzen Wort. Das Kontextfenster ist die Textmenge, die das Modell in einer Anfrage gleichzeitig lesen kann.

Bei lowcloud ist GLM 5 eines von 14 Modellen, die ueber die Melious AI GmbH in Saarbruecken auf Servern in der EU laufen. Die Anfrage geht dabei nicht an Z.ai. Welches Modell arbeitet, entscheidest du selbst: im Chat pro Nachricht, fest fuer einen Agenten oder fuer einen einzelnen Schritt eines Ablaufs. GLM 5 ist die aelteste GLM-Version im lowcloud-Katalog. Z.ai hat seitdem GLM 5.1, GLM 5.2, GLM 5.3 und GLM 5.3 Flash nachgelegt. Fuer neue Agenten gibt es nur noch wenige Gruende, GLM 5 zu waehlen. Welche das sind, steht weiter unten.

Hersteller
Z.ai, China
Kontextfenster
200k Token
Bilder lesen
nein
Lizenz
MIT
Verarbeitung
EU-Server über Melious

Woher GLM 5 kommt

Hersteller ist Z.ai, ein Unternehmen aus Peking, China. Das Modell wurde im Februar 2026 veroeffentlicht. Die Bauweise ist ein Mixture of Experts, kurz MoE. Das Modell ist dabei in viele Teilbereiche zerlegt und schaltet pro Anfrage nur einen kleinen Teil davon ein: 40 von 744 Milliarden Parametern. Das senkt die Rechenkosten. Fuer die Nutzung im Baukasten aendert es nichts, du merkst davon nichts. Die Lizenz ist MIT. Das ist eine echte Open-Source-Lizenz ohne Auflagen zur Nutzungsart und ohne Einschraenkung auf bestimmte Kundengruppen oder Umsatzgroessen. Die Gewichte liegen oeffentlich auf Hugging Face unter zai-org/GLM-5, jeder kann sie herunterladen und das Modell selbst betreiben. Das ist erwaehnenswert, weil es bei den neueren GLM-Versionen nicht mehr so ist. GLM 5.3 steht auf Hugging Face unter einer eigenen Lizenz von Z.ai mit dem Namen glm-5.3, nicht unter MIT. Wer bei einem Kunden begruenden muss, dass ein Modell wirklich frei lizenziert ist, hat diese Begruendung bei GLM 5 und bei GLM 5.3 nicht.

GLM 5 ist abgeloest

Z.ai hat nach GLM 5 vier weitere Versionen veroeffentlicht: GLM 5.1, GLM 5.2, GLM 5.3 und GLM 5.3 Flash. Alle vier sind bei lowcloud ebenfalls verfuegbar. Die aktuelle Version ist GLM 5.3. Der sichtbarste Unterschied ist das Kontextfenster. GLM 5 liegt bei 200.000 Token, GLM 5.2 und GLM 5.3 bei einer Million. Das ist der Unterschied zwischen einem laengeren Vertrag und einem kompletten Aktenordner in einer Anfrage. Es bleiben zwei Faelle, in denen GLM 5 weiter Sinn ergibt. Erstens: ein bestehender Agent laeuft damit und liefert, was er soll. Dann gibt es keinen Grund, an einem laufenden Ablauf zu drehen. Zweitens: du brauchst feste JSON-Schemas. Ein JSON-Schema ist eine Vorlage, die genau festlegt, welche Felder die Antwort enthalten muss und welchen Typ jedes Feld hat. GLM 5 nimmt solche Vorlagen an, GLM 5.2 und GLM 5.3 laut lowcloud-Katalog nicht. Innerhalb der GLM-Reihe bleiben dafuer GLM 5 und GLM 5.1.

Was "laeuft auf EU-Servern" hier konkret heisst

Die Kette ist kurz und hat drei Stationen. Deine Anfrage geht an die lowcloud UG in Bielefeld. Von dort geht sie an die Melious AI GmbH in Saarbruecken. Melious gibt sie an ein Rechenzentrum in der EU weiter, in dem GLM 5 laeuft. Z.ai ist an dieser Kette nicht beteiligt. Das Modell wurde in China entwickelt und trainiert. Die Kopie, die deine Anfrage bearbeitet, laeuft in Europa. Der Hersteller sieht die Anfrage nicht. Melious betreibt keine eigenen Rechenzentren, sondern verteilt die Last auf europaeische Betreiber. Welcher Betreiber ein bestimmtes Modell bedient, veroeffentlicht Melious nicht. lowcloud weiss es also auch nicht und kann es dir nicht sagen. Wenn ein Kunde den konkreten Standort im Vertrag braucht, ist das die Grenze der Auskunft, die du geben kannst.

Wofuer GLM 5 im Baukasten taugt

Textarbeit mit festem Ausgabeformat. GLM 5 nimmt feste JSON-Schemas an, die Antwort kommt also in der Struktur zurueck, die du vorgibst. Das ist der Fall, der zaehlt, wenn ein spaeterer Schritt im Ablauf mit den Daten weiterarbeitet: Felder aus einer E-Mail ziehen und in ein CRM schreiben, Positionen aus einem Rechnungstext in eine Tabelle uebertragen, Anfragen nach festen Kategorien sortieren. Ohne Schema muss der naechste Schritt raten, mit Schema nicht. lowcloud hat das selbst gegen die API geprobt und nicht von der Herstellerseite abgeschrieben. Das Ergebnis deckt sich hier mit der Angabe von Z.ai: feste Schemas werden angenommen. Dokumente bis rund 200.000 Token. Das reicht fuer lange Vertraege, Handbuecher oder ein Konvolut aus mehreren Dateien in einer Anfrage. Schritte, die stabil laufen sollen und keine neuen Faehigkeiten brauchen. Ein Agent, der seit Monaten mit GLM 5 arbeitet, wird durch einen Modellwechsel nicht automatisch besser, aber er muss neu getestet werden.

Wofuer GLM 5 nicht taugt

Bilder. GLM 5 liest keine. Screenshots, fotografierte Lieferscheine, gescannte Formulare, Produktfotos: alles Faelle fuer ein anderes Modell. lowcloud hat auch das gegen die API geprobt, das Ergebnis deckt sich mit der Angabe von Z.ai. Wenn du Bilder lesen und gleichzeitig feste JSON-Schemas brauchst, ist Kimi K2.6 im EU-Katalog das einzige Modell, das beides kann. Wenn nur das Bild zaehlt und das Format frei bleiben darf, kommen GLM 5.3 Flash, Mistral Small 4, Qwen 3.8 27B, Kimi K3 und Kimi K2.7 Code in Frage. Sehr lange Eingaben. Ab etwa 200.000 Token ist Schluss. Fuer eine Million Token stehen GLM 5.2, GLM 5.3, Kimi K3 und DeepSeek V4 Pro bereit. Aufgaben, bei denen du den aktuellen Stand willst. Bei Programmieraufgaben und langen mehrstufigen Ablaeufen ist GLM 5.3 die neuere Arbeit desselben Herstellers. Belastbare Vergleichszahlen dazu veroeffentlicht lowcloud nicht, herstellereigene Benchmarks sind keine unabhaengige Messung.

Was GLM 5 kostet

lowcloud veroeffentlicht keine Token-Preise. Der Grund ist einfach: auf den Einkaufspreis kommt ein Aufschlag, eine hier genannte Zahl waere also falsch. Im EU-Katalog liegt GLM 5 in der guenstigen Mitte. Es ist nicht das billigste der 14 Modelle und nicht das teuerste. Was ein Lauf tatsaechlich gekostet hat, steht in Euro an jedem einzelnen Lauf in der App. Das ist die Zahl, mit der du gegenueber deinem Kunden rechnest, nicht eine Listenangabe von einer Website. Zum Ausprobieren: auf agent.lowcloud.de kannst du dir ohne Konto einen Ablauf bauen lassen, dabei waehlt lowcloud das Modell. Die freie Modellwahl, also auch GLM 5, kommt mit dem kostenlosen Konto.

GLM 5 ausprobieren

Für die Modellwahl brauchst du ein kostenloses Konto. Danach wählst du GLM 5 im Chat, pro Agent oder pro Schritt.

Häufige Fragen

Gehen meine Daten nach China, wenn ich GLM 5 nutze?

Nein. Deine Anfrage geht an die lowcloud UG in Bielefeld, von dort an die Melious AI GmbH in Saarbruecken und von dort an ein Rechenzentrum in der EU. Z.ai bekommt die Anfrage nicht zu sehen. Das Modell stammt aus China, betrieben wird es fuer dich in Europa. Was lowcloud nicht sagen kann: welcher europaeische Betreiber genau das Modell bedient. Melious veroeffentlicht das nicht.

Ist GLM 5 Open Source?

Ja. Die Gewichte stehen unter der MIT-Lizenz auf Hugging Face unter zai-org/GLM-5. MIT stellt keine Bedingungen an die Art der Nutzung. Achtung bei Uebersichtsseiten, die das pauschal fuer die ganze GLM-Reihe behaupten: GLM 5.3 steht unter einer eigenen Lizenz von Z.ai, nicht unter MIT.

Kann GLM 5 Bilder lesen?

Nein. GLM 5 verarbeitet nur Text. lowcloud hat das gegen die API geprobt, nicht nur von der Herstellerseite uebernommen. Fuer Bilder plus festes JSON-Schema ist Kimi K2.6 im EU-Katalog die einzige Wahl. Geht es nur um das Bild, kommen auch GLM 5.3 Flash, Mistral Small 4, Qwen 3.8 27B, Kimi K3 und Kimi K2.7 Code in Frage.

Wie gross ist das Kontextfenster von GLM 5?

200.000 Token laut lowcloud-Katalog, das deckt sich mit der Dokumentation von Z.ai. Das sind grob 150.000 Woerter in einer Anfrage. Reicht das nicht, bieten GLM 5.2, GLM 5.3, Kimi K3 und DeepSeek V4 Pro eine Million Token.

GLM 5 oder GLM 5.3 - was soll ich nehmen?

Fuer neue Agenten in den meisten Faellen GLM 5.3: neuer, groesseres Kontextfenster. GLM 5 nur dann, wenn du feste JSON-Schemas brauchst, denn die nimmt GLM 5.3 laut Katalog nicht an, oder wenn ein bestehender Agent bereits stabil mit GLM 5 laeuft. Beide lesen keine Bilder.

Was kostet ein Lauf mit GLM 5?

lowcloud nennt keine Token-Preise, weil auf den Einkaufspreis ein Aufschlag kommt und eine veroeffentlichte Zahl damit falsch waere. Im EU-Katalog liegt GLM 5 in der guenstigen Mitte. Die tatsaechlichen Kosten in Euro stehen an jedem Lauf in der App.

GLM 5 ist ein Produktname von Z.ai. Zwischen lowcloud und Z.ai besteht keine Geschäftsbeziehung; wir betreiben das offen verfügbare Modell über einen europäischen Anbieter. Stand: 7. September 2026.