Alle Modelle

GLM 5.1 von Z.ai

GLM 5.1 ist ein großes Sprachmodell der chinesischen Firma Z.ai. Es verarbeitet ausschließlich Text, keine Bilder, und nimmt pro Anfrage rund 200.000 Token entgegen. Ein Token ist ungefähr ein halbes Wort, 200.000 Token sind also grob mehrere hundert Seiten. Die Gewichte, also die trainierte Modelldatei, liegen seit dem 3. April 2026 unter MIT-Lizenz öffentlich auf Hugging Face. Jeder darf sie herunterladen, verändern, weitergeben und kommerziell einsetzen.

Bei lowcloud ist GLM 5.1 eines von 14 Modellen, die über Server in der EU laufen. Du wählst es im Chat pro Nachricht, fest für einen Agenten oder für einen einzelnen Schritt eines Ablaufs. Die Anfrage geht dabei nicht an Z.ai in China, sondern über die Melious AI GmbH in Saarbrücken an Rechenzentren in der EU. Eins vorweg: GLM 5.1 ist zwei Generationen alt. Für die meisten Aufgaben ist heute GLM 5.3 oder GLM 5.2 die bessere Wahl. Es gibt genau einen Grund, trotzdem GLM 5.1 zu nehmen, und der steht weiter unten.

Hersteller
Z.ai, China
Kontextfenster
200k Token
Bilder lesen
nein
Lizenz
MIT
Verarbeitung
EU-Server über Melious

Woher GLM 5.1 kommt

Hersteller ist Z.ai, eine KI-Firma aus China. Das Modell gehört zur GLM-5-Reihe. Die Gewichte erschienen am 3. April 2026 auf Hugging Face. Ein offizielles Ankündigungsdatum nennt Z.ai in seiner Dokumentation nicht, das Datum auf Hugging Face ist der früheste belegbare Zeitpunkt. Die Lizenz ist MIT. Das ist eine der freizügigsten Lizenzen überhaupt: Download, Veränderung, Weitergabe und kommerzielle Nutzung sind erlaubt, nennenswerte Auflagen gibt es nicht. Bei GLM 5.1 ist die verbreitete Bezeichnung "Open Source" also zutreffend. Bei anderen Modellen derselben Reihe ist sie es nicht: Der Nachfolger GLM 5.3 steht unter einer eigenen Lizenz von Z.ai, nicht unter MIT. Technisch ist GLM 5.1 ein Mixture-of-Experts-Modell, kurz MoE. Das heißt: Das Modell besteht aus vielen Teilblöcken, und für jedes einzelne Token wird nur ein kleiner Teil davon benutzt. Insgesamt hat GLM 5.1 rund 754 Milliarden Parameter, das sind die trainierten Zahlenwerte im Modell. Pro Token laufen davon 8 von 256 Expertenblöcken plus ein fester Block. Deshalb ist der Betrieb günstiger, als die Gesamtgröße vermuten lässt. Diese Angaben stehen in der Konfigurationsdatei der Gewichte auf Hugging Face.

Zwei Generationen alt: was das heißt

Nach GLM 5.1 kamen GLM 5.2 (Gewichte seit Juni 2026) und GLM 5.3 (Gewichte seit August 2026). Beide fassen laut lowcloud-Katalog 1 Million Token statt 200.000. Die Nutzung von GLM 5.1 liegt bei rund 2,6 Prozent der Nutzung von GLM 5.2. Das Modell ist damit praktisch abgelöst. Wenn du heute einen Agenten neu baust, nimm GLM 5.3 oder GLM 5.2. Sie sind neuer, haben ein größeres Kontextfenster und werden von Z.ai weiterentwickelt. Diese Seite ist keine Empfehlung für GLM 5.1. Sie beschreibt, was das Modell ist und in welchem einen Fall es noch die richtige Wahl sein kann.

Was "auf EU-Servern" konkret heißt

Die Kette ist: du, dann lowcloud UG in Bielefeld, dann Melious AI GmbH in Saarbrücken, dann Rechenzentren in der EU. Melious betreibt keine eigenen Rechenzentren, sondern verteilt die Anfragen auf europäische Betreiber. Deine Anfrage geht nicht an Z.ai und nicht an einen Server in China. Das Modell ist chinesisch, der Betrieb ist es nicht. Was wir nicht wissen und deshalb auch nicht behaupten: welcher konkrete Betreiber GLM 5.1 zu einem bestimmten Zeitpunkt bedient. Melious veröffentlicht die Zuordnung von Modell zu Rechenzentrum nicht. Wenn dein Kunde diese Angabe braucht, frag uns, bevor du sie zusagst.

Wofür GLM 5.1 im Baukasten taugt

Der eine Grund für GLM 5.1 sind feste JSON-Schemas. Ein festes JSON-Schema heißt: Du gibst dem Modell vorher genau vor, welche Felder die Antwort haben muss, zum Beispiel Lieferant, Betrag und Datum, und bekommst die Antwort verlässlich in dieser Form zurück. Das brauchst du überall dort, wo die Antwort direkt weiter in ein anderes System läuft, etwa ins CRM, in die Buchhaltung, in eine Datenbank oder in eine Tabelle. Wir haben das selbst gegen die API geprobt und nicht von der Herstellerseite abgeschrieben: GLM 5.1 nimmt feste JSON-Schemas an. Die Nachfolger GLM 5.2 und GLM 5.3 tun das in unseren Tests nicht, obwohl die Dokumentation von Z.ai für beide "Structured Output" auflistet. Das ist unsere eigene Beobachtung. Uns ist keine andere Stelle bekannt, die das veröffentlicht. Innerhalb der GLM-Reihe ist GLM 5.1 damit das Modell für Schritte, die ein festes Antwortformat brauchen. Dazu kommt: 200.000 Token reichen für lange Dokumente, Verträge oder ganze Mailverläufe in einem Durchgang. Für reine Textarbeit ist das Modell brauchbar, also zusammenfassen, einsortieren, einzelne Felder herausziehen, Text umschreiben.

Wofür GLM 5.1 nicht taugt

Bilder kann GLM 5.1 nicht lesen. Nicht schlecht, sondern gar nicht: Das Modell nimmt ausschließlich Text entgegen. Das steht so in der Dokumentation von Z.ai und lässt sich an der Konfigurationsdatei der Gewichte nachvollziehen, die keinerlei Bildteil enthält. Gescannte Rechnungen, Screenshots, Fotos und Formulare, die als Bild im PDF liegen, gehen also nicht. Aus dem EU-Katalog lesen diese Modelle Bilder: GLM 5.3 Flash, Kimi K3, Kimi K2.7 Code, Kimi K2.6, Qwen 3.8 27B und Mistral Small 4. Wenn du Bildverstehen und feste JSON-Schemas zusammen brauchst, ist Kimi K2.6 im EU-Katalog das einzige Modell, das beides kann. Für sehr lange Eingaben reicht GLM 5.1 nicht: 200.000 Token sind deutlich weniger als bei GLM 5.2, GLM 5.3, Kimi K3 und DeepSeek V4 Pro mit je 1 Million. Und für alles, was einfach aktuell und allgemein gut sein soll, ist GLM 5.1 schlicht das ältere Modell. Nimm dann den Nachfolger.

Was GLM 5.1 kostet

Preise nennen wir auf der Website nicht. Auf den Einkaufspreis kommt ein Aufschlag, jede hier veröffentlichte Zahl wäre also falsch. Die Einordnung: GLM 5.1 liegt im EU-Katalog preislich in der Mitte. Es ist weder das günstigste noch das teuerste der 14 Modelle. Den tatsächlichen Betrag siehst du in Euro an jedem einzelnen Lauf in der App. Das gilt für alle Modelle gleich, du kannst also vor der Entscheidung zwei Modelle laufen lassen und die Beträge vergleichen. Um ein Modell gezielt auszuwählen, brauchst du ein Konto. Ohne Konto kannst du auf agent.lowcloud.de einen Ablauf bauen lassen, dabei wählt lowcloud das Modell. Die Modellwahl kommt mit dem kostenlosen Konto.

GLM 5.1 ausprobieren

Für die Modellwahl brauchst du ein kostenloses Konto. Danach wählst du GLM 5.1 im Chat, pro Agent oder pro Schritt.

Häufige Fragen

Ist GLM 5.1 Open Source?

Ja, im engen Sinn. Die Gewichte stehen unter MIT-Lizenz auf Hugging Face. Jeder darf sie herunterladen, verändern und kommerziell einsetzen. Trainingsdaten und Trainingscode gehören nicht dazu, das ist bei fast allen sogenannten offenen Modellen so. Bei lowcloud nutzt du GLM 5.1 nicht als Download, sondern als Dienst über Server in der EU.

Gehen meine Daten nach China?

Nein. Das Modell kommt aus China, die Verarbeitung nicht. Deine Anfrage läuft von lowcloud in Bielefeld über die Melious AI GmbH in Saarbrücken an Rechenzentren in der EU. Z.ai sieht die Anfrage nicht und ist an der Verarbeitung nicht beteiligt. Was wir nicht sagen können: welcher europäische Betreiber den einzelnen Lauf ausführt. Diese Zuordnung veröffentlicht Melious nicht.

Kann GLM 5.1 Bilder oder gescannte PDFs lesen?

Nein, GLM 5.1 verarbeitet nur Text. Für Bilder, Screenshots und gescannte Dokumente nimm aus dem EU-Katalog GLM 5.3 Flash, Kimi K3, Kimi K2.7 Code, Kimi K2.6, Qwen 3.8 27B oder Mistral Small 4.

GLM 5.1 oder GLM 5.2 beziehungsweise GLM 5.3?

Für neue Agenten GLM 5.3 oder GLM 5.2. Sie sind neuer und fassen 1 Million Token statt 200.000. GLM 5.1 nur dann, wenn dein Schritt ein festes JSON-Schema braucht: Das nehmen die beiden Nachfolger in unseren eigenen Tests nicht an, GLM 5.1 schon.

Wie groß ist das Kontextfenster von GLM 5.1?

Rund 200.000 Token für die Eingabe. Das Kontextfenster ist die Textmenge, die das Modell in einer Anfrage gleichzeitig sehen kann, also Frage, Anhänge und bisheriger Verlauf zusammen. 200.000 Token sind grob mehrere hundert Seiten. In der Modelldatei steht der genaue Wert 202.752 Token.

Was kostet ein Lauf mit GLM 5.1?

Preise nennen wir hier nicht, weil auf den Einkaufspreis ein Aufschlag kommt. Im EU-Katalog liegt GLM 5.1 preislich in der Mitte. Der tatsächliche Betrag in Euro steht an jedem Lauf in der App.

GLM 5.1 ist ein Produktname von Z.ai. Zwischen lowcloud und Z.ai besteht keine Geschäftsbeziehung; wir betreiben das offen verfügbare Modell über einen europäischen Anbieter. Stand: 7. September 2026.