Hast du dieses Tool genutzt? Bewerte es
Hast du dieses Tool genutzt? Bewerte es
Z.ai Chat ist der GLM-Chatbot aus erster Hand — die offizielle Chat-Oberfläche der GLM-Familie großer Sprachmodelle. Diese Unterscheidung wiegt schwerer, als es zunächst scheint, denn die meisten Seiten, die sich als „kostenlose ChatGPT-Alternative" ausgeben, sind Wiederverkäufer, die fremde APIs umhüllen. Hier ist das anders: Betreiber ist das Unternehmen, das die Modelle selbst baut, und die Startseite benennt den Zweck unumwunden — ein KI-Assistent auf GLM-Basis, mit dem sich Websites bauen, Code schreiben, langlaufende Aufgaben bewältigen und sofort Antworten holen lassen.
Das Firmenbild hat drei Schichten, die es zu entwirren lohnt, weil jede an anderer Stelle auftaucht. Die öffentliche Marke ist Z.ai. VentureBeat identifiziert das Unternehmen in seiner unabhängigen Berichterstattung zur GLM-5.2-Veröffentlichung als „chinesisches KI-Start-up Z.ai (vormals Zhipu AI)" — Z.ai ist also die international auftretende Identität jener Organisation, die früher als Zhipu bekannt war. Vertragspartner und datenschutzrechtlich Verantwortlicher ist jedoch keiner dieser beiden Namen: Die Nutzungsbedingungen definieren Z.ai als die von JINGSHENG HENGXING TECHNOLOGY PTE.LTD betriebene Plattform, einer im International Plaza eingetragenen Gesellschaft in Singapur, und die Datenschutzerklärung benennt dieselbe Einheit als Verantwortlichen für die Verarbeitung deiner personenbezogenen Daten. Wer Zuständigkeit oder Datenverwaltung prüft, muss rechtlich auf die singapurische Gesellschaft schauen.
Was dieses Produkt aus dem dichten Feld kostenloser Chat-Assistenten heraushebt, sind die weitgehend offenen Gewichte der zugrunde liegenden Modelle. VentureBeat bestätigt, dass die Kerngewichte von GLM-5.2 unter einer uneingeschränkten MIT-Open-Source-Lizenz veröffentlicht wurden und sich von Hugging Face für lokales Feintuning und Eigenbetrieb herunterladen lassen. Die Chat-Oberfläche ist damit eine bequeme Vordertür zu einem Modell, das man im Prinzip auch selbst betreiben könnte. Das können nur sehr wenige kostenlose Assistenten von sich sagen.
Eine Klarstellung vorweg, weil sie die häufigste Verwechslungsquelle ist: Z.ai betreibt zwei kommerzielle Stränge, die sich leicht vermengen lassen. Die Chat-Oberfläche unter chat.z.ai ist das kostenlose Endkundenprodukt. Davon getrennt existiert eine kostenpflichtige Entwicklerplattform — eine token-basiert abgerechnete API und ein abonnementbasierter GLM Coding Plan ab 18 US-Dollar im Monat. Preisangaben in diesem Text sind nach Strang gekennzeichnet, denn die API-Preisliste sagt nichts darüber aus, was die Nutzung des Chatfensters kostet.
Statt ein undurchsichtiges „bestes Modell" vorzusetzen, legt Z.ai die ganze Familie offen und lässt wählen. Die offizielle Dokumentation benennt die aktuellen Rollen klar: GLM-5.3 gilt als jüngstes Flaggschiff mit umfassenden Fortschritten in Softwareentwicklung und Agentenfähigkeiten; GLM-5V-Turbo ist ein multimodales Coding-Modell mit Schwerpunkt visuelle Programmierung; GLM-Image erzeugt Bilder aus Text und beansprucht Open-Source-Spitzenniveau bei komplexen Szenen; CogVideoX-3 übernimmt die Videoerzeugung.
Die Oberfläche trägt oben einen Modellwähler, sodass Umschalten ein einzelner Klick ist und keine Grabung in den Einstellungen. Das zählt mehr, als es klingt: Ein leichteres Modell antwortet oft schneller und genügt für Routinefragen vollauf, und bewusst eine Stufe tiefer gehen zu können, ist ein echter Bedienvorteil.
Der Produkttitel selbst stellt „Chatbot" neben „Agent", und die Fähigkeitsliste beginnt mit langlaufenden Aufgaben. Auf dieser Achse hat das Unternehmen am sichtbarsten investiert. Die unabhängige Berichterstattung von VentureBeat beschreibt GLM-5.2 als ein Modell, das eigens dafür entwickelt wurde, langlaufende autonome Coding- und Engineering-Aufgaben zu dominieren, und berichtet Benchmark-Ergebnisse genau auf dieser Achse — 62,1 bei SWE-bench Pro gegenüber 58,6 für GPT-5.5 und 74,4 % bei FrontierSWE, einem Benchmark, der die Bewältigung langlaufender Aufgaben prüfen soll.
Abonnenten erhalten eine zusätzliche Werkzeugschicht. Der GLM Coding Plan gewährt exklusiven MCP-Zugriff auf Vision Understanding, Web Search, Web Reader und Zread — jene Fähigkeiten, mit denen ein Modell nachschlagen und Seiten lesen kann, statt allein aus Parametern zu antworten.
VentureBeats Bericht schreibt GLM-5.2 ein bemerkenswert stabiles Kontextfenster von einer Million Token zu. Bemerkenswert ist, dass dies keine bloße Schlagzeilenzahl bleibt: Dieselbe Berichterstattung beschreibt eine architektonische Optimierung namens IndexShare, die denselben Indexer über je vier spärliche Attention-Schichten wiederverwendet und dadurch den Rechenaufwand pro Token bei maximaler Kontextlänge um etwa das 2,9-Fache senkt. Ein derart langer Kontext ist hier also so konstruiert, dass er wirtschaftlich nutzbar ist, statt nur nominell zur Verfügung zu stehen.
Code zu schreiben ist hier keine Nebenfähigkeit — das Produkt positioniert sich ebenso als Coding-Agent wie als Gesprächsassistent. Die Oberfläche enthält neben dem Modellwähler einen eigenen ZCode-Einstieg, und das Abonnementprodukt ist ausdrücklich um Entwicklungsarbeit herum gebaut. Laut offizieller Dokumentation lässt sich der GLM Coding Plan auf Werkzeuge wie Claude Code, Cline und OpenCode anwenden und unterstützt natürlichsprachliches Programmieren — Anforderungen im Klartext beschreiben, um Pläne zu erzeugen, Code zu schreiben und Fehler zu beheben — sowie kontextbewusste Code-Vervollständigung in Echtzeit.
Die Oberfläche platziert direkt unter dem Eingabefeld fünf Aufgaben-Kurzbefehle: Landingpages, Wissenschaftserklärungen und Unterrichtsentwürfe, 3D-Modellierung, kleine Spiele und persönliche Blogs. Das ist eher Einstiegsgerüst als eigenständige Funktion, aber gut gewählt: Jeder Punkt steht für eine Aufgabe, an deren Ende etwas Fertiges steht, statt für reines Frage-Antwort-Spiel, was neue Nutzende zur eigentlichen Stärke des Produkts lenkt.
Die Plattform beschreibt sich als auf chinesisch- und englischsprachige Nutzende zugeschnitten, und die gerenderte Oberfläche bestätigt das: englische Bedienelemente mischen sich mit chinesischen Begrüßungen und Kurzbefehlen. Wer zwischen diesen beiden Sprachen arbeitet, findet in einem Modell, das Chinesisch in Training und Produktgestaltung als erstklassige Sprache und nicht als nachträgliche Ergänzung behandelt, einen bedeutsamen Unterschied.
Für alle, die auf den Modellen aufbauen statt mit ihnen zu plaudern, zeichnet die Dokumentation einen kompletten Weg: eine standardisierte RESTful-HTTP-API, kompatibel mit allen Programmiersprachen, offizielle Python- und Java-SDKs sowie OpenAI-SDK-Kompatibilität für den schnellen Wechsel von OpenAI. Der Endpunkt lautet api.z.ai/api/paas/v4/chat/completions, und die OpenAI-kompatible Form bedeutet, dass eine bestehende Integration oft nur Basis-URL und Schlüssel tauschen muss.
Der am besten belegte Anwendungsfall. Zwischen der ZCode-Oberfläche, der Anbindung an Drittwerkzeuge und Benchmark-Leistungen mit Schwerpunkt auf SWE-bench Pro und FrontierSWE zielt das Produkt genau hierhin, und hier sind die unabhängigen Belege am stärksten.
Ein unterschätzter Ablauf, den es nur bei Anbietern mit offenen Gewichten gibt. Da GLM-Gewichte unter MIT herunterladbar sind, können Teams, die Eigenbetrieb erwägen, die kostenlose Chat-Oberfläche nutzen, um das Verhalten des Modells an ihren tatsächlichen Problemen zu prüfen, bevor sie Infrastruktur binden. Das Chatfenster wird zum Prüfstand ohne Kosten.
Die veröffentlichten API-Sätze setzen GLM-4.7 bei 0,6 US-Dollar je Million Eingabe-Token und 2,2 US-Dollar in der Ausgabe an, mehrere Flash-Stufen sind mit null ausgewiesen. Für hohe Volumina geringer Komplexität — Klassifikation, Extraktion, Routine-Zusammenfassungen — verschiebt diese Preisgestaltung, was wirtschaftlich überhaupt tragfähig ist.
Mit Web Search und Web Reader als Werkzeugen kann der Assistent Antworten in abgerufenen Seiten verankern statt allein im parametrischen Gedächtnis. Nützlich für tagesaktuelle Fragen und das Sichten von Literatur, mit dem üblichen Vorbehalt: Abruf verringert Erfindungen, beseitigt sie aber nicht.
Die chinesisch-englische Ausrichtung macht das Werkzeug zur praktischen Wahl für Übersetzung, sprachübergreifendes Entwerfen und Lokalisierungsprüfung — Aufgaben, bei denen überwiegend auf englischen Daten trainierte Modelle oft technisch korrektes, im Ton aber schiefes Chinesisch liefern.
Entwerfen, Umformulieren, Erklären, Ideen sammeln. Die unglamouröse Mehrheit der Assistenznutzung, kompetent und kostenfrei erledigt.
Rufe chat.z.ai auf. Die Oberfläche zeigt ein Eingabefeld, einen Modellwähler und die fünf Aufgaben-Kurzbefehle. Mit einem Kurzbefehl zu beginnen ist ein vernünftiger erster Zug: Sie führen die „etwas bauen"-Ausrichtung des Produkts schneller vor als eine offene Frage.
Nutze den Modellwähler, statt die Voreinstellung hinzunehmen. Für eine schnelle Faktenfrage antwortet ein leichteres Modell zügiger; für eine mehrstufige Coding-Aufgabe wähle das Flaggschiff. Sich anzugewöhnen, Modell und Aufgabe aufeinander abzustimmen, bringt den größten Qualitätsgewinn pro Sekunde.
Das Produkt ist auf ausgedehnte autonome Arbeit optimiert. Statt eine Reihe kleiner Fragen zu stellen, beschreibe das vollständige Ziel, die Randbedingungen und wie ein fertiges Ergebnis aussieht. Das spielt mit der Architektur statt gegen sie.
Für alles Zeitkritische oder extern Überprüfbare nutze Websuche und Leseleistung statt der Trainingsdaten des Modells. Das parametrische Wissen jedes Modells hat einen Stichtag; Abruf ist der Weg darum herum.
Die Oberfläche trägt einen dauerhaften Hinweis, dass sämtliche Inhalte KI-erzeugt und nur als Anhaltspunkt gedacht sind. Behandle das als geltende Handlungsanweisung, nicht als juristische Floskel — besonders bei Code, Zahlen und Quellenangaben.
Wer das Chatfenster als Arbeitsablauf und nicht als Kuriosität nutzt, findet zwei kostenpflichtige Wege. Die API rechnet token-basiert für die programmatische Anbindung ab; der GLM Coding Plan ist ein Abonnement für den Einsatz in Claude Code, Cline und ähnlichen Werkzeugen. Lies vor der Wahl die Kontingentmechanik im Abschnitt zu den Einschränkungen.
Der praktischste und am wenigsten beworbene Hinweis. Die Dokumentation hält fest, dass die Modellnutzung außerhalb der Stoßzeiten mit 50 % des Standard-Kreditsatzes berechnet wird, wobei Stoßzeiten als Montag bis Freitag von 14:00 bis 18:00 Uhr Singapur-Standardzeit definiert sind. Verlagert man Stapelverarbeitung aus diesem vierstündigen Werktagsfenster, verdoppelt sich das effektive Kontingent buchstäblich. Keine Drittbesprechung dieses Produkts erwähnt das.
Das Abonnementkontingent wird in Krediten geführt, berechnet aus Eingabe-Token mal Eingabefaktor plus zwischengespeicherte Eingabe mal deren Faktor plus Ausgabe-Token mal Ausgabefaktor, geteilt durch 10.000. Die Ausgabe wiegt weit schwerer als die Eingabe — bei GLM-5.3 lauten die Faktoren 6,9 für Eingabe, 1,7 für Cache und 24 für Ausgabe. Die praktische Folge: Weitschweifige Ausgaben kosten dramatisch mehr als lange Eingaben. Um knappe Antworten zu bitten ist eine Kontingentstrategie, nicht bloß eine Stilvorliebe.
Zwischengespeicherte Eingabe kostet sowohl in der API-Preisliste als auch bei den Kreditfaktoren nur einen Bruchteil frischer Eingabe. Wer immer wieder denselben Systemprompt oder dasselbe Dokument sendet, senkt die Kosten spürbar, indem er Anfragen so aufbaut, dass stabile Inhalte an einer zwischenspeicherbaren Stelle liegen.
Mehrere Modelle sind in der offiziellen Preistabelle mit null ausgewiesen. Bei hohen Stückzahlen einfacher Aufgaben auf eine kostenlose Flash-Stufe zu leiten und das Flaggschiff für wirklich harte Probleme zu reservieren, ist schlichte Betriebswirtschaft.
Die Verfügbarkeit unterscheidet sich je Strang. VentureBeat berichtete, GLM-5.3 sei zunächst nur über den GLM Coding Plan und die ZCode-Umgebung zugänglich gewesen, API-Zugang und offene Gewichte folgten später. Prüfe, welche Oberfläche das gewünschte Modell bereitstellt, bevor du darum herum planst.
Steht Eigenbetrieb zur Debatte, nutze die kostenlose Oberfläche systematisch — gleiche Prompts, gleiches Bewertungsraster, über die Modellstufen hinweg — bevor du Gewichte herunterlädst. Das ist die denkbar günstigste Prüfung vor dem Ausrollen.
Die Bedingungen autorisieren ausdrücklich die Nutzung nicht-personenbezogener Nutzerinhalte zur Entwicklung und Verbesserung der Machine-Learning- und KI-Technologien des Unternehmens. Für kostenlose Endkunden-KI ist das üblich — und zugleich ein Grund, proprietären Code und vertrauliche Dokumente aus dem kostenlosen Chatfenster herauszuhalten.
Entwicklerinnen und Engineering-Teams. Mit Abstand die stärkste Passung. Zwischen coding-orientierten Benchmarks, Drittwerkzeug-Anbindung und aggressiver Preisgestaltung ist das Produkt um dieses Publikum herum gebaut.
Teams, die Modelle mit offenen Gewichten prüfen. Wer als Organisation womöglich beim Eigenbetrieb landet, profitiert von einer kostenlosen Erstanbieter-Oberfläche zu Modellen, die sich später unter MIT herunterladen lassen.
Kostensensible Bauende. Start-ups und Einzelpersonen, denen die API-Preise der Spitzenmodelle zu hoch sind, sowie alle, für die ein leistungsfähiger kostenloser KI-Assistent ohne Abonnement schlicht ausreicht. Veröffentlichte Sätze und Gratis-Stufen verändern die Rechnung erheblich.
Chinesisch-englisch zweisprachige Nutzende. Ein Modell, das Chinesisch als erstklassige Sprache und nicht als Übersetzungsziel entworfen hat.
Forschende und Analystinnen. Abrufwerkzeuge plus ein sehr großes Kontextfenster passen zu dokumentenlastiger Analysearbeit.
Wer sich anderswo umsehen sollte. Wer das tiefste Ökosystem an Drittanbieter-Plugins braucht, findet ChatGPT weiterhin vorn. Organisationen mit Vorgaben, die Datenverarbeitung durch Unternehmen mit chinesischer Verbindung einschränken, müssen die singapurische Struktur an ihren eigenen Compliance-Regeln messen, statt anzunehmen, die Eintragung in Singapur erledige die Frage. Wer dokumentierte Unternehmensgarantien braucht — SLAs, auditierte Compliance-Zertifikate —, sollte diese gesondert prüfen; die hier gesichtete öffentliche Dokumentation deckt sie nicht ab.
Z.ai Chat ist eine browserbasierte Webanwendung unter chat.z.ai. Die umliegenden Angebote teilen sich nach Funktion: z.ai beherbergt Marketingseite, Abonnementeinstieg und Technikblog; docs.z.ai trägt die Entwicklerdokumentation; api.z.ai bedient den API-Verkehr; die rechtlichen Vereinbarungen liegen unter chat.z.ai/legal-agreement/.
Der API-Zugang ist auf Portabilität ausgelegt. Die Dokumentation bietet eine standardisierte RESTful-HTTP-API für alle Programmiersprachen, offizielle Python- und Java-SDKs sowie OpenAI-SDK-Kompatibilität, die ausdrücklich als Migrationspfad benannt wird; der Endpunkt lautet api.z.ai/api/paas/v4/chat/completions.
Die Reichweite geht weit über die Erstanbieter-Oberflächen hinaus. VentureBeat berichtete, GLM-5.2 sei unmittelbar auf Hugging Face, über die Z.ai-API und in mehr als zwanzig Coding-Umgebungen von Drittanbietern verfügbar gewesen — man kann diese Modelle also häufig in bereits vorhandenen Werkzeugen nutzen. Die Abonnementdokumentation nennt Claude Code, Cline und OpenCode als unterstützte Clients, die Abonnementseite ergänzt Kilo Code und weitere.
Die Oberfläche ist zweisprachig; die Plattform beschreibt sich als auf chinesisch- und englischsprachige Nutzende zugeschnitten. In der gesichteten Dokumentation fanden sich keine nativen Mobil-Apps, weshalb hier keine Aussage zu deren Verfügbarkeit getroffen wird.
Drei Stränge, jeweils anders bepreist. Sie zu vermengen ist der häufigste Fehler in Drittdarstellungen dieses Produkts.
Die Chat-Oberfläche ist kostenlos. Z.ais eigene Konsolenmeldungen beschreiben das Produkt als kostenlose, quelloffen basierte ChatGPT-Alternative. Die hier gesichtete öffentliche Dokumentation veröffentlicht weder Nachrichtenobergrenzen noch Ratenbegrenzungen für die kostenlose Chat-Stufe, deshalb wird keine konkrete Grenze genannt — das Fehlen einer veröffentlichten Grenze belegt nicht, dass es keine gibt.
Die API rechnet token-basiert ab, mit Sätzen je Million Token: GLM-5.3 und GLM-5.2 bei 1,4 US-Dollar Eingabe und 4,4 US-Dollar Ausgabe; GLM-5 bei 1 und 3,2; GLM-4.7 bei 0,6 und 2,2; GLM-4.7-FlashX bei 0,07 und 0,4. Zwischengespeicherte Eingabe ist deutlich günstiger — 0,26 US-Dollar in der Flaggschiff-Stufe — und deren Speicherung ist als zeitlich befristet kostenlos ausgewiesen. Bemerkenswert: GLM-4.7-Flash, GLM-4.5-Flash und GLM-4.6V-Flash sind in Ein- und Ausgabe als kostenlos gelistet. Multimodale Fähigkeiten werden gesondert berechnet: Websuche 0,01 US-Dollar je Aufruf, GLM-Image 0,015 je Bild, CogVideoX-3 0,2 je Video und GLM-ASR-2512 rund 0,0024 je Minute.
Der GLM Coding Plan ist ein Abonnement, das laut offizieller Abonnementseite bei 18 US-Dollar monatlich beginnt und GLM-5.3, GLM-5.2 sowie GLM-5-Turbo in Claude Code, Kilo Code, Cline, OpenCode und weiteren abdeckt. Es gibt drei Stufen mit doppelten Kontingenten — Lite mit 2.000 Fünf-Stunden-Krediten und 10.000 wöchentlich; Pro mit 12.000 und 60.000; Max mit 28.000 und 140.000. Fünf-Stunden-Kredite füllen sich dynamisch fünf Stunden nach Verbrauch wieder auf; Wochenkredite setzen sich alle sieben Tage ab Abonnementbeginn zurück. Der oben erwähnte Randzeiten-Rabatt verdoppelt die Kapazität für Arbeit, die außerhalb singapurischer Werktagsnachmittage eingeplant wird.
Zur Einordnung der Preisschwankungen: VentureBeats Berichterstattung vom Juni 2026 nannte Unternehmens-Abonnementstufen ab 12,60 US-Dollar monatlich, unterhalb der derzeit ausgewiesenen 18. Aktionspreise bewegen sich offensichtlich; prüfe die geltenden Sätze, statt dich auf eine in einem Artikel zitierte Zahl zu verlassen — auch auf die in diesem.
ChatGPT bleibt der Maßstab für Breite — das größte Plugin- und Integrationsökosystem, die ausgereifteste mobile Erfahrung, das dichteste Drittanbieter-Werkzeug. Z.ai konkurriert über Preis und offene Gewichte, nicht über Ökosystemreife.
Claude ist der übliche Vergleich für Code und lange Dokumente, und bemerkenswerterweise ist der GLM Coding Plan darauf ausgelegt, innerhalb von Claude Code zu laufen — für Entwickelnde, die ihr Werkzeug behalten und nur das Modell dahinter tauschen wollen, sind beide ebenso Ergänzung wie Wettbewerb.
DeepSeek ist die strukturell nächste Entsprechung: ein weiteres chinesisches Labor mit starken Modellen offener Gewichte und aggressiver Preisgestaltung. Die Wahl zwischen beiden hängt meist davon ab, welche Benchmarks zur eigenen Last passen, nicht von einem kategorialen Unterschied.
Gemini bietet tiefe Google-Workspace-Integration und sehr großen Kontext. VentureBeats Benchmark-Bericht sah GLM-5.2 bei Terminal-Bench 2.1 deutlich vor Gemini 3.1 Pro — 81,0 gegenüber 74,0 — auch wenn solche Vorsprünge knapp sind und sich mit jeder Veröffentlichung verschieben.
GLM direkt selbst betreiben verdient als anbieterspezifische Alternative eine eigene Erwähnung. Da die Gewichte MIT-lizenziert auf Hugging Face liegen, kann eine Organisation dasselbe Modell auf eigener Infrastruktur fahren — ohne Anbieterbindung, ohne dass Daten den Perimeter verlassen, zum Preis von GPU-Kapazität und Betriebsaufwand.
Ehrliches Fazit: Die Unterscheidungsmerkmale von Z.ai Chat sind offene Gewichte, aggressive Preise und coding-orientierte Agentenfähigkeit. Die Nachteile gegenüber ChatGPT liegen in Ökosystemtiefe und mobilem Feinschliff. Für ein bestimmtes und wachsendes Publikum — Entwickelnde, denen Kosten und Portabilität wichtig sind — geht dieser Tausch auf.
Herstellerunterlagen und Enthusiasten-Berichte zeichnen gern einen Durchmarsch. Die unabhängige Berichterstattung ist vielschichtiger. VentureBeats eigene Benchmark-Tabelle zeigt GLM-5.2 bei manchen Maßen klar vorn — 62,1 bei SWE-bench Pro gegen 58,6 für GPT-5.5 — und bei anderen zurück: Bei den rohen Terminal-Bench-2.1-Werten erreichte es 81,0 gegenüber 85,0 von Claude 4.8 und 84,0 von GPT-5.5, während es beim selben Maß Gemini 3.1 Pro deutlich übertrifft. Zutreffend gelesen heißt das „an der Spitze konkurrenzfähig mit besonderer Stärke bei langlaufendem Coding", nicht „schlägt alles". Zudem altern Benchmarks schnell.
Die Erzählung von den offenen Gewichten trägt ein wichtiges Sternchen. VentureBeat berichtete, GLM-5.3 sei zunächst nur über den GLM Coding Plan und die ZCode-Umgebung verfügbar gewesen, API-Zugang und offene Gewichte folgten später, sobald Sicherheitsbewertung und Härtung abgeschlossen seien, und das Unternehmen plane die Gewichte etwa zwei Wochen nach dem Start freizugeben. Das neueste Modell ist also vorübergehend ein geschlossenes, abonnementgebundenes Produkt. Hängt dein Vorhaben daran, dass Gewichte herunterladbar sind, prüfe die Verfügbarkeit der konkreten Version, statt eine einheitliche Lizenzierung der Familie zu unterstellen.
Zwei dokumentierte Regeln verdienen vor dem Abschluss Beachtung. Der GLM Coding Plan ist strikt auf offiziell unterstützte Werkzeuge und Produkte beschränkt, und Abonnenten wird mitgeteilt, dass sie die Abonnementvorteile in nicht unterstützten Werkzeugen oder Szenarien nicht nutzen dürfen — es ist kein allgemeines Kreditguthaben. Und ist das Kontingent erschöpft, muss man laut offizieller FAQ bis zum nächsten Fünf-Stunden-Zyklus warten; das System bucht nichts vom Kontoguthaben ab. Das ist insofern nutzerfreundlich, als es Überraschungskosten verhindert, bedeutet aber auch, dass das Erreichen der Obergrenze die Arbeit stoppt, statt sie herabgestuft fortzuführen.
Jeder Plan trägt zugleich eine Fünf-Stunden- und eine Wochengrenze. Es kann durchaus sein, dass Wochenkontingent übrig ist, während das Fünf-Stunden-Fenster blockiert — oder umgekehrt. Wer intensive Schübe plant, sollte beide Beschränkungen zusammen durchrechnen.
Die Bedingungen verlangen eine ausdrückliche Autorisierung, dass das Unternehmen nicht-personenbezogene Nutzerinhalte zur Entwicklung und Verbesserung seiner Machine-Learning- und KI-Technologien nutzt und speichert. Die Datenschutzerklärung führt gesondert das Trainieren und Verbessern von Modellen unter ihren berechtigten Interessen auf und hält fest, dass öffentlich verfügbare Internetinformationen zum Modelltraining beschafft werden können. Eine Widerspruchsmöglichkeit ist in den gesichteten Unterlagen nicht dokumentiert. Für kostenlose Endkunden-KI ist das nicht ungewöhnlich, sollte aber beeinflussen, was man ins Fenster einfügt.
Ein Mindestalter für die Registrierung wird nicht genannt. Die Bedingungen sagen nur, dass man als Minderjähriger nach dem Recht des Wohnsitzlandes oder -staates diese Bedingungen mit der gesetzlichen Vertretung durchgehen sollte — ein Hinweis, keine Schranke. Die einzige feste altersbezogene Regel untersagt Nutzenden, personenbezogene Daten von Kindern unter 13 Jahren in einer Weise zu verarbeiten oder zu speichern, die gegen COPPA verstößt; das regelt, was Nutzende tun dürfen, nicht wer sich registrieren darf. Eltern, die dieses Werkzeug prüfen, sollten das Fehlen einer Schranke nicht als Zusicherung der Eignung lesen.
Drei Namen hängen an diesem Produkt: die Marke Z.ai, die frühere Identität Zhipu AI und die singapurische Vertragseinheit JINGSHENG HENGXING TECHNOLOGY PTE.LTD, die zugleich als Verantwortliche benannt ist. Für die meisten Privatnutzenden ist das belanglos; für Organisationen mit Vorgaben zu Datenstandort oder Herkunftsland nicht — und die Eintragung in Singapur klärt für sich genommen keine Fragen zu einem Unternehmen, das VentureBeat als chinesisches KI-Start-up beschreibt. Bewerte anhand deiner tatsächlichen Richtlinie, nicht anhand einer Zeile im Fußbereich.
Die Datenschutzerklärung gestattet die Offenlegung gegenüber Geschäftspartnern, Investoren, Erwerbern oder potenziellen Erwerbern zur Abwicklung von Transaktionen über Geschäftsvermögen, ausgedehnt auf Verschmelzung, Übernahme oder Schulden- beziehungsweise Vermögensverkauf. Branchenüblich und dennoch wissenswert: Die Verwahrstelle deiner Daten kann ohne dein Zutun wechseln.
Ein dauerhafter Hinweis am unteren Rand der Oberfläche stellt fest, dass alle Inhalte KI-erzeugt und nur als Anhaltspunkt gedacht sind. Das Produkt beansprucht keine Richtigkeit — und niemand sollte sie an seiner Stelle beanspruchen.
Die öffentliche Dokumentation ist bei API-Sätzen, Kreditfaktoren und Kontingentmechanik gründlich — und beim kostenlosen Chatprodukt selbst vergleichsweise schweigsam. Nachrichtenobergrenzen, Ratenbegrenzungen und Aufbewahrungsfristen für Chatverläufe fanden sich in den gesichteten Unterlagen nicht. Das ist eine Informationslücke, hier benannt statt mit Vermutungen gefüllt.
Innerhalb einer einzigen Recherchesitzung zeigte dieses Produkt GLM-5.2 im Seitentitel, GLM-4.7 im Modellwähler und GLM-5.3 in Bloglink und Dokumentation. Versionsangaben in jeder Sekundärquelle — auch auf dieser Seite — veralten schnell. Prüfe in der Oberfläche selbst, was gerade ausgeliefert wird.
Die Chat-Oberfläche lässt sich kostenlos nutzen, und die Konsolenmeldungen der Plattform beschreiben sie als kostenlose, quelloffen basierte ChatGPT-Alternative. Zwei Klarstellungen zählen. Erstens gilt „kostenlos" dem Chatprodukt; die API rechnet token-basiert ab und der GLM Coding Plan ist ein kostenpflichtiges Abonnement ab 18 US-Dollar monatlich. Zweitens veröffentlicht die gesichtete Dokumentation weder Nachrichtenobergrenzen noch Ratenbegrenzungen für die Gratis-Stufe, weshalb keine konkrete Zahl zitiert werden kann — eine Lücke in den verfügbaren Informationen, keine Zusicherung unbegrenzter Nutzung.
Ja, dies ist ein Erstanbieter-Produkt. VentureBeat identifiziert das Unternehmen in unabhängiger Berichterstattung als chinesisches KI-Start-up Z.ai, vormals Zhipu AI — jene Organisation, die die GLM-Modelle entwickelt. Die in Bedingungen und Datenschutzerklärung genannte Vertrags- und Verantwortlicheneinheit ist die singapurische Gesellschaft JINGSHENG HENGXING TECHNOLOGY PTE.LTD. Also: Z.ai die Marke, Zhipu AI der frühere Name, die singapurische Einheit der rechtliche Gegenpart.
Die Dokumentation führt derzeit GLM-5.3 als Flaggschiff für Softwareentwicklung und Agentenarbeit, GLM-5V-Turbo für visuelle Programmierung, GLM-Image für Text-zu-Bild und CogVideoX-3 für Video. Die Chat-Oberfläche enthält einen Modellwähler, und die API-Preisliste deckt ein breiteres Feld ab, darunter GLM-5.2, GLM-5, GLM-4.7 und kostenlose Flash-Stufen. Die Verfügbarkeit unterscheidet sich je Strang — GLM-5.3 startete auf dem Coding Plan und in ZCode vor API und offenen Gewichten.
Weitgehend, mit einem zeitlichen Vorbehalt. VentureBeat bestätigte, dass die Kerngewichte von GLM-5.2 unter einer uneingeschränkten MIT-Lizenz veröffentlicht wurden und sich von Hugging Face für Eigenbetrieb und Feintuning herunterladen lassen. Dasselbe Medium berichtete jedoch, GLM-5.3 sei zuerst als reines Abonnementprodukt erschienen, die Gewichte seien rund zwei Wochen nach dem Start nach Abschluss der Sicherheitsbewertung geplant. Prüfe die Lizenzierung der konkret benötigten Version.
Je Million Token: GLM-5.3 und GLM-5.2 bei 1,4 US-Dollar Eingabe und 4,4 Ausgabe; GLM-5 bei 1 und 3,2; GLM-4.7 bei 0,6 und 2,2; GLM-4.7-FlashX bei 0,07 und 0,4. Zwischengespeicherte Eingabe kostet erheblich weniger. GLM-4.7-Flash, GLM-4.5-Flash und GLM-4.6V-Flash sind als kostenlos gelistet. Werkzeuge und Medien werden gesondert berechnet: Websuche 0,01 US-Dollar je Aufruf, GLM-Image 0,015 je Bild, CogVideoX-3 0,2 je Video.
Jede Stufe trägt zwei gleichzeitige Grenzen. Lite bietet 2.000 Fünf-Stunden-Kredite und 10.000 wöchentlich; Pro 12.000 und 60.000; Max 28.000 und 140.000. Fünf-Stunden-Kredite füllen sich fünf Stunden nach Verbrauch wieder auf; Wochenkredite setzen sich alle sieben Tage zurück. Kredite errechnen sich aus Eingabe-, Cache-Eingabe- und Ausgabe-Token multipliziert mit modellspezifischen Faktoren, geteilt durch 10.000, wobei die Ausgabe am schwersten wiegt. Entscheidend: Nutzung außerhalb der Stoßzeiten wird mit 50 % des Standardsatzes berechnet, Stoßzeit ist Montag bis Freitag 14:00–18:00 Uhr Singapur-Zeit.
Du wartest. Die offizielle FAQ hält fest, dass das System nichts vom Kontoguthaben abbucht und man nach Verbrauch des Kontingents bis zum nächsten Fünf-Stunden-Zyklus warten muss. Das verhindert unerwartete Kosten, bedeutet aber auch, dass die Arbeit stoppt, statt auf niedrigerer Stufe weiterzulaufen. Beachte zudem, dass der Plan strikt auf offiziell unterstützte Werkzeuge begrenzt ist.
Praktisch ja. Die Bedingungen verlangen deine Autorisierung, nicht-personenbezogene Nutzerinhalte zur Entwicklung und Verbesserung der Machine-Learning- und KI-Technologien des Unternehmens zu nutzen und zu speichern, und die Datenschutzerklärung führt Trainieren und Verbessern von Modellen unter ihren Zwecken. Eine Widerspruchsmöglichkeit erscheint in der gesichteten Dokumentation nicht. Halte vertrauliches Material aus dem kostenlosen Chatprodukt heraus.
Ein ausdrückliches Mindestalter wird nicht genannt. Die Bedingungen sagen lediglich, dass Minderjährige nach dem Recht ihres Landes oder Staates die Bedingungen mit einer gesetzlichen Vertretung durchgehen sollten, was eine Empfehlung und keine Beschränkung ist. Die einzige feste Regel untersagt das Verarbeiten oder Speichern personenbezogener Daten von Kindern unter 13 Jahren unter Verstoß gegen COPPA — eine Vorgabe für das Verhalten der Nutzenden, keine Registrierungsschranke.
Ja, und das ist ein bewusstes Entwurfsziel. Der GLM Coding Plan unterstützt unter anderem Claude Code, Kilo Code, Cline und OpenCode, und VentureBeat berichtete, GLM-5.2 sei zum Start in mehr als zwanzig Coding-Umgebungen von Drittanbietern verfügbar gewesen. Für die direkte Anbindung ist die API OpenAI-SDK-kompatibel, sodass die Migration einer bestehenden OpenAI-Integration oft im Wechsel von Basis-URL und Schlüssel besteht.