Vous avez utilisé cet outil ? Notez-le
Vous avez utilisé cet outil ? Notez-le
Z.ai Chat est le chatbot GLM de première partie : l'interface conversationnelle officielle de la famille de modèles de langage GLM. Cette distinction pèse plus lourd qu'il n'y paraît, car la plupart des sites qui se présentent comme des « alternatives gratuites à ChatGPT » sont des revendeurs qui enveloppent l'API de quelqu'un d'autre. Ce n'est pas le cas ici : le service est exploité par l'entreprise qui construit les modèles, et la page d'accueil énonce clairement sa vocation — un assistant IA propulsé par GLM permettant de créer des sites web, d'écrire du code, de mener des tâches de longue haleine et d'obtenir des réponses immédiates.
Le paysage corporatif comporte trois strates qu'il vaut la peine de démêler, chacune apparaissant à un endroit différent. La marque publique est Z.ai. VentureBeat, couvrant de façon indépendante la sortie de GLM-5.2, identifie l'entreprise comme « la jeune pousse chinoise d'IA Z.ai (anciennement Zhipu AI) » — Z.ai est donc l'identité internationale de l'organisation autrefois connue sous le nom de Zhipu. L'entité contractante et responsable du traitement des données n'est cependant ni l'une ni l'autre : les conditions d'utilisation définissent Z.ai comme la plateforme exploitée par JINGSHENG HENGXING TECHNOLOGY PTE.LTD, société singapourienne immatriculée à International Plaza, et la politique de confidentialité désigne cette même entité comme le responsable du traitement de vos données personnelles. Si votre évaluation touche à la juridiction ou à la gouvernance des données, c'est l'entité singapourienne qui compte juridiquement.
Ce qui distingue ce produit du champ encombré des assistants conversationnels gratuits, c'est que les modèles sous-jacents sont en grande partie à poids ouverts. VentureBeat confirme que les poids fondamentaux de GLM-5.2 ont été publiés sous une licence open source MIT sans restriction, téléchargeables depuis Hugging Face en vue d'un affinage local et d'un hébergement autonome. L'interface conversationnelle constitue donc une porte d'entrée commode vers un modèle que vous pourriez, en principe, faire tourner vous-même. Très peu d'assistants gratuits peuvent en dire autant.
Une clarification s'impose d'emblée, car c'est la source de confusion la plus fréquente : Z.ai exploite deux voies commerciales faciles à confondre. L'interface de chat sur chat.z.ai est le produit grand public gratuit. Séparément existe une plateforme développeur payante — une API facturée au jeton et un abonnement GLM Coding Plan à partir de 18 $ par mois. Les tarifs cités dans cet article sont étiquetés par voie, car la grille de l'API ne décrit pas ce que vous payez pour utiliser la fenêtre de conversation.
Plutôt que de présenter un unique « meilleur modèle » opaque, Z.ai expose la famille entière et vous laisse choisir. La documentation officielle formule clairement les rôles actuels : GLM-5.3 est décrit comme le vaisseau amiral le plus récent, apportant des avancées globales en ingénierie logicielle et en capacités d'agent ; GLM-5V-Turbo est un modèle de codage multimodal spécialisé dans la programmation visuelle ; GLM-Image prend en charge la génération d'images à partir de texte, revendiquée comme état de l'art open source sur les scènes complexes ; et CogVideoX-3 gère la génération vidéo.
L'interface comporte un sélecteur de modèle en haut de l'écran, si bien que basculer relève du simple clic et non d'une fouille dans les réglages. Cela compte plus qu'il n'y paraît : un modèle plus léger répond souvent plus vite et suffit amplement aux questions courantes, et pouvoir descendre d'un cran délibérément constitue un véritable avantage ergonomique.
Le titre même du produit associe « Chatbot » et « Agent », et la liste des capacités s'ouvre sur les tâches de longue haleine. C'est l'axe sur lequel l'entreprise a le plus visiblement investi. La couverture indépendante de VentureBeat décrit GLM-5.2 comme un modèle conçu spécifiquement pour dominer les tâches autonomes de codage et d'ingénierie au long cours, et rapporte des résultats de référence précisément sur cet axe — 62,1 sur SWE-bench Pro contre 58,6 pour GPT-5.5, et 74,4 % sur FrontierSWE, un banc d'essai conçu pour mesurer l'achèvement de tâches prolongées.
Les abonnés bénéficient d'une couche d'outils supplémentaire. Le GLM Coding Plan octroie un accès MCP exclusif couvrant la compréhension visuelle, la recherche web, la lecture de pages et Zread — les capacités qui permettent au modèle d'aller consulter et de lire des pages plutôt que de répondre uniquement à partir de ses paramètres.
Le reportage de VentureBeat crédite GLM-5.2 d'une fenêtre de contexte d'un million de jetons remarquablement stable. Il ne s'agit pas d'un simple chiffre d'affiche : la même couverture décrit une optimisation architecturale nommée IndexShare, qui réutilise un indexeur identique sur chaque groupe de quatre couches d'attention éparse et réduit ainsi le calcul par jeton d'environ 2,9 fois à la longueur de contexte maximale. Autrement dit, ce contexte long est conçu pour être économiquement exploitable plutôt que nominalement disponible.
Écrire du code n'est pas ici une capacité annexe — le produit se positionne autant comme agent de codage que comme assistant conversationnel. L'interface comprend un point d'entrée ZCode dédié à côté du sélecteur de modèle, et le produit par abonnement est explicitement bâti autour du travail de développement. Selon la documentation officielle, le GLM Coding Plan s'applique à des outils tels que Claude Code, Cline et OpenCode, prenant en charge la programmation en langage naturel — décrire des exigences en langage courant pour générer des plans, écrire du code et déboguer — ainsi qu'une complétion de code contextuelle en temps réel.
L'interface propose cinq raccourcis de tâches directement sous la zone de saisie : pages d'atterrissage, vulgarisation scientifique et plans de cours, modélisation 3D, petits jeux et blogs personnels. Il s'agit d'un échafaudage d'accueil plutôt que de fonctionnalités distinctes, mais le choix est judicieux : chacun représente une tâche visant à produire quelque chose de complet plutôt qu'une simple question-réponse, ce qui oriente les nouveaux venus vers la véritable force du produit.
La plateforme se décrit comme taillée pour les utilisateurs chinois et anglophones, et l'interface rendue le confirme, mêlant contrôles en anglais et invites en chinois. Pour quiconque travaille entre ces deux langues, un modèle dont l'entraînement et la conception traitent le chinois comme une langue de premier rang plutôt qu'une greffe tardive constitue une différence significative.
Pour ceux qui veulent bâtir sur les modèles plutôt que dialoguer avec eux, la documentation trace un chemin complet : une API HTTP RESTful standard compatible avec tous les langages de programmation, des SDK Python et Java officiels, et une compatibilité avec le SDK OpenAI pour migrer rapidement depuis OpenAI. Le point de terminaison est api.z.ai/api/paas/v4/chat/completions, et cette compatibilité signifie qu'une intégration existante ne demande souvent qu'un changement d'URL de base et de clé.
Le cas le mieux étayé. Entre la surface ZCode, l'intégration aux outils tiers et des performances concentrées sur SWE-bench Pro et FrontierSWE, c'est là que le produit vise et là que les preuves indépendantes sont les plus solides.
Un flux de travail sous-estimé et propre aux fournisseurs à poids ouverts. Comme les poids GLM sont téléchargeables sous licence MIT, les équipes qui envisagent l'auto-hébergement peuvent utiliser l'interface gratuite pour évaluer le comportement du modèle sur leurs problèmes réels avant d'engager des infrastructures. La fenêtre de conversation devient un banc d'évaluation à coût nul.
Les tarifs publiés placent GLM-4.7 à 0,6 $ le million de jetons en entrée et 2,2 $ en sortie, plusieurs modèles de la gamme Flash étant affichés comme gratuits. Pour des volumes élevés et peu complexes — classification, extraction, résumés de routine — cette tarification modifie ce qui devient économiquement viable.
Avec la recherche web et la lecture de pages disponibles comme outils, l'assistant peut ancrer ses réponses dans des pages récupérées plutôt que dans la seule mémoire paramétrique. Utile pour les questions d'actualité et le balayage documentaire, avec la réserve habituelle : la récupération réduit la fabulation sans l'éliminer.
L'orientation sino-anglaise en fait un choix pratique pour la traduction, la rédaction interlingue et la relecture de localisation — des tâches où les modèles entraînés principalement sur des données anglaises produisent souvent un chinois techniquement correct mais au ton décalé.
Rédiger, reformuler, expliquer, faire émerger des idées. La majorité peu spectaculaire des usages d'un assistant, traitée avec compétence et sans frais.
Le conseil le plus actionnable et le moins mis en avant. La documentation indique qu'en heures creuses, l'usage des modèles est facturé à 50 % du tarif standard en crédits, les heures pleines étant définies du lundi au vendredi de 14h00 à 18h00, heure normale de Singapour. Déplacer les traitements par lots hors de cette fenêtre de quatre heures en semaine double littéralement votre quota effectif. Aucune recension tierce de ce produit ne le mentionne.
Le quota d'abonnement est libellé en crédits, calculés comme les jetons d'entrée multipliés par un coefficient d'entrée, plus l'entrée en cache par son coefficient, plus les jetons de sortie par un coefficient de sortie, le tout divisé par 10 000. La sortie pèse bien plus lourd que l'entrée — pour GLM-5.3 les coefficients sont de 6,9 en entrée, 1,7 en cache et 24 en sortie. Conséquence pratique : des sorties verbeuses coûtent nettement plus cher que de longues entrées. Demander des réponses concises relève de la stratégie de quota, pas seulement du goût stylistique.
L'entrée en cache est facturée à une fraction de l'entrée fraîche, tant dans la grille de l'API que dans les coefficients de crédits. Si vous envoyez régulièrement la même instruction système ou le même document, structurer les requêtes pour que le contenu stable se trouve à un emplacement cachable réduit sensiblement le coût.
Plusieurs modèles figurent à coût nul dans la grille officielle. Pour des tâches simples et nombreuses, router vers un palier Flash gratuit et garder le vaisseau amiral pour les problèmes réellement difficiles relève de l'arithmétique élémentaire.
La disponibilité varie selon la voie. VentureBeat a rapporté que GLM-5.3 n'était initialement accessible que via le GLM Coding Plan et l'environnement ZCode, l'accès API et les poids ouverts venant plus tard. Vérifiez quelle surface expose le modèle voulu avant de bâtir un plan autour.
Si l'auto-hébergement est envisagé, utilisez l'interface gratuite de manière systématique — mêmes invites, même grille, à travers les paliers de modèles — avant de télécharger des poids. C'est l'évaluation pré-déploiement la moins coûteuse qui soit.
Les conditions autorisent explicitement l'usage du contenu utilisateur ne constituant pas des données personnelles pour développer et améliorer les technologies d'apprentissage automatique et d'IA de l'entreprise. C'est courant pour un produit d'IA grand public gratuit, et c'est aussi une raison de tenir code propriétaire et documents confidentiels hors de la fenêtre gratuite.
Les développeurs et équipes d'ingénierie. L'adéquation la plus forte, et de loin. Entre les bancs d'essai centrés sur le code, l'intégration aux outils tiers et une tarification agressive, le produit est bâti autour de ce public.
Les équipes évaluant des modèles à poids ouverts. Quiconque dont la démarche d'achat pourrait aboutir à un auto-hébergement gagne à disposer d'une interface gratuite et de première partie vers des modèles téléchargeables ensuite sous MIT.
Les bâtisseurs sensibles au coût. Les jeunes pousses et les particuliers pour qui la tarification des API de pointe est prohibitive, et quiconque veut simplement un assistant IA gratuit compétent sans abonnement. Les tarifs publiés et les paliers gratuits changent substantiellement le calcul.
Les utilisateurs bilingues chinois-anglais. Un modèle conçu avec le chinois comme langue de premier rang plutôt que comme cible de traduction.
Les chercheurs et analystes. Des outils de récupération associés à une très grande fenêtre de contexte conviennent au travail analytique riche en documents.
Ceux qui devraient regarder ailleurs. Quiconque exige l'écosystème de greffons tiers le plus profond trouvera ChatGPT encore devant. Les organisations dont les politiques restreignent le traitement des données par des sociétés d'affiliation chinoise doivent confronter la structure de l'entité singapourienne à leurs propres règles de conformité plutôt que de supposer que l'immatriculation à Singapour règle la question. Ceux qui ont besoin de garanties d'entreprise documentées — SLA, certifications de conformité auditées — devront les vérifier séparément, la documentation publique examinée ici ne les couvrant pas.
Z.ai Chat est une application web accessible par navigateur à l'adresse chat.z.ai. Les propriétés voisines se répartissent par fonction : z.ai héberge le site vitrine, l'entrée d'abonnement et le blog technique ; docs.z.ai porte la documentation développeur ; api.z.ai sert le trafic d'API ; et les accords juridiques résident sous chat.z.ai/legal-agreement/.
L'accès API est pensé pour la portabilité. La documentation fournit une API HTTP RESTful standard compatible avec tous les langages, des SDK Python et Java officiels, et une compatibilité SDK OpenAI explicitement présentée comme chemin de migration, le point de terminaison étant api.z.ai/api/paas/v4/chat/completions.
La portée dépasse largement les surfaces de première partie. VentureBeat a rapporté que GLM-5.2 était disponible dès sa sortie sur Hugging Face, l'API Z.ai et plus de vingt environnements de codage tiers — vous pouvez donc souvent utiliser ces modèles dans des outils que vous possédez déjà. La documentation d'abonnement cite Claude Code, Cline et OpenCode parmi les clients pris en charge, et la page d'abonnement ajoute Kilo Code et d'autres.
L'interface est bilingue, la plateforme se décrivant comme taillée pour les utilisateurs chinois et anglophones. La documentation examinée ne mentionnait aucune application mobile native, et aucune affirmation n'est formulée ici quant à leur disponibilité.
Trois voies, tarifées différemment. Les confondre est l'erreur la plus courante dans les présentations tierces de ce produit.
L'interface de conversation est gratuite. Les messages de console de Z.ai décrivent le produit comme une alternative gratuite à ChatGPT fondée sur l'open source. La documentation publique examinée ici ne publie ni plafond de messages ni limite de débit pour le palier gratuit, aucune limite précise n'est donc énoncée — l'absence de limite publiée ne prouve pas qu'il n'en existe aucune.
L'API est facturée au jeton, à raison du million de jetons : GLM-5.3 et GLM-5.2 à 1,4 $ en entrée et 4,4 $ en sortie ; GLM-5 à 1 $ et 3,2 $ ; GLM-4.7 à 0,6 $ et 2,2 $ ; GLM-4.7-FlashX à 0,07 $ et 0,4 $. L'entrée en cache coûte bien moins — 0,26 $ pour le palier amiral — et le stockage de cette entrée est affiché comme gratuit pour une durée limitée. Notablement, GLM-4.7-Flash, GLM-4.5-Flash et GLM-4.6V-Flash sont affichés gratuits en entrée comme en sortie. Les capacités multimodales sont tarifées à part : recherche web à 0,01 $ par appel, GLM-Image à 0,015 $ l'image, CogVideoX-3 à 0,2 $ la vidéo et GLM-ASR-2512 à environ 0,0024 $ la minute.
Le GLM Coding Plan est un abonnement débutant à 18 $ par mois selon la page officielle, couvrant GLM-5.3, GLM-5.2 et GLM-5-Turbo dans Claude Code, Kilo Code, Cline, OpenCode et d'autres. Il se décline en trois paliers assortis de doubles quotas — Lite à 2 000 crédits sur cinq heures et 10 000 hebdomadaires ; Pro à 12 000 et 60 000 ; Max à 28 000 et 140 000. Les crédits quinquehoraires se rechargent dynamiquement cinq heures après consommation ; les crédits hebdomadaires se réinitialisent tous les sept jours à compter de l'abonnement. La remise en heures creuses évoquée plus haut double effectivement la capacité pour un travail programmé hors des après-midi de semaine singapouriens.
Pour situer la volatilité tarifaire, la couverture de VentureBeat de juin 2026 citait des paliers d'abonnement entreprise à partir de 12,60 $ par mois, en deçà des 18 $ actuellement affichés. Les prix promotionnels bougent manifestement ; vérifiez les tarifs en vigueur plutôt que de vous fier à un chiffre cité dans un article, y compris celui-ci.
ChatGPT demeure la référence en matière d'étendue — le plus vaste écosystème de greffons et d'intégrations, l'expérience mobile la plus aboutie, l'outillage tiers le plus fourni. Z.ai rivalise sur le prix et les poids ouverts, non sur la maturité de l'écosystème.
Claude est la comparaison habituelle pour le code et les documents longs, et notons que le GLM Coding Plan est conçu pour fonctionner dans Claude Code — pour les développeurs souhaitant conserver leur outillage tout en changeant le modèle sous-jacent, ces produits sont autant complémentaires que concurrents.
DeepSeek est l'analogue structurel le plus proche : un autre laboratoire chinois livrant de solides modèles à poids ouverts à des tarifs agressifs. Le choix entre les deux tient généralement à l'adéquation des bancs d'essai à votre charge de travail plutôt qu'à une différence catégorielle.
Gemini offre une intégration poussée à Google Workspace et un très grand contexte. Le reportage de VentureBeat plaçait GLM-5.2 nettement devant Gemini 3.1 Pro sur Terminal-Bench 2.1 — 81,0 contre 74,0 — même si les avances sur ces bancs restent minces et changent à chaque sortie.
L'auto-hébergement direct de GLM mérite d'être cité comme l'alternative propre à ce fournisseur. Les poids étant sous licence MIT sur Hugging Face, une organisation peut faire tourner le même modèle sur sa propre infrastructure — sans dépendance au fournisseur, sans que les données quittent le périmètre, au prix de la capacité GPU et de l'effort opérationnel.
En résumé honnête : les atouts différenciants de Z.ai Chat sont les poids ouverts, une tarification agressive et une capacité d'agent orientée code. Ses faiblesses face à ChatGPT tiennent à la profondeur de l'écosystème et au fini mobile. Pour un public précis et croissant — les développeurs soucieux de coût et de portabilité — l'échange est avantageux.
Les documents du fournisseur et la couverture enthousiaste tendent à présenter un sans-faute. Le reportage indépendant est plus nuancé. Le tableau de VentureBeat montre GLM-5.2 l'emportant nettement sur certaines mesures — 62,1 sur SWE-bench Pro contre 58,6 pour GPT-5.5 — mais en retrait sur d'autres : sur les scores bruts de Terminal-Bench 2.1, il atteint 81,0 face aux 85,0 de Claude 4.8 et aux 84,0 de GPT-5.5, tout en devançant largement Gemini 3.1 Pro sur cette même mesure. La lecture juste est « compétitif à la frontière, avec une force spécifique sur le codage de longue haleine », et non « surpasse tout ». Les bancs d'essai vieillissent par ailleurs vite.
L'argument des poids ouverts s'accompagne d'un astérisque important. VentureBeat a rapporté que GLM-5.3 n'était d'abord accessible qu'à travers le GLM Coding Plan et l'environnement ZCode, l'accès API et les poids ouverts arrivant plus tard, une fois l'évaluation de sécurité et le durcissement achevés, l'entreprise prévoyant de publier les poids environ deux semaines après le lancement. Le modèle le plus récent est donc temporairement un produit fermé, réservé aux abonnés. Si votre projet dépend de poids téléchargeables, vérifiez la disponibilité de la version précise plutôt que de supposer une licence uniforme.
Deux règles documentées méritent l'attention avant de souscrire. Le GLM Coding Plan est strictement limité aux outils et produits officiellement pris en charge, et il est signifié aux abonnés qu'ils ne doivent pas utiliser les avantages de l'abonnement dans des outils ou contextes non pris en charge — ce n'est pas un solde de crédits polyvalent. Et lorsque le quota est épuisé, selon la FAQ officielle, il faut attendre le cycle de cinq heures suivant, le système ne prélevant rien sur le solde du compte. C'est plutôt favorable à l'utilisateur, puisque cela évite les frais surprises, mais cela signifie aussi qu'atteindre le plafond interrompt le travail au lieu de le dégrader.
Chaque formule comporte à la fois une limite de cinq heures et une limite hebdomadaire. Il est tout à fait possible qu'il vous reste du quota hebdomadaire tout en étant bloqué par la fenêtre de cinq heures, ou l'inverse. Quiconque prévoit des rafales intensives devrait modéliser les deux contraintes.
Les conditions exigent une autorisation explicite pour que l'entreprise utilise et stocke le contenu utilisateur ne constituant pas des données personnelles afin de développer et améliorer ses technologies d'apprentissage automatique et d'intelligence artificielle. La politique de confidentialité mentionne séparément l'entraînement et l'amélioration des modèles parmi ses intérêts légitimes, et indique que des informations publiquement disponibles sur internet peuvent être collectées pour entraîner les modèles. Aucune faculté d'opposition n'est documentée dans les éléments consultés. Pour une IA grand public gratuite cela n'a rien d'inhabituel, mais cela devrait guider ce que vous collez dans la fenêtre.
Aucun âge minimum d'inscription n'est indiqué. Les conditions se bornent à dire que si vous êtes mineur au regard des lois de votre pays ou État de résidence, vous devriez examiner ces conditions avec votre représentant légal — une recommandation, non un verrou. La seule règle ferme liée à l'âge interdit aux utilisateurs de traiter ou stocker les informations personnelles d'enfants de moins de 13 ans en violation du COPPA, ce qui encadre ce que les utilisateurs peuvent faire plutôt que qui peut s'inscrire. Les parents évaluant cet outil ne devraient pas lire l'absence de verrou comme une assurance d'adéquation.
Trois noms se rattachent à ce produit : la marque Z.ai, l'identité antérieure Zhipu AI, et l'entité contractante singapourienne JINGSHENG HENGXING TECHNOLOGY PTE.LTD, également désignée responsable du traitement. Pour la plupart des particuliers cela importe peu ; pour les organisations soumises à des règles de résidence des données ou de pays d'origine, non — et l'immatriculation à Singapour ne résout pas à elle seule les interrogations concernant une société que VentureBeat décrit comme une jeune pousse chinoise d'IA. Évaluez au regard de votre politique réelle plutôt que d'une ligne en pied de page.
La politique de confidentialité autorise la divulgation à tout partenaire commercial, investisseur, cessionnaire ou cessionnaire potentiel afin de faciliter des transactions sur actifs, s'étendant aux fusions, acquisitions ou cessions de dettes ou d'actifs. Usuel dans le secteur, et bon à savoir : le dépositaire de vos données peut changer sans votre intervention.
Un avis permanent en bas de l'interface indique que tout le contenu est généré par IA et fourni à titre indicatif. Le produit ne revendique pas l'exactitude, et vous ne devriez pas la revendiquer en son nom.
La documentation publique est détaillée sur les tarifs d'API, les coefficients de crédits et la mécanique des quotas — et comparativement silencieuse sur les limites propres au produit de conversation gratuit. Plafonds de messages, limites de débit et durées de conservation des conversations n'ont pas été trouvés dans les éléments consultés. C'est une lacune d'information, signalée ici plutôt que comblée par conjecture.
Au cours d'une même session de recherche, ce produit a affiché GLM-5.2 dans le titre de sa page, GLM-4.7 dans son sélecteur de modèle et GLM-5.3 dans son lien de blog et sa documentation. Les références de version de toute source secondaire — y compris cette page — se périment rapidement. Vérifiez dans l'interface elle-même ce qui est actuellement servi.
L'interface de conversation est gratuite, et les messages de console de la plateforme la décrivent comme une alternative gratuite à ChatGPT fondée sur l'open source. Deux précisions comptent. D'abord, « gratuit » vaut pour le produit conversationnel ; l'API est facturée au jeton et le GLM Coding Plan est un abonnement payant à partir de 18 $ par mois. Ensuite, la documentation publique examinée ne publie ni plafond de messages ni limite de débit pour le palier gratuit, aucun chiffre précis ne peut donc être cité — il s'agit d'une lacune dans l'information disponible, non d'une garantie d'usage illimité.
Oui, il s'agit bien du fournisseur de première partie. VentureBeat, dans un reportage indépendant, identifie l'entreprise comme la jeune pousse chinoise d'IA Z.ai, anciennement Zhipu AI — l'organisation qui développe les modèles GLM. L'entité contractante et responsable du traitement nommée dans les conditions et la politique de confidentialité est une société singapourienne, JINGSHENG HENGXING TECHNOLOGY PTE.LTD. Donc : Z.ai la marque, Zhipu AI l'ancien nom, l'entité singapourienne la contrepartie juridique.
La documentation présente actuellement GLM-5.3 comme le vaisseau amiral pour l'ingénierie logicielle et le travail d'agent, GLM-5V-Turbo pour la programmation visuelle, GLM-Image pour la génération d'images à partir de texte et CogVideoX-3 pour la vidéo. L'interface comporte un sélecteur de modèle, et la grille tarifaire de l'API couvre un ensemble plus large incluant GLM-5.2, GLM-5, GLM-4.7 et les paliers Flash gratuits. La disponibilité varie selon la voie — GLM-5.3 est arrivé sur le Coding Plan et ZCode avant l'API et les poids ouverts.
En grande partie, avec une réserve de calendrier. VentureBeat a confirmé que les poids fondamentaux de GLM-5.2 avaient été publiés sous licence MIT sans restriction et étaient téléchargeables depuis Hugging Face pour l'auto-hébergement et l'affinage. Le même média a toutefois rapporté que GLM-5.3 était d'abord sorti comme produit réservé aux abonnés, les poids étant prévus environ deux semaines après le lancement, sous réserve d'évaluation de sécurité. Vérifiez la licence de la version précise dont vous avez besoin.
Par million de jetons : GLM-5.3 et GLM-5.2 à 1,4 $ en entrée et 4,4 $ en sortie ; GLM-5 à 1 $ et 3,2 $ ; GLM-4.7 à 0,6 $ et 2,2 $ ; GLM-4.7-FlashX à 0,07 $ et 0,4 $. L'entrée en cache coûte sensiblement moins. GLM-4.7-Flash, GLM-4.5-Flash et GLM-4.6V-Flash sont affichés gratuits. Outils et médias sont facturés séparément : recherche web à 0,01 $ l'appel, GLM-Image à 0,015 $ l'image, CogVideoX-3 à 0,2 $ la vidéo.
Chaque palier comporte deux limites simultanées. Lite offre 2 000 crédits sur cinq heures et 10 000 par semaine ; Pro 12 000 et 60 000 ; Max 28 000 et 140 000. Les crédits quinquehoraires se rechargent cinq heures après consommation ; les hebdomadaires se réinitialisent tous les sept jours. Les crédits se calculent à partir des jetons d'entrée, d'entrée en cache et de sortie multipliés par des coefficients propres à chaque modèle puis divisés par 10 000, la sortie pesant le plus lourd. Point décisif : l'usage en heures creuses est facturé à 50 % du tarif standard, les heures pleines étant du lundi au vendredi de 14h00 à 18h00, heure de Singapour.
Vous attendez. La FAQ officielle indique que le système ne prélèvera rien sur le solde du compte et qu'une fois le quota consommé, il faut attendre le cycle de cinq heures suivant pour qu'il se recharge. Cela évite les frais imprévus, mais signifie aussi que le travail s'arrête au lieu de se poursuivre à un niveau inférieur. Notez également que la formule est strictement limitée aux outils officiellement pris en charge.
Effectivement oui. Les conditions vous demandent d'autoriser l'usage et le stockage du contenu utilisateur ne constituant pas des données personnelles pour développer et améliorer les technologies d'apprentissage automatique et d'IA de l'entreprise, et la politique de confidentialité mentionne l'entraînement et l'amélioration des modèles parmi ses finalités. Aucune faculté d'opposition n'apparaît dans la documentation consultée. Gardez les éléments confidentiels hors du produit conversationnel gratuit.
Aucun âge minimum explicite n'est indiqué. Les conditions disent seulement que les mineurs au regard des lois de leur pays ou État devraient examiner les conditions avec un représentant légal, ce qui relève de la recommandation plutôt que de la restriction. La seule règle ferme interdit de traiter ou stocker les informations personnelles d'enfants de moins de 13 ans en violation du COPPA — une contrainte sur la conduite des utilisateurs, non un verrou à l'inscription.
Oui, et c'est un objectif de conception assumé. Le GLM Coding Plan prend en charge Claude Code, Kilo Code, Cline et OpenCode entre autres, et VentureBeat a rapporté que GLM-5.2 était disponible dès son lancement dans plus de vingt environnements de codage tiers. Pour une intégration directe, l'API est compatible avec le SDK OpenAI, si bien que migrer une intégration OpenAI existante se résume souvent à changer l'URL de base et la clé.
Comment utiliser Z.ai Chat
Étape 1 — Ouvrir la conversation avant de créer un compte
Rendez-vous sur chat.z.ai. L'interface présente une zone de saisie, un sélecteur de modèle et les cinq raccourcis de tâches. Commencer par un raccourci est un premier geste raisonnable : ils démontrent l'orientation « fabriquer quelque chose » du produit plus vite qu'une question ouverte.
Étape 2 — Choisir son modèle délibérément
Utilisez le sélecteur plutôt que d'accepter la valeur par défaut. Pour une question factuelle rapide, un modèle léger répond plus vite ; pour une tâche de codage en plusieurs étapes, sélectionnez le vaisseau amiral. Prendre l'habitude d'adapter le modèle à la tâche est le gain de qualité par seconde le plus important à portée de main.
Étape 3 — Formuler les tâches longues comme des tâches, pas comme des questions
Le produit est optimisé pour le travail autonome prolongé. Plutôt que d'enchaîner de petites questions, décrivez l'objectif complet, les contraintes et l'aspect qu'aurait un résultat abouti. C'est jouer avec l'architecture plutôt que contre elle.
Étape 4 — Activer les outils quand la réponse dépend de faits actuels
Pour tout ce qui est sensible au temps ou vérifiable de l'extérieur, recourez à la recherche et à la lecture web plutôt qu'aux données d'entraînement du modèle. La connaissance paramétrique de tout modèle a une date limite ; la récupération est le moyen de la contourner.
Étape 5 — Vérifier tout ce qui porte à conséquence
L'interface affiche en permanence un avis indiquant que tout le contenu est généré par IA et fourni à titre indicatif. Traitez cela comme une consigne opérationnelle et non comme une formule juridique — en particulier pour le code, les chiffres et les citations.
Étape 6 — Passer à l'API ou au Coding Plan si l'usage s'intensifie
Si vous utilisez la fenêtre de conversation comme un flux de travail et non comme une curiosité, les deux voies payantes vous attendent. L'API est facturée au jeton pour l'intégration programmatique ; le GLM Coding Plan est un abonnement destiné à Claude Code, Cline et outils similaires. Lisez la mécanique des quotas dans la section des limites avant de choisir.