¿Has usado esta herramienta? Valórala
¿Has usado esta herramienta? Valórala
Z.ai Chat es el chatbot GLM de primera parte: la interfaz conversacional oficial de la familia de grandes modelos de lenguaje GLM. Esa distinción pesa más de lo que parece, porque la mayoría de los sitios que se presentan como «alternativa gratuita a ChatGPT» son revendedores que envuelven la API de otro. Aquí no ocurre eso: lo opera la empresa que construye los modelos, y la portada declara su propósito sin rodeos: un asistente de IA impulsado por GLM con el que crear sitios web, escribir código, afrontar tareas de largo recorrido y obtener respuestas inmediatas.
El panorama corporativo tiene tres capas que conviene desenredar, porque cada una aparece en un lugar distinto. La marca pública es Z.ai. VentureBeat, en su cobertura independiente del lanzamiento de GLM-5.2, identifica a la compañía como «la startup china de IA Z.ai (antes Zhipu AI)», de modo que Z.ai es la identidad internacional de la organización antes conocida como Zhipu. Sin embargo, la entidad contratante y responsable del tratamiento de datos no es ninguno de esos nombres: las condiciones de uso definen Z.ai como la plataforma operada por JINGSHENG HENGXING TECHNOLOGY PTE.LTD, sociedad singapurense registrada en International Plaza, y la política de privacidad señala a esa misma entidad como responsable del tratamiento de sus datos personales. Si su evaluación afecta a la jurisdicción o al gobierno del dato, la entidad singapurense es la que cuenta jurídicamente.
Lo que distingue a este producto del abarrotado campo de asistentes conversacionales gratuitos es que los modelos subyacentes son en gran medida de pesos abiertos. VentureBeat confirma que los pesos fundamentales de GLM-5.2 se publicaron bajo una licencia de código abierto MIT sin restricciones, descargables desde Hugging Face para afinado local y autoalojamiento. La interfaz de chat es, por tanto, una puerta de entrada cómoda a un modelo que en principio usted mismo podría ejecutar. Muy pocos asistentes gratuitos pueden decir lo mismo.
Una aclaración de entrada, porque es la fuente de confusión más habitual: Z.ai mantiene dos vías comerciales fáciles de mezclar. La interfaz de chat en chat.z.ai es el producto de consumo gratuito. Aparte existe una plataforma de desarrollo de pago: una API medida por tokens y una suscripción GLM Coding Plan desde 18 dólares al mes. Las cifras de precios de este artículo van etiquetadas por vía, porque la lista de tarifas de la API no describe lo que se paga por usar la ventana de conversación.
En lugar de presentar un opaco «mejor modelo», Z.ai expone toda la familia y deja elegir. La documentación oficial define con claridad los papeles actuales: GLM-5.3 se describe como el buque insignia más reciente, con avances integrales en ingeniería de software y capacidades de agente; GLM-5V-Turbo es un modelo multimodal de codificación especializado en programación visual; GLM-Image admite generación de imágenes a partir de texto, reivindicada como estado del arte de código abierto en escenas complejas; y CogVideoX-3 se encarga de la generación de vídeo.
La interfaz incorpora un selector de modelo en la parte superior, de modo que cambiar es un clic y no una excavación por los ajustes. Importa más de lo que suena: un modelo más ligero suele responder antes y basta de sobra para preguntas rutinarias, y poder bajar un escalón deliberadamente supone una ventaja ergonómica real.
El propio título del producto empareja «Chatbot» con «Agent», y la lista de capacidades arranca con las tareas de largo recorrido. Es el eje en el que la compañía ha invertido de forma más visible. La cobertura independiente de VentureBeat describe GLM-5.2 como un modelo diseñado específicamente para dominar tareas autónomas prolongadas de codificación e ingeniería, y aporta resultados de referencia justo en ese eje: 62,1 en SWE-bench Pro frente al 58,6 de GPT-5.5, y 74,4 % en FrontierSWE, un banco de pruebas concebido para medir la finalización de tareas prolongadas.
Los suscriptores disponen de una capa de herramientas adicional. El GLM Coding Plan concede acceso MCP exclusivo a comprensión visual, búsqueda web, lectura de páginas y Zread: las capacidades que permiten al modelo consultar y leer páginas en lugar de responder únicamente desde sus parámetros.
El reportaje de VentureBeat atribuye a GLM-5.2 una ventana de contexto de un millón de tokens notablemente estable. Cabe destacar que no se queda en cifra de titular: la misma cobertura describe una optimización arquitectónica llamada IndexShare, que reutiliza el mismo indexador cada cuatro capas de atención dispersa y reduce así el cómputo por token unas 2,9 veces en la longitud máxima de contexto. Dicho de otro modo, ese contexto largo está diseñado para resultar económicamente utilizable, no meramente disponible sobre el papel.
Escribir código no es aquí una capacidad accesoria: el producto se posiciona tanto como agente de programación cuanto como asistente conversacional. La interfaz incluye un punto de entrada ZCode dedicado junto al selector de modelo, y el producto por suscripción está construido explícitamente en torno al trabajo de desarrollo. Según la documentación oficial, el GLM Coding Plan se aplica a herramientas como Claude Code, Cline y OpenCode, y admite programación en lenguaje natural —describir requisitos en lenguaje llano para generar planes, escribir código y depurar— además de autocompletado de código consciente del contexto en tiempo real.
La interfaz siembra cinco atajos de tareas justo debajo del cuadro de entrada: páginas de aterrizaje, divulgación científica y planes de clase, modelado 3D, juegos pequeños y blogs personales. Son andamiaje de incorporación más que funciones distintas, pero están bien escogidos: cada uno representa una tarea que termina en algo completo en lugar de una simple pregunta, lo que orienta a los recién llegados hacia la verdadera fortaleza del producto.
La plataforma se describe como pensada para usuarios de chino e inglés, y la interfaz renderizada lo confirma, mezclando controles en inglés con saludos y atajos en chino. Para quien trabaja entre esas dos lenguas, un modelo cuyo entrenamiento y diseño tratan el chino como lengua de primer orden y no como añadido tardío supone una diferencia significativa.
Para quienes desean construir sobre los modelos en lugar de conversar con ellos, la documentación traza un camino completo: una API HTTP RESTful estándar compatible con todos los lenguajes de programación, SDK oficiales de Python y Java, y compatibilidad con el SDK de OpenAI para migrar con rapidez desde OpenAI. El punto final es api.z.ai/api/paas/v4/chat/completions, y esa compatibilidad implica que una integración existente a menudo solo necesita cambiar la URL base y la clave.
El caso mejor respaldado. Entre la superficie ZCode, la integración con herramientas de terceros y un rendimiento de referencia concentrado en SWE-bench Pro y FrontierSWE, aquí es donde apunta el producto y donde las pruebas independientes resultan más sólidas.
Un flujo de trabajo infravalorado y propio de los proveedores de pesos abiertos. Como los pesos de GLM se descargan bajo MIT, los equipos que barajan el autoalojamiento pueden usar la interfaz gratuita para evaluar el comportamiento del modelo en sus problemas reales antes de comprometer infraestructura. La ventana de chat se convierte en un banco de pruebas sin coste.
Las tarifas publicadas sitúan GLM-4.7 en 0,6 dólares por millón de tokens de entrada y 2,2 de salida, con varios modelos de gama Flash listados sin coste. Para volúmenes altos y baja complejidad —clasificación, extracción, resúmenes rutinarios— ese precio cambia lo que resulta económicamente viable.
Con búsqueda web y lectura de páginas disponibles como herramientas, el asistente puede anclar respuestas en páginas recuperadas y no solo en la memoria paramétrica. Útil para cuestiones de actualidad y rastreo bibliográfico, con la salvedad habitual: la recuperación reduce la fabulación pero no la elimina.
La orientación chino-inglés lo convierte en una opción práctica para traducción, redacción en varias lenguas y revisión de localización, tareas en las que los modelos entrenados sobre todo con datos en inglés suelen producir un chino técnicamente correcto pero de tono desajustado.
Redactar, reescribir, explicar, generar ideas. La mayoría poco vistosa del uso de un asistente, resuelta con solvencia y sin coste.
Entre en chat.z.ai. La interfaz presenta un cuadro de entrada, un selector de modelo y los cinco atajos de tareas. Empezar por un atajo es un primer movimiento razonable: demuestran la orientación del producto a fabricar algo más deprisa que una pregunta abierta.
Use el selector en lugar de aceptar el valor por defecto. Para una consulta factual rápida, un modelo ligero responde antes; para una tarea de programación en varios pasos, escoja el buque insignia. Adquirir el hábito de ajustar el modelo a la tarea es la mayor mejora de calidad por segundo a su alcance.
El producto está optimizado para trabajo autónomo prolongado. En vez de encadenar preguntas pequeñas, describa el objetivo completo, las restricciones y el aspecto que tendría un resultado terminado. Es jugar con la arquitectura y no contra ella.
Para cualquier asunto sensible al tiempo o verificable externamente, recurra a la búsqueda y lectura web en lugar de a los datos de entrenamiento del modelo. El conocimiento paramétrico de cualquier modelo tiene fecha de corte; la recuperación es la forma de sortearla.
La propia interfaz muestra de manera permanente un aviso de que todo el contenido está generado por IA y se ofrece solo como referencia. Trátelo como una indicación operativa y no como una fórmula legal, sobre todo en el caso del código, las cifras y las citas.
Si ha acabado usando la ventana de chat como un flujo de trabajo y no como una curiosidad, le esperan las dos vías de pago. La API se mide por tokens para la integración programática; el GLM Coding Plan es una suscripción para trabajar dentro de Claude Code, Cline y herramientas similares. Lea la mecánica de cuotas en el apartado de limitaciones antes de decidir.
El consejo más aplicable y menos publicitado. La documentación indica que en horas valle el uso de los modelos se cobra al 50 % de la tarifa estándar en créditos, y define las horas punta como de lunes a viernes de 14:00 a 18:00, hora estándar de Singapur. Desplazar el procesamiento por lotes fuera de esa ventana de cuatro horas entre semana duplica literalmente su cuota efectiva. Ninguna reseña de terceros sobre este producto lo menciona.
La cuota de suscripción se expresa en créditos, calculados como tokens de entrada por un multiplicador de entrada, más entrada en caché por el suyo, más tokens de salida por un multiplicador de salida, todo dividido entre 10.000. La salida pesa mucho más que la entrada: en GLM-5.3 los multiplicadores son 6,9 de entrada, 1,7 de caché y 24 de salida. La consecuencia práctica es que las salidas verbosas cuestan bastante más que las entradas largas. Pedir respuestas concisas es una estrategia de cuota, no solo una preferencia de estilo.
La entrada en caché se cobra a una fracción de la entrada nueva, tanto en la lista de la API como en los multiplicadores de créditos. Si envía repetidamente la misma instrucción de sistema o el mismo documento, estructurar las peticiones para que el contenido estable quede en posición cacheable reduce el coste de forma apreciable.
Varios modelos figuran con coste cero en la tabla oficial. Para tareas simples de gran volumen, encaminarlas a una gama Flash gratuita y reservar el buque insignia para los problemas realmente difíciles es aritmética elemental.
La disponibilidad difiere según la vía. VentureBeat informó de que GLM-5.3 solo era accesible al principio a través del GLM Coding Plan y el entorno ZCode, y de que el acceso por API y los pesos abiertos llegaron después. Compruebe qué superficie expone el modelo que desea antes de planificar en torno a él.
Si el autoalojamiento está sobre la mesa, use la interfaz gratuita de forma sistemática —mismos prompts, misma rúbrica, a través de las gamas de modelos— antes de descargar pesos. Es la evaluación previa al despliegue más barata posible.
Las condiciones autorizan expresamente el uso del contenido de usuario que no constituya datos personales para desarrollar y mejorar las tecnologías de aprendizaje automático e IA de la compañía. Es habitual en la IA de consumo gratuita, y es también motivo para mantener el código propietario y los documentos confidenciales fuera de la ventana gratuita.
Desarrolladores y equipos de ingeniería. El encaje más sólido con diferencia. Entre bancos de pruebas centrados en código, integración con herramientas de terceros y precios agresivos, el producto está construido en torno a este público.
Equipos que evalúan modelos de pesos abiertos. Cualquier organización cuya vía de adquisición pueda terminar en autoalojamiento se beneficia de una interfaz gratuita y de primera parte hacia modelos que después podrá descargar bajo MIT.
Constructores sensibles al coste. Startups y particulares para quienes el precio de las API de modelos punteros resulta prohibitivo, y quien simplemente quiera un asistente de IA gratuito competente sin suscripción. Las tarifas publicadas y las gamas gratuitas cambian sustancialmente la aritmética.
Usuarios bilingües de chino e inglés. Un modelo diseñado con el chino como lengua de primer orden y no como destino de traducción.
Investigadores y analistas. Las herramientas de recuperación junto a una ventana de contexto muy grande encajan con el trabajo analítico cargado de documentos.
Quiénes deberían mirar otra cosa. Quien necesite el ecosistema de complementos de terceros más profundo seguirá encontrando a ChatGPT por delante. Las organizaciones con políticas que restringen el tratamiento de datos por empresas de vinculación china deben contrastar la estructura de la entidad singapurense con sus propias reglas de cumplimiento, en lugar de suponer que la constitución en Singapur zanja la cuestión. Quien precise garantías empresariales documentadas —SLA, certificaciones de cumplimiento auditadas— deberá verificarlas por separado: la documentación pública revisada aquí no las cubre.
Z.ai Chat es una aplicación web accesible desde el navegador en chat.z.ai. Las propiedades circundantes se reparten por función: z.ai alberga el sitio de marketing, la entrada de suscripción y el blog técnico; docs.z.ai contiene la documentación para desarrolladores; api.z.ai atiende el tráfico de la API; y los acuerdos legales residen bajo chat.z.ai/legal-agreement/.
El acceso a la API está pensado para la portabilidad. La documentación ofrece una API HTTP RESTful estándar compatible con todos los lenguajes, SDK oficiales de Python y Java, y compatibilidad con el SDK de OpenAI planteada explícitamente como vía de migración, con el punto final en api.z.ai/api/paas/v4/chat/completions.
El alcance supera con creces las superficies propias. VentureBeat informó de que GLM-5.2 estuvo disponible desde el primer momento en Hugging Face, en la API de Z.ai y en más de veinte entornos de codificación de terceros, lo que significa que a menudo puede usar estos modelos dentro de herramientas que ya tiene. La documentación de la suscripción nombra a Claude Code, Cline y OpenCode entre los clientes admitidos, y la página de suscripción añade Kilo Code y otros.
La interfaz es bilingüe, y la plataforma se describe como pensada para usuarios de chino e inglés. La documentación revisada no recogía aplicaciones móviles nativas, por lo que aquí no se afirma nada sobre su disponibilidad.
Tres vías, con precios distintos. Confundirlas es el error más frecuente en las reseñas ajenas de este producto.
La interfaz de chat es gratuita. Los propios mensajes de consola de Z.ai describen el producto como una alternativa gratuita a ChatGPT basada en código abierto. La documentación pública revisada aquí no publica límites de mensajes ni de frecuencia para la gama gratuita, de modo que no se indica ningún límite concreto: la ausencia de un límite publicado no prueba que no exista.
La API se mide por tokens, con tarifas por millón: GLM-5.3 y GLM-5.2 a 1,4 dólares de entrada y 4,4 de salida; GLM-5 a 1 y 3,2; GLM-4.7 a 0,6 y 2,2; GLM-4.7-FlashX a 0,07 y 0,4. La entrada en caché resulta mucho más barata —0,26 dólares en la gama insignia— y su almacenamiento figura como gratuito por tiempo limitado. Cabe destacar que GLM-4.7-Flash, GLM-4.5-Flash y GLM-4.6V-Flash aparecen sin coste tanto en entrada como en salida. Las capacidades multimodales se tarifan aparte: búsqueda web a 0,01 dólares por uso, GLM-Image a 0,015 por imagen, CogVideoX-3 a 0,2 por vídeo y GLM-ASR-2512 a unos 0,0024 por minuto.
El GLM Coding Plan es una suscripción que arranca en 18 dólares mensuales según la página oficial, y cubre GLM-5.3, GLM-5.2 y GLM-5-Turbo dentro de Claude Code, Kilo Code, Cline, OpenCode y otros. Se ofrece en tres gamas con cuotas dobles: Lite con 2.000 créditos de cinco horas y 10.000 semanales; Pro con 12.000 y 60.000; Max con 28.000 y 140.000. Los créditos de cinco horas se reponen dinámicamente cinco horas después del consumo; los semanales se reinician cada siete días desde la suscripción. El descuento en horas valle mencionado más arriba duplica en la práctica la capacidad del trabajo programado fuera de las tardes laborables singapurenses.
Como referencia sobre la volatilidad de los precios, la cobertura de VentureBeat de junio de 2026 citaba gamas de suscripción empresarial desde 12,60 dólares al mes, por debajo de los 18 que figuran ahora. Los precios promocionales se mueven claramente; consulte las tarifas vigentes en lugar de fiarse de cualquier cifra citada en un artículo, incluido este.
ChatGPT sigue siendo la referencia en amplitud: el mayor ecosistema de complementos e integraciones, la experiencia móvil más pulida, el utillaje de terceros más profundo. Z.ai compite en precio y pesos abiertos, no en madurez de ecosistema.
Claude es la comparación habitual para código y documentos extensos, y conviene notar que el GLM Coding Plan está diseñado para ejecutarse dentro de Claude Code: para desarrolladores que quieren conservar su utillaje y cambiar solo el modelo de fondo, ambos productos son tanto complementarios como competidores.
DeepSeek es el análogo estructural más próximo: otro laboratorio chino que publica modelos potentes de pesos abiertos con precios agresivos. Elegir entre ambos suele depender del ajuste de los bancos de pruebas a su carga concreta más que de una diferencia categórica.
Gemini ofrece integración profunda con Google Workspace y un contexto muy grande. El reportaje de referencias de VentureBeat situó a GLM-5.2 bastante por delante de Gemini 3.1 Pro en Terminal-Bench 2.1 —81,0 frente a 74,0—, aunque estas ventajas son estrechas y cambian con cada lanzamiento.
Autoalojar GLM directamente merece mención como la alternativa exclusiva de este proveedor. Al estar los pesos con licencia MIT en Hugging Face, una organización puede ejecutar el mismo modelo en su propia infraestructura: sin dependencia del proveedor, sin que los datos salgan del perímetro, a cambio de capacidad de GPU y esfuerzo operativo.
Resumen honesto: los rasgos diferenciales de Z.ai Chat son los pesos abiertos, unos precios agresivos y una capacidad de agente orientada al código. Sus desventajas frente a ChatGPT son la profundidad del ecosistema y el acabado móvil. Para un público concreto y creciente —desarrolladores a quienes importan el coste y la portabilidad— el intercambio compensa.
Los materiales del proveedor y la cobertura entusiasta tienden a pintar un triunfo limpio. El periodismo independiente es más matizado. La propia tabla de VentureBeat muestra a GLM-5.2 ganando con claridad en algunas medidas —62,1 en SWE-bench Pro frente al 58,6 de GPT-5.5— y quedando por detrás en otras: en las puntuaciones brutas de Terminal-Bench 2.1 alcanzó 81,0 frente al 85,0 de Claude 4.8 y el 84,0 de GPT-5.5, mientras que en esa misma medida supera con holgura a Gemini 3.1 Pro. La lectura precisa es «competitivo en la frontera con una fortaleza específica en codificación de largo recorrido», no «gana en todo». Además, los bancos de pruebas envejecen deprisa.
El relato de los pesos abiertos lleva un asterisco importante. VentureBeat informó de que GLM-5.3 solo estuvo disponible al principio mediante el GLM Coding Plan y el entorno ZCode, y de que el acceso por API y los pesos abiertos llegarían después, una vez completadas la evaluación de seguridad y el endurecimiento, con la intención declarada de publicar los pesos unas dos semanas tras el lanzamiento. Es decir, el modelo más nuevo es temporalmente un producto cerrado tras suscripción. Si su plan depende de que los pesos sean descargables, verifique la disponibilidad de la versión concreta en lugar de suponer que la licencia de la familia se aplica de manera uniforme.
Antes de contratar merecen atención dos reglas documentadas. El GLM Coding Plan está estrictamente limitado a herramientas y productos oficialmente admitidos, y se advierte a los suscriptores de que no deben usar las ventajas de la suscripción en herramientas o escenarios no admitidos: no es un saldo de créditos de uso general. Y cuando la cuota se agota, según el FAQ oficial, hay que esperar al siguiente ciclo de cinco horas, y el sistema no descontará del saldo de la cuenta. Resulta favorable al usuario, porque evita cargos sorpresa, pero también implica que tocar techo detiene el trabajo en vez de degradarlo.
Cada plan lleva a la vez un límite de cinco horas y otro semanal. Es perfectamente posible que quede cuota semanal mientras la ventana de cinco horas bloquea, o al revés. Quien planifique ráfagas intensivas debería modelar ambas restricciones.
Las condiciones exigen autorización expresa para que la compañía utilice y almacene el contenido de usuario que no constituya datos personales con el fin de desarrollar y mejorar sus tecnologías de aprendizaje automático e inteligencia artificial. La política de privacidad enumera por separado el entrenamiento y la mejora de modelos entre sus intereses legítimos, e indica que puede obtener información públicamente disponible en internet para entrenar modelos. En el material revisado no se documenta ninguna vía de exclusión. Para una IA de consumo gratuita no es llamativo, pero debería condicionar lo que se pega en la ventana.
No se indica ninguna edad mínima de registro. Las condiciones se limitan a decir que quien sea menor conforme a las leyes de su país o estado de residencia debería revisar estas condiciones con su representante legal: una orientación, no una barrera. La única regla firme ligada a la edad prohíbe a los usuarios tratar o almacenar información personal de menores de 13 años de forma que vulnere la COPPA, lo que regula qué pueden hacer los usuarios y no quién puede registrarse. Los progenitores que evalúen esta herramienta no deberían leer la ausencia de barrera como una garantía de idoneidad.
Al producto se asocian tres nombres: la marca Z.ai, la identidad previa Zhipu AI y la entidad contratante singapurense JINGSHENG HENGXING TECHNOLOGY PTE.LTD, que además figura como responsable del tratamiento. Para la mayoría de usuarios particulares esto es irrelevante; para organizaciones con políticas de residencia de datos o país de origen, no lo es, y la constitución en Singapur no resuelve por sí sola las dudas sobre una compañía que VentureBeat describe como startup china de IA. Evalúe conforme a su política real y no a una línea del pie de página.
La política de privacidad permite la comunicación a cualquier socio comercial, inversor, cesionario o cesionario potencial para facilitar operaciones sobre activos del negocio, extendiéndose a fusiones, adquisiciones o ventas de deuda o activos. Es estándar en el sector, y conviene saberlo: el custodio de sus datos puede cambiar sin su intervención.
Un aviso permanente en la parte inferior de la interfaz señala que todo el contenido está generado por IA y se ofrece solo como referencia. El producto no reivindica exactitud, y usted tampoco debería reivindicarla en su nombre.
La documentación pública es minuciosa sobre tarifas de API, multiplicadores de créditos y mecánica de cuotas, y comparativamente silenciosa sobre los límites del propio producto de chat gratuito. Los topes de mensajes, los límites de frecuencia y los plazos de conservación de las conversaciones no aparecieron en el material revisado. Es una laguna de información, señalada aquí en lugar de rellenada con conjeturas.
En una sola sesión de investigación, este producto mostró GLM-5.2 en el título de su página, GLM-4.7 en su selector de modelo y GLM-5.3 en el enlace del blog y la documentación. Las referencias de versión de cualquier fuente secundaria —incluida esta página— caducan enseguida. Compruebe en la propia interfaz qué se está sirviendo ahora.
La interfaz de chat puede usarse gratis, y los mensajes de consola de la plataforma la describen como una alternativa gratuita a ChatGPT basada en código abierto. Importan dos matices. Primero, «gratuito» se aplica al producto de chat; la API se mide por tokens y el GLM Coding Plan es una suscripción de pago desde 18 dólares al mes. Segundo, la documentación pública revisada no publica topes de mensajes ni límites de frecuencia para la gama gratuita, de modo que no puede citarse ninguna cifra concreta: es una laguna en la información disponible, no una garantía de uso ilimitado.
Sí, es un producto de primera parte. VentureBeat, en cobertura independiente, identifica a la compañía como la startup china de IA Z.ai, antes Zhipu AI: la organización que desarrolla los modelos GLM. La entidad contratante y responsable del tratamiento nombrada en las condiciones y la política de privacidad es una sociedad singapurense, JINGSHENG HENGXING TECHNOLOGY PTE.LTD. En resumen: Z.ai la marca, Zhipu AI el nombre anterior y la entidad singapurense la contraparte jurídica.
La documentación presenta actualmente GLM-5.3 como buque insignia para ingeniería de software y trabajo de agente, GLM-5V-Turbo para programación visual, GLM-Image para generación de imágenes a partir de texto y CogVideoX-3 para vídeo. La interfaz incluye un selector de modelo, y la lista de precios de la API abarca un conjunto más amplio que incluye GLM-5.2, GLM-5, GLM-4.7 y las gamas Flash gratuitas. La disponibilidad difiere según la vía: GLM-5.3 llegó al Coding Plan y a ZCode antes que a la API y a los pesos abiertos.
En gran medida, con una salvedad temporal. VentureBeat confirmó que los pesos fundamentales de GLM-5.2 se publicaron bajo licencia MIT sin restricciones y son descargables desde Hugging Face para autoalojamiento y afinado. Sin embargo, ese mismo medio informó de que GLM-5.3 salió primero como producto exclusivo para suscriptores, con los pesos previstos unas dos semanas después del lanzamiento a la espera de la evaluación de seguridad. Verifique la licencia de la versión concreta que necesite.
Por millón de tokens: GLM-5.3 y GLM-5.2 a 1,4 dólares de entrada y 4,4 de salida; GLM-5 a 1 y 3,2; GLM-4.7 a 0,6 y 2,2; GLM-4.7-FlashX a 0,07 y 0,4. La entrada en caché cuesta bastante menos. GLM-4.7-Flash, GLM-4.5-Flash y GLM-4.6V-Flash figuran sin coste. Herramientas y medios se tarifan aparte: búsqueda web a 0,01 dólares por uso, GLM-Image a 0,015 por imagen, CogVideoX-3 a 0,2 por vídeo.
Cada gama lleva dos límites simultáneos. Lite ofrece 2.000 créditos de cinco horas y 10.000 semanales; Pro 12.000 y 60.000; Max 28.000 y 140.000. Los créditos de cinco horas se reponen cinco horas después del consumo; los semanales se reinician cada siete días. Los créditos se calculan a partir de tokens de entrada, entrada en caché y salida multiplicados por los multiplicadores de cada modelo y divididos entre 10.000, con la salida como componente de mayor peso. Un punto decisivo: el uso en horas valle se cobra al 50 % de la tarifa estándar, y las horas punta son de lunes a viernes de 14:00 a 18:00, hora de Singapur.
Toca esperar. El FAQ oficial indica que el sistema no descontará del saldo de la cuenta y que, una vez consumida la cuota, hay que aguardar al siguiente ciclo de cinco horas para que se reponga. Evita cargos inesperados, pero también significa que el trabajo se detiene en lugar de continuar en una gama inferior. Tenga presente además que el plan está estrictamente limitado a herramientas oficialmente admitidas.
En la práctica sí. Las condiciones le piden autorizar el uso y almacenamiento del contenido de usuario que no constituya datos personales para desarrollar y mejorar las tecnologías de aprendizaje automático e IA de la compañía, y la política de privacidad incluye el entrenamiento y la mejora de modelos entre sus finalidades. En la documentación revisada no aparece ninguna vía de exclusión. Mantenga el material confidencial fuera del producto de chat gratuito.
No se indica ninguna edad mínima explícita. Las condiciones solo dicen que los menores conforme a las leyes de su país o estado deberían revisar las condiciones con un representante legal, lo que es orientación y no restricción. La única regla firme prohíbe tratar o almacenar información personal de menores de 13 años vulnerando la COPPA: una limitación de la conducta del usuario, no una barrera de registro.
Sí, y es un objetivo de diseño deliberado. El GLM Coding Plan admite Claude Code, Kilo Code, Cline y OpenCode, entre otros, y VentureBeat informó de que GLM-5.2 estuvo disponible desde su lanzamiento en más de veinte entornos de codificación de terceros. Para integración directa, la API es compatible con el SDK de OpenAI, de modo que migrar una integración existente de OpenAI suele reducirse a cambiar la URL base y la clave.