Já usou esta ferramenta? Avalie-a
Já usou esta ferramenta? Avalie-a
O Z.ai Chat é o chatbot GLM de primeira mão: a interface conversacional oficial da família de grandes modelos de linguagem GLM. Essa distinção pesa mais do que parece, porque a maioria dos sites que se apresentam como «alternativa gratuita ao ChatGPT» são revendedores que embrulham a API de outra pessoa. Aqui não é o caso: é operado pela empresa que constrói os modelos, e a página inicial declara o propósito sem rodeios — um assistente de IA movido a GLM com o qual construir sites, escrever código, conduzir tarefas de longo curso e obter respostas imediatas.
O retrato societário tem três camadas que vale a pena desembaraçar, pois cada uma aparece num sítio diferente. A marca pública é Z.ai. A VentureBeat, ao noticiar de forma independente o lançamento do GLM-5.2, identifica a empresa como «a startup chinesa de IA Z.ai (anteriormente Zhipu AI)» — ou seja, Z.ai é a identidade internacional da organização antes conhecida por Zhipu. A entidade contratante e responsável pelo tratamento de dados, porém, não é nenhum desses nomes: as condições de utilização definem o Z.ai como a plataforma operada pela JINGSHENG HENGXING TECHNOLOGY PTE.LTD, sociedade singapurense registada no International Plaza, e a política de privacidade nomeia essa mesma entidade como responsável pelo tratamento dos seus dados pessoais. Se a sua avaliação envolve jurisdição ou governação de dados, é a entidade singapurense que conta juridicamente.
O que distingue este produto do campo apinhado de assistentes conversacionais gratuitos é que os modelos por baixo têm, em larga medida, pesos abertos. A VentureBeat confirma que os pesos centrais do GLM-5.2 foram publicados sob licença aberta MIT sem restrições, transferíveis a partir do Hugging Face para afinação local e alojamento próprio. A interface de conversa é, assim, uma porta de entrada cómoda para um modelo que, em princípio, o próprio utilizador poderia executar. Muito poucos assistentes gratuitos podem dizer o mesmo.
Um esclarecimento logo de início, por ser a fonte de confusão mais comum: o Z.ai mantém duas vias comerciais fáceis de baralhar. A interface de conversa em chat.z.ai é o produto de consumo gratuito. Em separado existe uma plataforma paga para programadores — uma API tarifada por tokens e uma subscrição GLM Coding Plan a partir de 18 dólares por mês. Os valores neste artigo estão identificados por via, porque a tabela de preços da API não descreve o que se paga para usar a janela de conversa.
Em vez de apresentar um opaco «melhor modelo», o Z.ai expõe toda a família e deixa escolher. A documentação oficial define com clareza os papéis atuais: o GLM-5.3 é descrito como a mais recente carro-chefe, com avanços abrangentes em engenharia de software e capacidades de agente; o GLM-5V-Turbo é um modelo multimodal de codificação especializado em programação visual; o GLM-Image suporta geração de imagens a partir de texto, reivindicada como estado da arte em código aberto para cenas complexas; e o CogVideoX-3 trata da geração de vídeo.
A interface traz um seletor de modelo no topo, pelo que alternar é um clique e não uma escavação nas definições. Isso importa mais do que soa: um modelo mais leve costuma responder mais depressa e chega perfeitamente para perguntas de rotina, e poder descer um degrau deliberadamente é uma vantagem ergonómica concreta.
O próprio título do produto emparelha «Chatbot» com «Agent», e a lista de capacidades abre com tarefas de longo curso. É o eixo em que a empresa mais visivelmente investiu. A cobertura independente da VentureBeat descreve o GLM-5.2 como um modelo concebido especificamente para dominar tarefas autónomas prolongadas de codificação e engenharia, e relata resultados de referência exatamente nesse eixo: 62,1 no SWE-bench Pro contra os 58,6 do GPT-5.5, e 74,4 % no FrontierSWE, um teste criado para medir a conclusão de tarefas prolongadas.
Os subscritores contam com uma camada adicional de ferramentas. O GLM Coding Plan concede acesso MCP exclusivo a compreensão visual, pesquisa na web, leitura de páginas e Zread — as capacidades que permitem ao modelo consultar e ler páginas em vez de responder apenas a partir dos seus parâmetros.
A reportagem da VentureBeat atribui ao GLM-5.2 uma janela de contexto de um milhão de tokens notavelmente estável. É de assinalar que não se fica pelo número de manchete: a mesma cobertura descreve uma otimização arquitetónica chamada IndexShare, que reutiliza o mesmo indexador a cada quatro camadas de atenção esparsa e reduz assim o cálculo por token cerca de 2,9 vezes no comprimento máximo de contexto. Por outras palavras, esse contexto longo foi projetado para ser economicamente utilizável e não apenas nominalmente disponível.
Escrever código não é aqui uma capacidade lateral: o produto posiciona-se tanto como agente de programação quanto como assistente conversacional. A interface inclui um ponto de entrada ZCode dedicado ao lado do seletor de modelo, e o produto por subscrição é explicitamente construído em torno do trabalho de desenvolvimento. Segundo a documentação oficial, o GLM Coding Plan aplica-se a ferramentas como Claude Code, Cline e OpenCode, suportando programação em linguagem natural — descrever requisitos em linguagem corrente para gerar planos, escrever código e depurar — além de conclusão de código sensível ao contexto em tempo real.
A interface coloca cinco atalhos de tarefas mesmo por baixo da caixa de entrada: páginas de destino, divulgação científica e planos de aula, modelação 3D, jogos pequenos e blogues pessoais. São andaimes de acolhimento mais do que funcionalidades distintas, mas bem escolhidos: cada um representa uma tarefa que termina em algo completo em vez de mera pergunta e resposta, o que encaminha os recém-chegados para a verdadeira força do produto.
A plataforma descreve-se como talhada para utilizadores de chinês e inglês, e a interface renderizada confirma-o, misturando controlos em inglês com saudações e atalhos em chinês. Para quem trabalha entre estas duas línguas, um modelo cujo treino e desenho tratam o chinês como língua de primeira ordem e não como acrescento tardio constitui uma diferença significativa.
Para quem quer construir sobre os modelos em vez de conversar com eles, a documentação traça um percurso completo: uma API HTTP RESTful padrão compatível com todas as linguagens de programação, SDK oficiais de Python e Java, e compatibilidade com o SDK da OpenAI para migrar depressa a partir da OpenAI. O ponto de extremidade é api.z.ai/api/paas/v4/chat/completions, e essa compatibilidade significa que uma integração existente muitas vezes só precisa de trocar o URL base e a chave.
O caso mais bem sustentado. Entre a superfície ZCode, a integração com ferramentas de terceiros e um desempenho de referência concentrado em SWE-bench Pro e FrontierSWE, é para aqui que o produto aponta e onde as provas independentes são mais fortes.
Um fluxo de trabalho subvalorizado e próprio dos fornecedores de pesos abertos. Como os pesos GLM se transferem sob MIT, equipas que ponderam alojamento próprio podem usar a interface gratuita para avaliar o comportamento do modelo nos seus problemas reais antes de comprometer infraestrutura. A janela de conversa torna-se um banco de ensaio de custo nulo.
As tarifas publicadas colocam o GLM-4.7 em 0,6 dólares por milhão de tokens de entrada e 2,2 de saída, com vários modelos da gama Flash listados sem custo. Para volumes elevados e baixa complexidade — classificação, extração, resumos de rotina — esse preço altera aquilo que é economicamente viável.
Com pesquisa na web e leitura de páginas disponíveis como ferramentas, o assistente pode ancorar respostas em páginas recuperadas em vez de apenas na memória paramétrica. Útil para questões de atualidade e varrimento bibliográfico, com a ressalva habitual: a recuperação reduz a fabulação mas não a elimina.
A orientação sino-inglesa torna-o uma escolha prática para tradução, redação entre línguas e revisão de localização — tarefas em que modelos treinados sobretudo com dados em inglês produzem muitas vezes um chinês tecnicamente correto mas de tom desajustado.
Rascunhar, reescrever, explicar, gerar ideias. A maioria pouco vistosa do uso de um assistente, resolvida com competência e sem custo.
Vá a chat.z.ai. A interface apresenta uma caixa de entrada, um seletor de modelo e os cinco atalhos de tarefas. Começar por um atalho é uma primeira jogada sensata: mostram a orientação do produto para fabricar algo mais depressa do que uma pergunta aberta.
Use o seletor em vez de aceitar o valor por omissão. Para uma pergunta factual rápida, um modelo mais leve responde antes; para uma tarefa de código em vários passos, escolha a carro-chefe. Ganhar o hábito de ajustar o modelo à tarefa é o maior ganho de qualidade por segundo ao seu alcance.
O produto está otimizado para trabalho autónomo prolongado. Em vez de encadear perguntas pequenas, descreva o objetivo completo, as restrições e o aspeto de um resultado acabado. É jogar com a arquitetura e não contra ela.
Para tudo o que seja sensível ao tempo ou verificável externamente, recorra à pesquisa e leitura na web em vez dos dados de treino do modelo. O conhecimento paramétrico de qualquer modelo tem data de corte; a recuperação é a forma de a contornar.
A própria interface exibe permanentemente um aviso de que todo o conteúdo é gerado por IA e serve apenas de referência. Trate-o como orientação operacional e não como fórmula jurídica — sobretudo no caso de código, números e citações.
Se der por si a usar a janela de conversa como fluxo de trabalho e não como curiosidade, esperam-no as duas vias pagas. A API é tarifada por tokens para integração programática; o GLM Coding Plan é uma subscrição para usar dentro do Claude Code, Cline e ferramentas afins. Leia a mecânica das quotas na secção de limitações antes de escolher.
A dica mais aplicável e menos divulgada. A documentação indica que, fora das horas de ponta, o uso dos modelos é cobrado a 50 % da tarifa padrão em créditos, definindo as horas de ponta como de segunda a sexta, das 14:00 às 18:00, hora padrão de Singapura. Deslocar o processamento em lote para fora dessa janela de quatro horas em dias úteis duplica literalmente a quota efetiva. Nenhuma análise de terceiros sobre este produto o menciona.
A quota da subscrição é expressa em créditos, calculados como tokens de entrada vezes um multiplicador de entrada, mais entrada em cache vezes o seu multiplicador, mais tokens de saída vezes um multiplicador de saída, tudo dividido por 10.000. A saída pesa muito mais do que a entrada — no GLM-5.3 os multiplicadores são 6,9 na entrada, 1,7 na cache e 24 na saída. A consequência prática é que saídas prolixas custam bastante mais do que entradas longas. Pedir respostas concisas é uma estratégia de quota e não apenas uma preferência de estilo.
A entrada em cache é cobrada a uma fração da entrada nova, tanto na tabela da API como nos multiplicadores de créditos. Se envia repetidamente a mesma instrução de sistema ou o mesmo documento, estruturar os pedidos para que o conteúdo estável fique numa posição passível de cache reduz o custo de forma apreciável.
Vários modelos figuram com custo zero na tabela oficial. Para tarefas simples de grande volume, encaminhar para uma gama Flash gratuita e reservar a carro-chefe para os problemas verdadeiramente difíceis é aritmética simples.
A disponibilidade difere por via. A VentureBeat noticiou que o GLM-5.3 estava inicialmente acessível apenas através do GLM Coding Plan e do ambiente ZCode, com o acesso por API e os pesos abertos a surgirem mais tarde. Confirme que superfície expõe o modelo pretendido antes de planear em torno dele.
Se o alojamento próprio está em cima da mesa, use a interface gratuita de modo sistemático — mesmos prompts, mesma grelha, ao longo das gamas de modelos — antes de transferir pesos. É a avaliação pré-implementação mais barata que existe.
As condições autorizam expressamente o uso de conteúdo do utilizador que não constitua dados pessoais para desenvolver e melhorar as tecnologias de aprendizagem automática e IA da empresa. É comum na IA de consumo gratuita, e é também razão para manter código proprietário e documentos confidenciais fora da janela gratuita.
Programadores e equipas de engenharia. O encaixe mais forte, com larga margem. Entre testes de referência centrados em código, integração com ferramentas de terceiros e preços agressivos, o produto foi construído em torno deste público.
Equipas que avaliam modelos de pesos abertos. Qualquer organização cujo percurso de aquisição possa terminar em alojamento próprio beneficia de uma interface gratuita e de primeira mão para modelos que depois poderá transferir sob MIT.
Construtores sensíveis ao custo. Startups e particulares para quem o preço das API de modelos de ponta é proibitivo, e quem simplesmente queira um assistente de IA gratuito competente sem subscrição. As tarifas publicadas e as gamas gratuitas alteram substancialmente as contas.
Utilizadores bilingues de chinês e inglês. Um modelo desenhado com o chinês como língua de primeira ordem e não como destino de tradução.
Investigadores e analistas. As ferramentas de recuperação aliadas a uma janela de contexto muito grande servem trabalho analítico com muita documentação.
Quem deve procurar noutro lado. Quem precise do ecossistema mais profundo de extensões de terceiros continuará a encontrar o ChatGPT à frente. Organizações com políticas que restringem o tratamento de dados por empresas de ligação chinesa devem confrontar a estrutura da entidade singapurense com as suas próprias regras de conformidade, em vez de presumir que a constituição em Singapura resolve a questão. Quem necessite de garantias empresariais documentadas — SLA, certificações de conformidade auditadas — terá de as verificar à parte: a documentação pública consultada aqui não as cobre.
O Z.ai Chat é uma aplicação web acessível por navegador em chat.z.ai. As propriedades em redor repartem-se por função: z.ai acolhe o site de marketing, a entrada de subscrição e o blogue técnico; docs.z.ai contém a documentação para programadores; api.z.ai serve o tráfego da API; e os acordos legais residem sob chat.z.ai/legal-agreement/.
O acesso à API foi pensado para a portabilidade. A documentação disponibiliza uma API HTTP RESTful padrão compatível com todas as linguagens, SDK oficiais de Python e Java, e compatibilidade com o SDK da OpenAI explicitamente apresentada como caminho de migração, com o ponto de extremidade em api.z.ai/api/paas/v4/chat/completions.
O alcance ultrapassa largamente as superfícies próprias. A VentureBeat noticiou que o GLM-5.2 ficou disponível de imediato no Hugging Face, na API do Z.ai e em mais de vinte ambientes de codificação de terceiros — o que significa que muitas vezes é possível usar estes modelos dentro de ferramentas que já possui. A documentação da subscrição nomeia Claude Code, Cline e OpenCode entre os clientes suportados, e a página de subscrição acrescenta o Kilo Code e outros.
A interface é bilingue, descrevendo-se a plataforma como talhada para utilizadores de chinês e inglês. A documentação consultada não registava aplicações móveis nativas, pelo que aqui não se afirma nada sobre a sua disponibilidade.
Três vias, com preços distintos. Confundi-las é o erro mais frequente nas apresentações alheias deste produto.
A interface de conversa é gratuita. As próprias mensagens de consola do Z.ai descrevem o produto como alternativa gratuita ao ChatGPT assente em código aberto. A documentação pública consultada aqui não publica limites de mensagens nem de frequência para a gama gratuita, pelo que não se indica qualquer limite concreto: a ausência de limite publicado não prova que não exista.
A API é tarifada por tokens, com valores por milhão: GLM-5.3 e GLM-5.2 a 1,4 dólares de entrada e 4,4 de saída; GLM-5 a 1 e 3,2; GLM-4.7 a 0,6 e 2,2; GLM-4.7-FlashX a 0,07 e 0,4. A entrada em cache custa bastante menos — 0,26 dólares na gama de topo — e o seu armazenamento figura como gratuito por tempo limitado. De assinalar que GLM-4.7-Flash, GLM-4.5-Flash e GLM-4.6V-Flash surgem sem custo tanto na entrada como na saída. As capacidades multimodais são tarifadas à parte: pesquisa na web a 0,01 dólares por utilização, GLM-Image a 0,015 por imagem, CogVideoX-3 a 0,2 por vídeo e GLM-ASR-2512 a cerca de 0,0024 por minuto.
O GLM Coding Plan é uma subscrição que começa nos 18 dólares mensais segundo a página oficial, cobrindo GLM-5.3, GLM-5.2 e GLM-5-Turbo dentro do Claude Code, Kilo Code, Cline, OpenCode e outros. Existe em três gamas com quotas duplas: Lite com 2.000 créditos de cinco horas e 10.000 semanais; Pro com 12.000 e 60.000; Max com 28.000 e 140.000. Os créditos de cinco horas repõem-se dinamicamente cinco horas após o consumo; os semanais reiniciam-se a cada sete dias desde a subscrição. O desconto fora de ponta referido acima duplica na prática a capacidade do trabalho agendado fora das tardes úteis singapurenses.
Como referência sobre a volatilidade dos preços, a cobertura da VentureBeat de junho de 2026 citava gamas de subscrição empresarial a partir de 12,60 dólares por mês, abaixo dos 18 atualmente indicados. Os preços promocionais mexem-se claramente; confirme as tarifas em vigor em vez de confiar em qualquer número citado num artigo, incluindo este.
O ChatGPT continua a ser a referência em amplitude: o maior ecossistema de extensões e integrações, a experiência móvel mais polida, o ferramental de terceiros mais denso. O Z.ai compete no preço e nos pesos abertos, não na maturidade do ecossistema.
O Claude é a comparação habitual para código e documentos longos, e note-se que o GLM Coding Plan foi desenhado para correr dentro do Claude Code: para programadores que querem conservar o ferramental e trocar apenas o modelo por trás, os dois produtos são tanto complementares como concorrentes.
O DeepSeek é o análogo estrutural mais próximo: outro laboratório chinês a lançar modelos fortes de pesos abertos com preços agressivos. A escolha entre ambos costuma resumir-se à adequação dos testes de referência à sua carga concreta e não a uma diferença categórica.
O Gemini oferece integração profunda com o Google Workspace e um contexto muito grande. A reportagem de referências da VentureBeat colocou o GLM-5.2 bastante à frente do Gemini 3.1 Pro no Terminal-Bench 2.1 — 81,0 contra 74,0 — ainda que essas vantagens sejam estreitas e mudem a cada lançamento.
Alojar o GLM diretamente merece menção como alternativa exclusiva deste fornecedor. Estando os pesos licenciados sob MIT no Hugging Face, uma organização pode correr o mesmo modelo na sua própria infraestrutura: sem dependência do fornecedor, sem que os dados saiam do perímetro, ao preço de capacidade de GPU e esforço operacional.
Resumo honesto: os traços distintivos do Z.ai Chat são os pesos abertos, os preços agressivos e a capacidade de agente virada para código. As desvantagens face ao ChatGPT são a profundidade do ecossistema e o acabamento móvel. Para um público concreto e em crescimento — programadores a quem importam custo e portabilidade — a troca compensa.
Os materiais do fornecedor e a cobertura entusiasta tendem a pintar uma vitória sem mácula. O jornalismo independente é mais matizado. A própria tabela da VentureBeat mostra o GLM-5.2 a vencer com nitidez em algumas medidas — 62,1 no SWE-bench Pro contra os 58,6 do GPT-5.5 — e a ficar atrás noutras: nas pontuações brutas do Terminal-Bench 2.1 alcançou 81,0 contra os 85,0 do Claude 4.8 e os 84,0 do GPT-5.5, ao passo que na mesma medida supera largamente o Gemini 3.1 Pro. A leitura correta é «competitivo na fronteira, com uma força específica em codificação de longo curso» e não «bate tudo». Além disso, os testes de referência envelhecem depressa.
A narrativa dos pesos abertos traz um asterisco importante. A VentureBeat noticiou que o GLM-5.3 esteve inicialmente disponível apenas através do GLM Coding Plan e do ambiente ZCode, com o acesso por API e os pesos abertos a chegarem depois, uma vez concluídas a avaliação de segurança e o reforço, e que a empresa planeava publicar os pesos cerca de duas semanas após o lançamento. Ou seja, o modelo mais recente é temporariamente um produto fechado atrás de subscrição. Se o seu plano depende de pesos transferíveis, confirme a disponibilidade da versão concreta em vez de presumir que o licenciamento da família se aplica de modo uniforme.
Antes de subscrever, duas regras documentadas merecem atenção. O GLM Coding Plan está estritamente limitado a ferramentas e produtos oficialmente suportados, sendo comunicado aos subscritores que não devem usar as vantagens da subscrição em ferramentas ou cenários não suportados: não é um saldo de créditos de uso geral. E quando a quota se esgota, segundo o FAQ oficial, é preciso esperar pelo ciclo seguinte de cinco horas, não descontando o sistema do saldo da conta. É favorável ao utilizador, por evitar cobranças surpresa, mas também significa que atingir o teto interrompe o trabalho em vez de o degradar.
Cada plano traz em simultâneo um limite de cinco horas e um limite semanal. É perfeitamente possível ainda haver quota semanal enquanto a janela de cinco horas bloqueia, ou o inverso. Quem planeie períodos intensivos deve modelar ambas as restrições.
As condições exigem autorização expressa para que a empresa use e armazene conteúdo do utilizador que não constitua dados pessoais, a fim de desenvolver e melhorar as suas tecnologias de aprendizagem automática e inteligência artificial. A política de privacidade enumera à parte o treino e a melhoria de modelos entre os seus interesses legítimos e refere que informação publicamente disponível na internet pode ser obtida para treinar modelos. No material consultado não está documentada qualquer via de oposição. Para uma IA de consumo gratuita não é notável, mas deve condicionar o que se cola na janela.
Não é indicada qualquer idade mínima de registo. As condições limitam-se a dizer que quem for menor à luz das leis do seu país ou estado de residência deve rever estas condições com o representante legal: uma orientação, não uma barreira. A única regra firme ligada à idade proíbe os utilizadores de tratar ou armazenar informação pessoal de crianças com menos de 13 anos em violação da COPPA, o que regula o que os utilizadores podem fazer e não quem se pode registar. Os progenitores que avaliem esta ferramenta não devem ler a ausência de barreira como garantia de adequação.
Três nomes estão ligados a este produto: a marca Z.ai, a identidade anterior Zhipu AI e a entidade contratante singapurense JINGSHENG HENGXING TECHNOLOGY PTE.LTD, também nomeada responsável pelo tratamento. Para a maioria dos utilizadores particulares isto é irrelevante; para organizações com políticas de residência de dados ou país de origem não o é, e a constituição em Singapura não resolve por si só as dúvidas sobre uma empresa que a VentureBeat descreve como startup chinesa de IA. Avalie face à sua política real e não a uma linha no rodapé.
A política de privacidade permite a divulgação a qualquer parceiro de negócio, investidor, cessionário ou potencial cessionário para facilitar transações sobre ativos do negócio, estendendo-se a fusões, aquisições ou venda de dívida ou ativos. É padrão no setor, e é bom saber: o depositário dos seus dados pode mudar sem a sua intervenção.
Um aviso permanente no fundo da interface indica que todo o conteúdo é gerado por IA e serve apenas de referência. O produto não reivindica exatidão — e ninguém a deve reivindicar em seu nome.
A documentação pública é minuciosa quanto a tarifas de API, multiplicadores de créditos e mecânica de quotas — e comparativamente silenciosa sobre os limites do próprio produto de conversa gratuito. Tetos de mensagens, limites de frequência e prazos de conservação das conversas não foram encontrados no material consultado. É uma lacuna de informação, assinalada aqui em vez de preenchida com conjeturas.
Numa única sessão de investigação, este produto exibiu GLM-5.2 no título da página, GLM-4.7 no seletor de modelo e GLM-5.3 na ligação do blogue e na documentação. As referências de versão em qualquer fonte secundária — incluindo esta página — desatualizam-se rapidamente. Confirme na própria interface o que está a ser servido no momento.
A interface de conversa pode ser usada gratuitamente, e as mensagens de consola da plataforma descrevem-na como alternativa gratuita ao ChatGPT assente em código aberto. Importam dois esclarecimentos. Primeiro, «gratuito» aplica-se ao produto de conversa; a API é tarifada por tokens e o GLM Coding Plan é uma subscrição paga a partir de 18 dólares por mês. Segundo, a documentação pública consultada não publica tetos de mensagens nem limites de frequência para a gama gratuita, pelo que não é possível citar qualquer número concreto: é uma lacuna na informação disponível e não uma garantia de uso ilimitado.
Sim, é um produto de primeira mão. A VentureBeat, em cobertura independente, identifica a empresa como a startup chinesa de IA Z.ai, anteriormente Zhipu AI — a organização que desenvolve os modelos GLM. A entidade contratante e responsável pelo tratamento nomeada nas condições e na política de privacidade é uma sociedade singapurense, a JINGSHENG HENGXING TECHNOLOGY PTE.LTD. Em suma: Z.ai é a marca, Zhipu AI o nome anterior e a entidade singapurense a contraparte jurídica.
A documentação apresenta atualmente o GLM-5.3 como carro-chefe para engenharia de software e trabalho de agente, o GLM-5V-Turbo para programação visual, o GLM-Image para geração de imagens a partir de texto e o CogVideoX-3 para vídeo. A interface inclui um seletor de modelo, e a tabela de preços da API abrange um conjunto mais vasto que inclui GLM-5.2, GLM-5, GLM-4.7 e as gamas Flash gratuitas. A disponibilidade difere por via: o GLM-5.3 chegou ao Coding Plan e ao ZCode antes da API e dos pesos abertos.
Em larga medida, com uma ressalva de calendário. A VentureBeat confirmou que os pesos centrais do GLM-5.2 foram publicados sob licença MIT sem restrições e são transferíveis do Hugging Face para alojamento próprio e afinação. Contudo, o mesmo órgão noticiou que o GLM-5.3 saiu primeiro como produto exclusivo para subscritores, com os pesos previstos cerca de duas semanas após o lançamento, a aguardar avaliação de segurança. Confirme o licenciamento da versão concreta de que precisa.
Por milhão de tokens: GLM-5.3 e GLM-5.2 a 1,4 dólares de entrada e 4,4 de saída; GLM-5 a 1 e 3,2; GLM-4.7 a 0,6 e 2,2; GLM-4.7-FlashX a 0,07 e 0,4. A entrada em cache custa consideravelmente menos. GLM-4.7-Flash, GLM-4.5-Flash e GLM-4.6V-Flash figuram sem custo. Ferramentas e média são tarifados à parte: pesquisa na web a 0,01 dólares por utilização, GLM-Image a 0,015 por imagem, CogVideoX-3 a 0,2 por vídeo.
Cada gama traz dois limites simultâneos. O Lite oferece 2.000 créditos de cinco horas e 10.000 semanais; o Pro 12.000 e 60.000; o Max 28.000 e 140.000. Os créditos de cinco horas repõem-se cinco horas após o consumo; os semanais reiniciam-se a cada sete dias. Os créditos calculam-se a partir dos tokens de entrada, entrada em cache e saída multiplicados pelos multiplicadores de cada modelo e divididos por 10.000, sendo a saída a componente de maior peso. Ponto decisivo: o uso fora de ponta é cobrado a 50 % da tarifa padrão, sendo a ponta de segunda a sexta das 14:00 às 18:00, hora de Singapura.
Espera-se. O FAQ oficial indica que o sistema não desconta do saldo da conta e que, uma vez consumida a quota, é preciso aguardar o ciclo seguinte de cinco horas para que se reponha. Evita cobranças inesperadas, mas também significa que o trabalho para em vez de continuar numa gama inferior. Note ainda que o plano está estritamente limitado a ferramentas oficialmente suportadas.
Na prática sim. As condições pedem que autorize o uso e o armazenamento de conteúdo do utilizador que não constitua dados pessoais para desenvolver e melhorar as tecnologias de aprendizagem automática e IA da empresa, e a política de privacidade inclui o treino e a melhoria de modelos entre as suas finalidades. Na documentação consultada não surge qualquer via de oposição. Mantenha material confidencial fora do produto de conversa gratuito.
Não é indicada qualquer idade mínima explícita. As condições dizem apenas que os menores à luz das leis do seu país ou estado devem rever as condições com um representante legal, o que é orientação e não restrição. A única regra firme proíbe tratar ou armazenar informação pessoal de crianças com menos de 13 anos em violação da COPPA — uma limitação da conduta do utilizador e não uma barreira ao registo.
Pode, e é um objetivo de conceção deliberado. O GLM Coding Plan suporta Claude Code, Kilo Code, Cline e OpenCode, entre outros, e a VentureBeat noticiou que o GLM-5.2 estava disponível no lançamento em mais de vinte ambientes de codificação de terceiros. Para integração direta, a API é compatível com o SDK da OpenAI, pelo que migrar uma integração OpenAI existente resume-se muitas vezes a mudar o URL base e a chave.