Toolso.AI
Toolso.AI
FerramentasCategoriasTendênciaNovidadesPreçosBlog
Toolso.AI
Toolso.AI

💌Subscreva a Ferramentas de IA Semanal

Seleção semanal das últimas e mais populares ferramentas e tendências de IA, entregues na sua caixa de correio Subscrever

Toolso.AI
Toolso.AI

Descubra as melhores ferramentas de IA para impulsionar a sua produtividade

GitHubGitHubTwitterX (Twitter)YouTubeYouTubeTikTokEmail

Categorias Populares

  • Escrita com IA
  • Imagem IA
  • Vídeo IA
  • Programação IA
  • Mais Categorias

Explorar

  • Últimas Ferramentas
  • Ferramentas Populares
  • Mais Ferramentas
  • Submeter Ferramenta
  • Preços

Sobre

  • Sobre Nós
  • Contacto
  • Blog
  • Registo de Alterações

Legal

  • Política de Cookies
  • Política de Privacidade
  • Termos de Serviço
  • Política de Reembolso
© 2026 Toolso.AI Todos os Direitos Reservados
Oferta limitadaOferta por tempo limitadoDestaque promocionalRevisão em 24 h · Sem backlink · 30 dias em destaque$29.90depois $59.90Sobe para $59.90 após 31 de out.Termina em--:--:--Enviar agora
  1. Início
  2. Todas as Ferramentas
  3. Chat de IA
  4. Z.ai Chat
Prévia da interface do Z.ai Chat
Logotipo do Z.ai Chat

Z.ai Chat

O Z.ai Chat é a interface conversacional oficial da família de modelos GLM: acesso gratuito a modelos de ponta com pesos abertos para programar, correr agentes de longo curso, investigar e resolver dúvidas do dia a dia.

Chat de IAAssistente de IAIA de Código Aberto#Código aberto#Grátis#Multilíngue
Experimentar Grátis
Salvos
Visitas
Visualizações
Preço
Freemium
Publicado
21 de ago. de 2026
Domínio
chat.z.ai
Avaliação dos utilizadores

Já usou esta ferramenta? Avalie-a

Avaliar esta ferramenta

Informação do Produto Z.ai Chat

Experimentar Grátis
Informações da Ferramenta
Salvos
Visitas
Visualizações
Preço
Freemium
Publicado
21 de ago. de 2026
Domínio
chat.z.ai
Avaliação dos utilizadores

Já usou esta ferramenta? Avalie-a

Avaliar esta ferramenta

Ferramentas em Destaque

Ferramentas Relacionadas

Experimentar Grátis

O que é Z.ai Chat?

O Z.ai Chat é o chatbot GLM de primeira mão: a interface conversacional oficial da família de grandes modelos de linguagem GLM. Essa distinção pesa mais do que parece, porque a maioria dos sites que se apresentam como «alternativa gratuita ao ChatGPT» são revendedores que embrulham a API de outra pessoa. Aqui não é o caso: é operado pela empresa que constrói os modelos, e a página inicial declara o propósito sem rodeios — um assistente de IA movido a GLM com o qual construir sites, escrever código, conduzir tarefas de longo curso e obter respostas imediatas.

O retrato societário tem três camadas que vale a pena desembaraçar, pois cada uma aparece num sítio diferente. A marca pública é Z.ai. A VentureBeat, ao noticiar de forma independente o lançamento do GLM-5.2, identifica a empresa como «a startup chinesa de IA Z.ai (anteriormente Zhipu AI)» — ou seja, Z.ai é a identidade internacional da organização antes conhecida por Zhipu. A entidade contratante e responsável pelo tratamento de dados, porém, não é nenhum desses nomes: as condições de utilização definem o Z.ai como a plataforma operada pela JINGSHENG HENGXING TECHNOLOGY PTE.LTD, sociedade singapurense registada no International Plaza, e a política de privacidade nomeia essa mesma entidade como responsável pelo tratamento dos seus dados pessoais. Se a sua avaliação envolve jurisdição ou governação de dados, é a entidade singapurense que conta juridicamente.

O que distingue este produto do campo apinhado de assistentes conversacionais gratuitos é que os modelos por baixo têm, em larga medida, pesos abertos. A VentureBeat confirma que os pesos centrais do GLM-5.2 foram publicados sob licença aberta MIT sem restrições, transferíveis a partir do Hugging Face para afinação local e alojamento próprio. A interface de conversa é, assim, uma porta de entrada cómoda para um modelo que, em princípio, o próprio utilizador poderia executar. Muito poucos assistentes gratuitos podem dizer o mesmo.

Um esclarecimento logo de início, por ser a fonte de confusão mais comum: o Z.ai mantém duas vias comerciais fáceis de baralhar. A interface de conversa em chat.z.ai é o produto de consumo gratuito. Em separado existe uma plataforma paga para programadores — uma API tarifada por tokens e uma subscrição GLM Coding Plan a partir de 18 dólares por mês. Os valores neste artigo estão identificados por via, porque a tabela de preços da API não descreve o que se paga para usar a janela de conversa.

Funcionalidades principais

Uma linha de modelos entre os quais se escolhe realmente

Em vez de apresentar um opaco «melhor modelo», o Z.ai expõe toda a família e deixa escolher. A documentação oficial define com clareza os papéis atuais: o GLM-5.3 é descrito como a mais recente carro-chefe, com avanços abrangentes em engenharia de software e capacidades de agente; o GLM-5V-Turbo é um modelo multimodal de codificação especializado em programação visual; o GLM-Image suporta geração de imagens a partir de texto, reivindicada como estado da arte em código aberto para cenas complexas; e o CogVideoX-3 trata da geração de vídeo.

A interface traz um seletor de modelo no topo, pelo que alternar é um clique e não uma escavação nas definições. Isso importa mais do que soa: um modelo mais leve costuma responder mais depressa e chega perfeitamente para perguntas de rotina, e poder descer um degrau deliberadamente é uma vantagem ergonómica concreta.

Comportamento de agente e tarefas de longo curso

O próprio título do produto emparelha «Chatbot» com «Agent», e a lista de capacidades abre com tarefas de longo curso. É o eixo em que a empresa mais visivelmente investiu. A cobertura independente da VentureBeat descreve o GLM-5.2 como um modelo concebido especificamente para dominar tarefas autónomas prolongadas de codificação e engenharia, e relata resultados de referência exatamente nesse eixo: 62,1 no SWE-bench Pro contra os 58,6 do GPT-5.5, e 74,4 % no FrontierSWE, um teste criado para medir a conclusão de tarefas prolongadas.

Os subscritores contam com uma camada adicional de ferramentas. O GLM Coding Plan concede acesso MCP exclusivo a compreensão visual, pesquisa na web, leitura de páginas e Zread — as capacidades que permitem ao modelo consultar e ler páginas em vez de responder apenas a partir dos seus parâmetros.

Uma janela de contexto verdadeiramente ampla

A reportagem da VentureBeat atribui ao GLM-5.2 uma janela de contexto de um milhão de tokens notavelmente estável. É de assinalar que não se fica pelo número de manchete: a mesma cobertura descreve uma otimização arquitetónica chamada IndexShare, que reutiliza o mesmo indexador a cada quatro camadas de atenção esparsa e reduz assim o cálculo por token cerca de 2,9 vezes no comprimento máximo de contexto. Por outras palavras, esse contexto longo foi projetado para ser economicamente utilizável e não apenas nominalmente disponível.

Código como superfície de primeiro plano

Escrever código não é aqui uma capacidade lateral: o produto posiciona-se tanto como agente de programação quanto como assistente conversacional. A interface inclui um ponto de entrada ZCode dedicado ao lado do seletor de modelo, e o produto por subscrição é explicitamente construído em torno do trabalho de desenvolvimento. Segundo a documentação oficial, o GLM Coding Plan aplica-se a ferramentas como Claude Code, Cline e OpenCode, suportando programação em linguagem natural — descrever requisitos em linguagem corrente para gerar planos, escrever código e depurar — além de conclusão de código sensível ao contexto em tempo real.

Atalhos de criação guiados

A interface coloca cinco atalhos de tarefas mesmo por baixo da caixa de entrada: páginas de destino, divulgação científica e planos de aula, modelação 3D, jogos pequenos e blogues pessoais. São andaimes de acolhimento mais do que funcionalidades distintas, mas bem escolhidos: cada um representa uma tarefa que termina em algo completo em vez de mera pergunta e resposta, o que encaminha os recém-chegados para a verdadeira força do produto.

Bilingue por conceção

A plataforma descreve-se como talhada para utilizadores de chinês e inglês, e a interface renderizada confirma-o, misturando controlos em inglês com saudações e atalhos em chinês. Para quem trabalha entre estas duas línguas, um modelo cujo treino e desenho tratam o chinês como língua de primeira ordem e não como acrescento tardio constitui uma diferença significativa.

Acesso completo para programadores

Para quem quer construir sobre os modelos em vez de conversar com eles, a documentação traça um percurso completo: uma API HTTP RESTful padrão compatível com todas as linguagens de programação, SDK oficiais de Python e Java, e compatibilidade com o SDK da OpenAI para migrar depressa a partir da OpenAI. O ponto de extremidade é api.z.ai/api/paas/v4/chat/completions, e essa compatibilidade significa que uma integração existente muitas vezes só precisa de trocar o URL base e a chave.

Casos de uso

Engenharia de software assistida por agente

O caso mais bem sustentado. Entre a superfície ZCode, a integração com ferramentas de terceiros e um desempenho de referência concentrado em SWE-bench Pro e FrontierSWE, é para aqui que o produto aponta e onde as provas independentes são mais fortes.

Avaliar um modelo antes de o alojar por conta própria

Um fluxo de trabalho subvalorizado e próprio dos fornecedores de pesos abertos. Como os pesos GLM se transferem sob MIT, equipas que ponderam alojamento próprio podem usar a interface gratuita para avaliar o comportamento do modelo nos seus problemas reais antes de comprometer infraestrutura. A janela de conversa torna-se um banco de ensaio de custo nulo.

Cargas de API sensíveis ao custo

As tarifas publicadas colocam o GLM-4.7 em 0,6 dólares por milhão de tokens de entrada e 2,2 de saída, com vários modelos da gama Flash listados sem custo. Para volumes elevados e baixa complexidade — classificação, extração, resumos de rotina — esse preço altera aquilo que é economicamente viável.

Investigação e trabalho apoiado em recuperação

Com pesquisa na web e leitura de páginas disponíveis como ferramentas, o assistente pode ancorar respostas em páginas recuperadas em vez de apenas na memória paramétrica. Útil para questões de atualidade e varrimento bibliográfico, com a ressalva habitual: a recuperação reduz a fabulação mas não a elimina.

Conteúdo bilingue e tradução

A orientação sino-inglesa torna-o uma escolha prática para tradução, redação entre línguas e revisão de localização — tarefas em que modelos treinados sobretudo com dados em inglês produzem muitas vezes um chinês tecnicamente correto mas de tom desajustado.

Trabalho corrente de assistente

Rascunhar, reescrever, explicar, gerar ideias. A maioria pouco vistosa do uso de um assistente, resolvida com competência e sem custo.

Como usar Z.ai Chat

Passo 1 — Abrir a conversa e experimentar antes de criar conta

Vá a chat.z.ai. A interface apresenta uma caixa de entrada, um seletor de modelo e os cinco atalhos de tarefas. Começar por um atalho é uma primeira jogada sensata: mostram a orientação do produto para fabricar algo mais depressa do que uma pergunta aberta.

Passo 2 — Escolher o modelo de forma deliberada

Use o seletor em vez de aceitar o valor por omissão. Para uma pergunta factual rápida, um modelo mais leve responde antes; para uma tarefa de código em vários passos, escolha a carro-chefe. Ganhar o hábito de ajustar o modelo à tarefa é o maior ganho de qualidade por segundo ao seu alcance.

Passo 3 — Formular tarefas longas como tarefas e não como perguntas

O produto está otimizado para trabalho autónomo prolongado. Em vez de encadear perguntas pequenas, descreva o objetivo completo, as restrições e o aspeto de um resultado acabado. É jogar com a arquitetura e não contra ela.

Passo 4 — Ativar ferramentas quando a resposta depende de factos atuais

Para tudo o que seja sensível ao tempo ou verificável externamente, recorra à pesquisa e leitura na web em vez dos dados de treino do modelo. O conhecimento paramétrico de qualquer modelo tem data de corte; a recuperação é a forma de a contornar.

Passo 5 — Verificar tudo o que tenha consequências

A própria interface exibe permanentemente um aviso de que todo o conteúdo é gerado por IA e serve apenas de referência. Trate-o como orientação operacional e não como fórmula jurídica — sobretudo no caso de código, números e citações.

Passo 6 — Passar à API ou ao Coding Plan se o uso crescer

Se der por si a usar a janela de conversa como fluxo de trabalho e não como curiosidade, esperam-no as duas vias pagas. A API é tarifada por tokens para integração programática; o GLM Coding Plan é uma subscrição para usar dentro do Claude Code, Cline e ferramentas afins. Leia a mecânica das quotas na secção de limitações antes de escolher.

Dicas & boas práticas

Agendar o trabalho pesado da subscrição para horas de menor procura

A dica mais aplicável e menos divulgada. A documentação indica que, fora das horas de ponta, o uso dos modelos é cobrado a 50 % da tarifa padrão em créditos, definindo as horas de ponta como de segunda a sexta, das 14:00 às 18:00, hora padrão de Singapura. Deslocar o processamento em lote para fora dessa janela de quatro horas em dias úteis duplica literalmente a quota efetiva. Nenhuma análise de terceiros sobre este produto o menciona.

Raciocinar em créditos, não em tokens

A quota da subscrição é expressa em créditos, calculados como tokens de entrada vezes um multiplicador de entrada, mais entrada em cache vezes o seu multiplicador, mais tokens de saída vezes um multiplicador de saída, tudo dividido por 10.000. A saída pesa muito mais do que a entrada — no GLM-5.3 os multiplicadores são 6,9 na entrada, 1,7 na cache e 24 na saída. A consequência prática é que saídas prolixas custam bastante mais do que entradas longas. Pedir respostas concisas é uma estratégia de quota e não apenas uma preferência de estilo.

Aproveitar a cache em contexto repetido

A entrada em cache é cobrada a uma fração da entrada nova, tanto na tabela da API como nos multiplicadores de créditos. Se envia repetidamente a mesma instrução de sistema ou o mesmo documento, estruturar os pedidos para que o conteúdo estável fique numa posição passível de cache reduz o custo de forma apreciável.

Encaminhar o trabalho em massa para as gamas Flash gratuitas

Vários modelos figuram com custo zero na tabela oficial. Para tarefas simples de grande volume, encaminhar para uma gama Flash gratuita e reservar a carro-chefe para os problemas verdadeiramente difíceis é aritmética simples.

Não presumir que o modelo mais recente está disponível em toda a parte

A disponibilidade difere por via. A VentureBeat noticiou que o GLM-5.3 estava inicialmente acessível apenas através do GLM Coding Plan e do ambiente ZCode, com o acesso por API e os pesos abertos a surgirem mais tarde. Confirme que superfície expõe o modelo pretendido antes de planear em torno dele.

Tratar a janela de conversa como ferramenta de avaliação

Se o alojamento próprio está em cima da mesa, use a interface gratuita de modo sistemático — mesmos prompts, mesma grelha, ao longo das gamas de modelos — antes de transferir pesos. É a avaliação pré-implementação mais barata que existe.

Manter material sensível de fora

As condições autorizam expressamente o uso de conteúdo do utilizador que não constitua dados pessoais para desenvolver e melhorar as tecnologias de aprendizagem automática e IA da empresa. É comum na IA de consumo gratuita, e é também razão para manter código proprietário e documentos confidenciais fora da janela gratuita.

Para quem é Z.ai Chat?

Programadores e equipas de engenharia. O encaixe mais forte, com larga margem. Entre testes de referência centrados em código, integração com ferramentas de terceiros e preços agressivos, o produto foi construído em torno deste público.

Equipas que avaliam modelos de pesos abertos. Qualquer organização cujo percurso de aquisição possa terminar em alojamento próprio beneficia de uma interface gratuita e de primeira mão para modelos que depois poderá transferir sob MIT.

Construtores sensíveis ao custo. Startups e particulares para quem o preço das API de modelos de ponta é proibitivo, e quem simplesmente queira um assistente de IA gratuito competente sem subscrição. As tarifas publicadas e as gamas gratuitas alteram substancialmente as contas.

Utilizadores bilingues de chinês e inglês. Um modelo desenhado com o chinês como língua de primeira ordem e não como destino de tradução.

Investigadores e analistas. As ferramentas de recuperação aliadas a uma janela de contexto muito grande servem trabalho analítico com muita documentação.

Quem deve procurar noutro lado. Quem precise do ecossistema mais profundo de extensões de terceiros continuará a encontrar o ChatGPT à frente. Organizações com políticas que restringem o tratamento de dados por empresas de ligação chinesa devem confrontar a estrutura da entidade singapurense com as suas próprias regras de conformidade, em vez de presumir que a constituição em Singapura resolve a questão. Quem necessite de garantias empresariais documentadas — SLA, certificações de conformidade auditadas — terá de as verificar à parte: a documentação pública consultada aqui não as cobre.

Plataformas

O Z.ai Chat é uma aplicação web acessível por navegador em chat.z.ai. As propriedades em redor repartem-se por função: z.ai acolhe o site de marketing, a entrada de subscrição e o blogue técnico; docs.z.ai contém a documentação para programadores; api.z.ai serve o tráfego da API; e os acordos legais residem sob chat.z.ai/legal-agreement/.

O acesso à API foi pensado para a portabilidade. A documentação disponibiliza uma API HTTP RESTful padrão compatível com todas as linguagens, SDK oficiais de Python e Java, e compatibilidade com o SDK da OpenAI explicitamente apresentada como caminho de migração, com o ponto de extremidade em api.z.ai/api/paas/v4/chat/completions.

O alcance ultrapassa largamente as superfícies próprias. A VentureBeat noticiou que o GLM-5.2 ficou disponível de imediato no Hugging Face, na API do Z.ai e em mais de vinte ambientes de codificação de terceiros — o que significa que muitas vezes é possível usar estes modelos dentro de ferramentas que já possui. A documentação da subscrição nomeia Claude Code, Cline e OpenCode entre os clientes suportados, e a página de subscrição acrescenta o Kilo Code e outros.

A interface é bilingue, descrevendo-se a plataforma como talhada para utilizadores de chinês e inglês. A documentação consultada não registava aplicações móveis nativas, pelo que aqui não se afirma nada sobre a sua disponibilidade.

Preços e planos

Três vias, com preços distintos. Confundi-las é o erro mais frequente nas apresentações alheias deste produto.

A interface de conversa é gratuita. As próprias mensagens de consola do Z.ai descrevem o produto como alternativa gratuita ao ChatGPT assente em código aberto. A documentação pública consultada aqui não publica limites de mensagens nem de frequência para a gama gratuita, pelo que não se indica qualquer limite concreto: a ausência de limite publicado não prova que não exista.

A API é tarifada por tokens, com valores por milhão: GLM-5.3 e GLM-5.2 a 1,4 dólares de entrada e 4,4 de saída; GLM-5 a 1 e 3,2; GLM-4.7 a 0,6 e 2,2; GLM-4.7-FlashX a 0,07 e 0,4. A entrada em cache custa bastante menos — 0,26 dólares na gama de topo — e o seu armazenamento figura como gratuito por tempo limitado. De assinalar que GLM-4.7-Flash, GLM-4.5-Flash e GLM-4.6V-Flash surgem sem custo tanto na entrada como na saída. As capacidades multimodais são tarifadas à parte: pesquisa na web a 0,01 dólares por utilização, GLM-Image a 0,015 por imagem, CogVideoX-3 a 0,2 por vídeo e GLM-ASR-2512 a cerca de 0,0024 por minuto.

O GLM Coding Plan é uma subscrição que começa nos 18 dólares mensais segundo a página oficial, cobrindo GLM-5.3, GLM-5.2 e GLM-5-Turbo dentro do Claude Code, Kilo Code, Cline, OpenCode e outros. Existe em três gamas com quotas duplas: Lite com 2.000 créditos de cinco horas e 10.000 semanais; Pro com 12.000 e 60.000; Max com 28.000 e 140.000. Os créditos de cinco horas repõem-se dinamicamente cinco horas após o consumo; os semanais reiniciam-se a cada sete dias desde a subscrição. O desconto fora de ponta referido acima duplica na prática a capacidade do trabalho agendado fora das tardes úteis singapurenses.

Como referência sobre a volatilidade dos preços, a cobertura da VentureBeat de junho de 2026 citava gamas de subscrição empresarial a partir de 12,60 dólares por mês, abaixo dos 18 atualmente indicados. Os preços promocionais mexem-se claramente; confirme as tarifas em vigor em vez de confiar em qualquer número citado num artigo, incluindo este.

Alternativas

O ChatGPT continua a ser a referência em amplitude: o maior ecossistema de extensões e integrações, a experiência móvel mais polida, o ferramental de terceiros mais denso. O Z.ai compete no preço e nos pesos abertos, não na maturidade do ecossistema.

O Claude é a comparação habitual para código e documentos longos, e note-se que o GLM Coding Plan foi desenhado para correr dentro do Claude Code: para programadores que querem conservar o ferramental e trocar apenas o modelo por trás, os dois produtos são tanto complementares como concorrentes.

O DeepSeek é o análogo estrutural mais próximo: outro laboratório chinês a lançar modelos fortes de pesos abertos com preços agressivos. A escolha entre ambos costuma resumir-se à adequação dos testes de referência à sua carga concreta e não a uma diferença categórica.

O Gemini oferece integração profunda com o Google Workspace e um contexto muito grande. A reportagem de referências da VentureBeat colocou o GLM-5.2 bastante à frente do Gemini 3.1 Pro no Terminal-Bench 2.1 — 81,0 contra 74,0 — ainda que essas vantagens sejam estreitas e mudem a cada lançamento.

Alojar o GLM diretamente merece menção como alternativa exclusiva deste fornecedor. Estando os pesos licenciados sob MIT no Hugging Face, uma organização pode correr o mesmo modelo na sua própria infraestrutura: sem dependência do fornecedor, sem que os dados saiam do perímetro, ao preço de capacidade de GPU e esforço operacional.

Resumo honesto: os traços distintivos do Z.ai Chat são os pesos abertos, os preços agressivos e a capacidade de agente virada para código. As desvantagens face ao ChatGPT são a profundidade do ecossistema e o acabamento móvel. Para um público concreto e em crescimento — programadores a quem importam custo e portabilidade — a troca compensa.

Limitações & considerações

Os resultados de referência são fortes mas desiguais

Os materiais do fornecedor e a cobertura entusiasta tendem a pintar uma vitória sem mácula. O jornalismo independente é mais matizado. A própria tabela da VentureBeat mostra o GLM-5.2 a vencer com nitidez em algumas medidas — 62,1 no SWE-bench Pro contra os 58,6 do GPT-5.5 — e a ficar atrás noutras: nas pontuações brutas do Terminal-Bench 2.1 alcançou 81,0 contra os 85,0 do Claude 4.8 e os 84,0 do GPT-5.5, ao passo que na mesma medida supera largamente o Gemini 3.1 Pro. A leitura correta é «competitivo na fronteira, com uma força específica em codificação de longo curso» e não «bate tudo». Além disso, os testes de referência envelhecem depressa.

O «código aberto» não é imediato nos modelos mais recentes

A narrativa dos pesos abertos traz um asterisco importante. A VentureBeat noticiou que o GLM-5.3 esteve inicialmente disponível apenas através do GLM Coding Plan e do ambiente ZCode, com o acesso por API e os pesos abertos a chegarem depois, uma vez concluídas a avaliação de segurança e o reforço, e que a empresa planeava publicar os pesos cerca de duas semanas após o lançamento. Ou seja, o modelo mais recente é temporariamente um produto fechado atrás de subscrição. Se o seu plano depende de pesos transferíveis, confirme a disponibilidade da versão concreta em vez de presumir que o licenciamento da família se aplica de modo uniforme.

As quotas de subscrição são rígidas e não transbordam

Antes de subscrever, duas regras documentadas merecem atenção. O GLM Coding Plan está estritamente limitado a ferramentas e produtos oficialmente suportados, sendo comunicado aos subscritores que não devem usar as vantagens da subscrição em ferramentas ou cenários não suportados: não é um saldo de créditos de uso geral. E quando a quota se esgota, segundo o FAQ oficial, é preciso esperar pelo ciclo seguinte de cinco horas, não descontando o sistema do saldo da conta. É favorável ao utilizador, por evitar cobranças surpresa, mas também significa que atingir o teto interrompe o trabalho em vez de o degradar.

A estrutura de dupla quota é facilmente mal avaliada

Cada plano traz em simultâneo um limite de cinco horas e um limite semanal. É perfeitamente possível ainda haver quota semanal enquanto a janela de cinco horas bloqueia, ou o inverso. Quem planeie períodos intensivos deve modelar ambas as restrições.

O seu conteúdo pode alimentar o treino dos modelos

As condições exigem autorização expressa para que a empresa use e armazene conteúdo do utilizador que não constitua dados pessoais, a fim de desenvolver e melhorar as suas tecnologias de aprendizagem automática e inteligência artificial. A política de privacidade enumera à parte o treino e a melhoria de modelos entre os seus interesses legítimos e refere que informação publicamente disponível na internet pode ser obtida para treinar modelos. No material consultado não está documentada qualquer via de oposição. Para uma IA de consumo gratuita não é notável, mas deve condicionar o que se cola na janela.

A política de idade é invulgarmente permissiva

Não é indicada qualquer idade mínima de registo. As condições limitam-se a dizer que quem for menor à luz das leis do seu país ou estado de residência deve rever estas condições com o representante legal: uma orientação, não uma barreira. A única regra firme ligada à idade proíbe os utilizadores de tratar ou armazenar informação pessoal de crianças com menos de 13 anos em violação da COPPA, o que regula o que os utilizadores podem fazer e não quem se pode registar. Os progenitores que avaliem esta ferramenta não devem ler a ausência de barreira como garantia de adequação.

A jurisdição é estratificada e vale a pena compreendê-la

Três nomes estão ligados a este produto: a marca Z.ai, a identidade anterior Zhipu AI e a entidade contratante singapurense JINGSHENG HENGXING TECHNOLOGY PTE.LTD, também nomeada responsável pelo tratamento. Para a maioria dos utilizadores particulares isto é irrelevante; para organizações com políticas de residência de dados ou país de origem não o é, e a constituição em Singapura não resolve por si só as dúvidas sobre uma empresa que a VentureBeat descreve como startup chinesa de IA. Avalie face à sua política real e não a uma linha no rodapé.

A cláusula de transmissão de negócio permite a mudança de mãos dos dados

A política de privacidade permite a divulgação a qualquer parceiro de negócio, investidor, cessionário ou potencial cessionário para facilitar transações sobre ativos do negócio, estendendo-se a fusões, aquisições ou venda de dívida ou ativos. É padrão no setor, e é bom saber: o depositário dos seus dados pode mudar sem a sua intervenção.

O fornecedor exime-se quanto ao resultado

Um aviso permanente no fundo da interface indica que todo o conteúdo é gerado por IA e serve apenas de referência. O produto não reivindica exatidão — e ninguém a deve reivindicar em seu nome.

A documentação privilegia o programador

A documentação pública é minuciosa quanto a tarifas de API, multiplicadores de créditos e mecânica de quotas — e comparativamente silenciosa sobre os limites do próprio produto de conversa gratuito. Tetos de mensagens, limites de frequência e prazos de conservação das conversas não foram encontrados no material consultado. É uma lacuna de informação, assinalada aqui em vez de preenchida com conjeturas.

A nomenclatura dos modelos muda depressa

Numa única sessão de investigação, este produto exibiu GLM-5.2 no título da página, GLM-4.7 no seletor de modelo e GLM-5.3 na ligação do blogue e na documentação. As referências de versão em qualquer fonte secundária — incluindo esta página — desatualizam-se rapidamente. Confirme na própria interface o que está a ser servido no momento.

FAQ

Q1. O Z.ai Chat é mesmo gratuito?

A interface de conversa pode ser usada gratuitamente, e as mensagens de consola da plataforma descrevem-na como alternativa gratuita ao ChatGPT assente em código aberto. Importam dois esclarecimentos. Primeiro, «gratuito» aplica-se ao produto de conversa; a API é tarifada por tokens e o GLM Coding Plan é uma subscrição paga a partir de 18 dólares por mês. Segundo, a documentação pública consultada não publica tetos de mensagens nem limites de frequência para a gama gratuita, pelo que não é possível citar qualquer número concreto: é uma lacuna na informação disponível e não uma garantia de uso ilimitado.

Q2. Quem opera realmente o Z.ai e é o verdadeiro criador do GLM?

Sim, é um produto de primeira mão. A VentureBeat, em cobertura independente, identifica a empresa como a startup chinesa de IA Z.ai, anteriormente Zhipu AI — a organização que desenvolve os modelos GLM. A entidade contratante e responsável pelo tratamento nomeada nas condições e na política de privacidade é uma sociedade singapurense, a JINGSHENG HENGXING TECHNOLOGY PTE.LTD. Em suma: Z.ai é a marca, Zhipu AI o nome anterior e a entidade singapurense a contraparte jurídica.

Q3. Que modelos posso usar?

A documentação apresenta atualmente o GLM-5.3 como carro-chefe para engenharia de software e trabalho de agente, o GLM-5V-Turbo para programação visual, o GLM-Image para geração de imagens a partir de texto e o CogVideoX-3 para vídeo. A interface inclui um seletor de modelo, e a tabela de preços da API abrange um conjunto mais vasto que inclui GLM-5.2, GLM-5, GLM-4.7 e as gamas Flash gratuitas. A disponibilidade difere por via: o GLM-5.3 chegou ao Coding Plan e ao ZCode antes da API e dos pesos abertos.

Q4. Os modelos GLM são mesmo de código aberto?

Em larga medida, com uma ressalva de calendário. A VentureBeat confirmou que os pesos centrais do GLM-5.2 foram publicados sob licença MIT sem restrições e são transferíveis do Hugging Face para alojamento próprio e afinação. Contudo, o mesmo órgão noticiou que o GLM-5.3 saiu primeiro como produto exclusivo para subscritores, com os pesos previstos cerca de duas semanas após o lançamento, a aguardar avaliação de segurança. Confirme o licenciamento da versão concreta de que precisa.

Q5. Quanto custa a API?

Por milhão de tokens: GLM-5.3 e GLM-5.2 a 1,4 dólares de entrada e 4,4 de saída; GLM-5 a 1 e 3,2; GLM-4.7 a 0,6 e 2,2; GLM-4.7-FlashX a 0,07 e 0,4. A entrada em cache custa consideravelmente menos. GLM-4.7-Flash, GLM-4.5-Flash e GLM-4.6V-Flash figuram sem custo. Ferramentas e média são tarifados à parte: pesquisa na web a 0,01 dólares por utilização, GLM-Image a 0,015 por imagem, CogVideoX-3 a 0,2 por vídeo.

Q6. Como funciona a quota do GLM Coding Plan?

Cada gama traz dois limites simultâneos. O Lite oferece 2.000 créditos de cinco horas e 10.000 semanais; o Pro 12.000 e 60.000; o Max 28.000 e 140.000. Os créditos de cinco horas repõem-se cinco horas após o consumo; os semanais reiniciam-se a cada sete dias. Os créditos calculam-se a partir dos tokens de entrada, entrada em cache e saída multiplicados pelos multiplicadores de cada modelo e divididos por 10.000, sendo a saída a componente de maior peso. Ponto decisivo: o uso fora de ponta é cobrado a 50 % da tarifa padrão, sendo a ponta de segunda a sexta das 14:00 às 18:00, hora de Singapura.

Q7. O que acontece quando a minha quota de subscrição se esgota?

Espera-se. O FAQ oficial indica que o sistema não desconta do saldo da conta e que, uma vez consumida a quota, é preciso aguardar o ciclo seguinte de cinco horas para que se reponha. Evita cobranças inesperadas, mas também significa que o trabalho para em vez de continuar numa gama inferior. Note ainda que o plano está estritamente limitado a ferramentas oficialmente suportadas.

Q8. As minhas conversas são usadas para treinar os modelos?

Na prática sim. As condições pedem que autorize o uso e o armazenamento de conteúdo do utilizador que não constitua dados pessoais para desenvolver e melhorar as tecnologias de aprendizagem automática e IA da empresa, e a política de privacidade inclui o treino e a melhoria de modelos entre as suas finalidades. Na documentação consultada não surge qualquer via de oposição. Mantenha material confidencial fora do produto de conversa gratuito.

Q9. Existe idade mínima para usar o Z.ai Chat?

Não é indicada qualquer idade mínima explícita. As condições dizem apenas que os menores à luz das leis do seu país ou estado devem rever as condições com um representante legal, o que é orientação e não restrição. A única regra firme proíbe tratar ou armazenar informação pessoal de crianças com menos de 13 anos em violação da COPPA — uma limitação da conduta do utilizador e não uma barreira ao registo.

Q10. Posso usar estes modelos nas minhas ferramentas de programação atuais?

Pode, e é um objetivo de conceção deliberado. O GLM Coding Plan suporta Claude Code, Kilo Code, Cline e OpenCode, entre outros, e a VentureBeat noticiou que o GLM-5.2 estava disponível no lançamento em mais de vinte ambientes de codificação de terceiros. Para integração direta, a API é compatível com o SDK da OpenAI, pelo que migrar uma integração OpenAI existente resume-se muitas vezes a mudar o URL base e a chave.

Conhece uma Ferramenta Semelhante?
Se conhece outras ótimas ferramentas de IA, sinta-se à vontade para as submeter-nos