Z.ai Chat 是第一方的 GLM 对话助手——GLM 大语言模型家族的官方对话入口。这个区别的分量比看上去更重——因为绝大多数打着「免费 ChatGPT 替代品」旗号的站点,其实是把别人的 API 包一层转售。这个不是:它由造模型的公司自己运营,首页也把用途写得很直白——由 GLM 驱动的 AI 助手,可以建网站、写代码、处理长周期任务、给出即时答案。
公司层面有三个名字需要理清,因为它们分别出现在不同的地方。对外品牌是 Z.ai。VentureBeat 在报道 GLM-5.2 发布时独立指出,这家公司是「中国 AI 创业公司 Z.ai(前身为智谱 AI)」——也就是说 Z.ai 是原智谱这个组织面向国际的身份。但合同相对方与数据控制主体既不是这两个名字:服务条款把 Z.ai 定义为由 JINGSHENG HENGXING TECHNOLOGY PTE.LTD 运营的平台,这是一家注册在新加坡 International Plaza 的公司,隐私政策也把同一实体列为负责处理你个人数据的控制者。如果你的评估涉及司法辖区或数据治理,法律意义上要看的是这家新加坡公司。
真正把这个产品与一众免费聊天助手区分开的,是它底层的模型大体上是开放权重的。VentureBeat 核实 GLM-5.2 的核心权重以无限制的 MIT 开源许可证发布,可从 Hugging Face 下载用于本地微调与自部署。因此这个聊天界面本质上是一扇便利的前门,通向一个你原则上可以自己跑起来的模型。能这么说的免费助手非常少。
有一点需要在开头澄清,因为这是最常见的混淆来源:Z.ai 同时运行着两条容易被搅在一起的商业线。chat.z.ai 上的对话界面是免费的消费级产品;另外还有一条付费的开发者线——按 token 计费的 API,以及每月 18 美元起的订阅制 GLM Coding Plan。本文中的价格数字都会标明属于哪条线,因为 API 价目表并不能说明你在聊天窗口里要付多少钱。
Z.ai 没有只给出一个不透明的「最佳模型」,而是把整个家族摊开让你选。官方文档对当前分工写得很清楚:GLM-5.3 被描述为最新旗舰,在软件工程与智能体能力上全面提升;GLM-5V-Turbo 是专长视觉编程的多模态编码模型;GLM-Image 支持文生图,官方称在复杂场景下达到开源 SOTA;CogVideoX-3 负责视频生成。
对话界面顶部就有模型选择器,切换是一次点击而不是去设置里挖。这件事比听上去更要紧:轻量模型往往更快,而且对日常问题完全够用,能有意识地降一档,是实打实的使用体验优势。
产品自己的标题就把「Chatbot」和「Agent」并列,能力清单第一项是长周期任务。这是这家公司投入最显眼的方向。VentureBeat 对 GLM-5.2 的独立报道称,该模型专为在长周期自主编码与工程任务上取得优势而设计,给出的基准也正落在这个轴上——SWE-bench Pro 得分 62.1,高于 GPT-5.5 的 58.6;FrontierSWE 达到 74.4%,而后者正是为测试长周期任务完成度而设计的基准。
订阅用户还有一层额外的工具能力。GLM Coding Plan 提供专属 MCP 权限,涵盖视觉理解、网页搜索、网页读取与 Zread——也就是让模型能去查资料、读页面,而不是只凭参数作答的那些能力。
VentureBeat 的报道称 GLM-5.2 具备稳定的 100 万 token 上下文窗口。值得注意的是这不只是个宣传数字:同一篇报道描述了名为 IndexShare 的架构优化,它在每四个稀疏注意力层之间复用同一个索引器,从而在最大上下文长度下把每 token 的计算量降低约 2.9 倍。换句话说,这个长上下文是被工程化为「用得起」的,而不是名义上可用。
写代码在这里不是附带能力,这个产品在定位上既是对话助手也是编码智能体。对话界面在模型选择器旁设有专门的 ZCode 入口,订阅产品更是明确围绕开发工作构建。按官方文档,GLM Coding Plan 可应用于 Claude Code、Cline、OpenCode 等编码工具,支持自然语言编程——用平实的语言描述需求,自动生成方案、编写代码、调试问题——以及实时的、具备上下文感知的代码补全。
对话界面在输入框正下方预置了五个任务快捷方式:落地页、科普与教案、3D 建模、小游戏、个人博客。这些与其说是独立功能,不如说是新手引导的脚手架,但选得相当到位——每一个代表的都是「做出一个完整东西」的任务,而不是问答式任务,这会把新用户推向产品真正的强项。
平台自述为中英文用户量身定制,实际渲染出的界面也印证了这一点:英文的控件与中文的欢迎语、快捷场景混排。对于需要在这两种语言之间往返工作的人来说,一个在训练与产品设计上都把中文当作一等公民而非事后补丁的模型,是有意义的差异点。
对于想在模型之上做开发而不只是聊天的人,文档给出了完整路径:兼容所有编程语言的标准 RESTful HTTP API、官方 Python 与 Java SDK,以及为从 OpenAI 快速迁移而提供的 OpenAI SDK 兼容层。端点是 api.z.ai/api/paas/v4/chat/completions,而 OpenAI 兼容的形状意味着既有集成通常只需要替换 base URL 和密钥。
证据最扎实的场景。ZCode 界面、第三方工具集成,加上集中在 SWE-bench Pro 与 FrontierSWE 上的基准表现,共同指向这里——这是产品瞄准的方向,也是独立证据最强的地方。
这是开放权重厂商独有、却被低估的一条工作流。由于 GLM 权重可按 MIT 下载,正在考虑自部署的团队可以先用免费的聊天界面,在自己真实的问题上评估模型行为,再决定是否投入基础设施。聊天窗口就此变成一个零成本的评估台。
公布的 API 价格把 GLM-4.7 定在每百万输入 token 0.6 美元、输出 2.2 美元,另有若干 Flash 档位标注为免费。对于高频、低复杂度的负载——分类、抽取、常规摘要——这个定价会改变什么在经济上可行。
有了网页搜索与网页读取作为工具,助手可以把回答落在检索到的页面上,而不是只依赖参数记忆。适合处理时效性问题与文献扫描,但要带上那条标准提醒:检索能减少但不能消除编造。
中英并重的定位使它成为翻译、跨语言起草与本地化审校的务实选择——在这类任务上,主要以英文数据训练的模型常常产出技术正确但语感偏离的中文。
起草、改写、解释、头脑风暴。这些构成了助手使用中最不光鲜的大多数,而它处理得称职,且不收费。
访问 chat.z.ai。界面呈现的是输入框、模型选择器和五个任务快捷方式。从快捷方式入手是合理的第一步:它们比一个开放式提问更快地展示出这个产品「做出东西」的取向。
用模型选择器,而不是默认接受当前项。快速的事实性问题用轻量模型回得更快;多步骤的编码任务就选旗舰。养成把模型与任务匹配的习惯,是单位时间质量提升最明显的一个动作。
这个产品是为长时段自主工作优化的。与其抛出一连串小问题,不如描述完整目标、约束条件,以及一个完成品应该长什么样。这是顺着架构使力,而不是逆着它。
凡是涉及时效或可外部验证的内容,就用网页搜索与阅读能力,而不是依赖模型的训练数据。任何模型的参数知识都有截止时间,检索正是绕开它的办法。
界面本身固定挂着一条提示,声明以上内容均由 AI 生成、仅供参考和借鉴。请把它当作实际操作指引而不是法务套话——尤其是对代码、数字和引文而言。
如果你发现自己已经把聊天窗口当成一条工作流而不是新鲜玩意儿,那两条付费线就在那里。API 按 token 计费、面向程序化集成;GLM Coding Plan 是订阅制,用于在 Claude Code、Cline 等工具内部使用。在做选择之前,请先读「限制与注意事项」里的配额机制。
这是最可操作、也最少被宣传的一条。文档写明非高峰时段的模型用量按标准信用费率的 50% 计费,高峰定义为新加坡时间周一至周五 14:00 至 18:00。把批量工作挪出那个工作日的四小时窗口,等于把有效配额直接翻倍。没有任何一篇第三方评测提到过这一点。
订阅配额以信用计量,算法是输入 token 乘输入倍率、加缓存输入乘其倍率、加输出 token 乘输出倍率,再除以 10,000。输出的权重远高于输入——以 GLM-5.3 为例,倍率分别是输入 6.9、缓存 1.7、输出 24。实际后果是:啰嗦的输出比长输入贵得多。要求简洁的回答是一种配额策略,而不只是文风偏好。
无论在 API 价目表还是信用倍率里,缓存输入的价格都只是新鲜输入的一小部分。如果你反复发送同一段系统提示或同一份文档,把稳定内容安排在可被缓存的位置,能实质性地降低成本。
官方价目表里有若干模型标注为零成本。对于高频的简单任务,把请求路由到免费 Flash 档、把旗舰留给真正困难的问题,是很直白的经济学。
模型可用性因线路而异。VentureBeat 报道称 GLM-5.3 最初仅通过 GLM Coding Plan 与 ZCode 环境提供,API 访问与开放权重要稍后才跟上。在围绕某个模型做规划之前,先确认哪条线已经把它开放出来。
如果自部署在考虑范围内,就系统性地使用这个免费界面——同一批提示、同一套评分标准、跨模型档位跑一遍——再去下载权重。这是成本最低的一次部署前评估。
条款明确要求授权平台将不构成个人数据的 User Content 用于开发和改进其机器学习与人工智能技术。这在免费的消费级 AI 产品中并不稀奇,但也正因如此,专有代码与机密文档不该出现在免费聊天窗口里。
开发者与工程团队。 适配度遥遥领先。编码导向的基准、第三方工具集成,加上激进的定价,这个产品就是围绕这批人构建的。
正在评估开放权重模型的团队。 任何采购路径可能终点是自部署的人,都会受益于一个可以先免费试、之后又能按 MIT 下载的第一方界面。
成本敏感的构建者。 那些觉得前沿模型 API 定价难以承受的创业公司与个人,以及任何只是想要一个不用订阅的好用免费 AI 助手的人。公布的费率与免费档位实质性地改变了这笔账。
中英双语用户。 一个把中文当作一等语言而非翻译目标来设计的模型。
研究者与分析人员。 检索工具加上超大上下文窗口,适合文档密集的分析工作。
不建议使用的人群。 需要最深厚第三方插件生态的人,仍会发现 ChatGPT 领先。有政策限制由中国关联公司处理数据的组织,需要拿新加坡实体结构去比对自己的合规规则,而不能假定「注册在新加坡」就把问题解决了。需要文档化企业级保障——SLA、经审计的合规认证——的用户应另行核实,本次查阅的公开文档并未覆盖这些内容。
Z.ai Chat 是运行在浏览器中的网页应用,地址为 chat.z.ai。周边资产按职能拆分:z.ai 承载营销站、订阅入口与技术博客;docs.z.ai 提供开发者文档;api.z.ai 承接 API 流量;法务协议则位于 chat.z.ai/legal-agreement/ 之下。
API 接入是按可移植性设计的。文档提供兼容所有编程语言的标准 RESTful HTTP API、官方 Python 与 Java SDK,以及被明确定位为迁移路径的 OpenAI SDK 兼容层,端点为 api.z.ai/api/paas/v4/chat/completions。
触达范围远超第一方界面。VentureBeat 报道称 GLM-5.2 发布即上架 Hugging Face、Z.ai API 以及 20 多个第三方编码环境——也就是说你往往可以在自己已有的工具里用上这些模型。订阅文档点名支持 Claude Code、Cline 与 OpenCode,订阅页还补上了 Kilo Code 等。
界面为双语,平台自述为中英文用户量身定制。本次查阅的资料中未见原生移动应用,因此本文不就移动端可用性作出任何断言。
三条线,定价各不相同。把它们混为一谈,是第三方介绍这个产品时最常犯的错误。
对话界面是免费的。 Z.ai 自己的控制台信息把该产品描述为免费的、基于开源的 ChatGPT 替代方案。本次查阅的公开文档并未公布免费聊天档位的消息条数上限或速率限制,因此本文不给出具体限额——没有公布限制,并不等于证明不存在限制。
API 按 token 计费,单位为每百万 token:GLM-5.3 与 GLM-5.2 输入 1.4 美元、输出 4.4 美元;GLM-5 为 1 与 3.2;GLM-4.7 为 0.6 与 2.2;GLM-4.7-FlashX 为 0.07 与 0.4。缓存输入便宜得多——旗舰档为 0.26 美元——缓存输入存储则标注为限时免费。值得注意的是,GLM-4.7-Flash、GLM-4.5-Flash 与 GLM-4.6V-Flash 的输入输出均标注为免费。多模态能力单独计价:网页搜索每次 0.01 美元,GLM-Image 每张 0.015 美元,CogVideoX-3 每条视频 0.2 美元,GLM-ASR-2512 约合每分钟 0.0024 美元。
GLM Coding Plan 是订阅制,据官方订阅页起价为每月 18 美元,覆盖在 Claude Code、Kilo Code、Cline、OpenCode 等工具内使用 GLM-5.3、GLM-5.2 与 GLM-5-Turbo。共分三档并设双重配额——Lite 为 5 小时 2,000 信用、每周 10,000;Pro 为 12,000 与 60,000;Max 为 28,000 与 140,000。5 小时信用在消耗后 5 小时动态刷新,周信用自订阅起每 7 日重置。技巧章节提到的非高峰折扣,实际上让安排在新加坡工作日下午之外的工作获得了双倍容量。
关于价格波动的一个参照:VentureBeat 2026 年 6 月的报道提到企业订阅档位起价为每月 12.60 美元,低于目前标示的 18 美元。促销价显然会变动,请以当前费率为准,而不要依赖任何文章——包括本文——中引用的数字。
ChatGPT 仍是广度上的标杆——最大的插件与集成生态、最完善的移动体验、最深厚的第三方工具链。Z.ai 竞争的是价格与开放权重,而不是生态成熟度。
Claude 是编码与长文档工作上最常见的对照物,而且值得注意的是 GLM Coding Plan 本身就设计成可在 Claude Code 内运行——对那些想保留工具链、只换掉背后模型的开发者来说,这两个产品与其说是竞品,不如说是互补品。
DeepSeek 是结构上最接近的类比:同样是中国实验室、同样推出强力的开放权重模型、同样定价激进。在两者之间做选择,通常取决于基准与你具体负载的契合度,而非某种范畴性的差别。
Gemini 提供深度的 Google Workspace 集成与超大上下文。VentureBeat 的基准报道显示 GLM-5.2 在 Terminal-Bench 2.1 上明显领先 Gemini 3.1 Pro——81.0 对 74.0——不过基准上的领先幅度很窄,且随每次发布而变动。
直接自部署 GLM 值得作为这家厂商独有的替代方案单列。由于权重以 MIT 许可证挂在 Hugging Face 上,一个组织可以在自己的基础设施上跑同一个模型——没有厂商锁定、数据不出边界,代价是 GPU 算力与运维投入。
诚实的总结是:Z.ai Chat 的差异化在于开放权重、激进定价与编码导向的智能体能力。相对 ChatGPT 的劣势是生态深度与移动端打磨。对于一个具体且在扩大的人群——在意成本与可移植性的开发者——这笔交换是划算的。
厂商材料与爱好者报道往往呈现为一场完胜,而独立报道要更有层次。VentureBeat 自己的基准表显示 GLM-5.2 在部分指标上取得决定性优势——SWE-bench Pro 62.1 对 GPT-5.5 的 58.6——但在另一些指标上落后:在原始的 Terminal-Bench 2.1 得分上它是 81.0,低于 Claude 4.8 的 85.0 与 GPT-5.5 的 84.0;而在同一指标上它又大幅领先 Gemini 3.1 Pro。准确的读法是「处于前沿竞争位、并在长周期编码上有特定强项」,而不是「全面碾压」。另外基准本身也很快就会过时。
开放权重这个故事带着一个重要的星号。VentureBeat 报道称 GLM-5.3 最初仅通过 GLM Coding Plan 与 ZCode 环境提供,API 访问与开放权重要等安全评估与加固完成后才跟上,公司计划在发布约两周后放出权重。也就是说,最新的模型在一段时间内是封闭的、需订阅才能用的产品。如果你的方案依赖权重可下载,请针对具体版本核实可用性,不要假定整个家族的许可情况一律适用。
订阅前有两条明载规则值得注意。GLM Coding Plan 严格限定在官方支持的工具与产品内使用,订阅者被告知不得在任何不受支持的工具或场景中使用订阅权益——这不是一笔通用的信用余额。而当配额用尽时,按官方 FAQ 的说法,你必须等到下一个 5 小时周期刷新,系统不会从你的账户余额中扣款。这一点可以说是对用户友好的,因为它避免了意外扣费;但同时也意味着触顶就是停工,而不是降级继续。
每个档位都同时带有 5 小时限额与每周限额。完全可能出现周额度还有剩余、却被 5 小时窗口卡住的情况,反之亦然。任何计划高强度突击使用的人,都应该把两个约束一起算进去。
条款要求你明确授权该公司使用并存储不构成个人数据的 User Content,用于开发和改进其机器学习与人工智能技术。隐私政策另外把训练与改进模型列为其合法利益用途之一,并说明可能从互联网公开信息中获取资料用于训练模型。本次查阅的材料中未见任何退出机制。对免费档的消费级 AI 而言这不算意外,但它应当影响你往窗口里粘贴什么。
没有任何明示的最低注册年龄。条款只说,如果依你所在国家或州的法律你属于未成年人,你应与法定监护人共同审阅本条款——这是指引,不是关卡。唯一与年龄挂钩的硬性规定,是禁止用户以违反 COPPA 的方式处理或存储 13 岁以下儿童的个人信息,而这约束的是用户能做什么,而非谁可以注册。正在评估这个工具的家长,不应把「没有关卡」读作「适用性有保障」。
这个产品身上挂着三个名字:Z.ai 这个品牌、智谱 AI 这个旧称,以及新加坡合同主体 JINGSHENG HENGXING TECHNOLOGY PTE.LTD,后者同时也是载明的数据控制者。对多数个人用户来说这无关紧要;但对有数据驻留或来源国政策的组织来说并非如此,而「注册在新加坡」本身并不能解决关于一家被 VentureBeat 描述为中国 AI 创业公司的机构的疑问。请按你实际的政策去评估,而不是看页脚的一行字。
隐私政策允许向任何业务伙伴、投资者、受让人或受让方披露信息,以便利业务资产交易,范围延伸至并购、收购或债务与资产出售。这在行业内是标准做法,但值得知晓:你数据的保管方可能在你不参与的情况下发生变化。
对话界面底部固定的提示写明所有内容均由 AI 生成、仅供参考。产品自己并不主张准确性,你也不应替它主张。
公开文档对 API 费率、信用倍率与配额机制写得很细致,而对免费聊天产品自身的限制则相对沉默。免费档的消息条数上限、速率限制,以及聊天对话的数据保留期限,在本次查阅的材料中均未找到。这是一处信息缺口,此处如实指出,而不用猜测去填补。
在一次采集过程中,这个产品的页面标题出现的是 GLM-5.2,模型选择器里是 GLM-4.7,而博客链接与文档里是 GLM-5.3。任何二手资料——包括本页——里的版本引用都会很快过时。请以界面上当前实际提供的为准。
对话界面可以免费使用,平台自己的控制台信息也把它描述为免费的、基于开源的 ChatGPT 替代方案。有两点需要澄清。第一,「免费」指的是聊天产品;API 按 token 计费,GLM Coding Plan 是每月 18 美元起的付费订阅。第二,本次查阅的公开文档并未公布免费档的消息上限或速率限制,因此无法引用具体数字——这是可得信息中的缺口,而不是「无限使用」的保证。
是的,这是第一方产品。VentureBeat 在独立报道中指出,这家公司是中国 AI 创业公司 Z.ai,前身为智谱 AI——也就是开发 GLM 模型的那个组织。条款与隐私政策中载明的合同与数据控制主体则是一家新加坡公司 JINGSHENG HENGXING TECHNOLOGY PTE.LTD。所以:Z.ai 是品牌,智谱 AI 是旧称,新加坡实体是法律上的相对方。
文档目前把 GLM-5.3 定位为面向软件工程与智能体工作的旗舰,GLM-5V-Turbo 用于视觉编程,GLM-Image 用于文生图,CogVideoX-3 用于视频。对话界面带有模型选择器,API 价目表覆盖的范围更广,包括 GLM-5.2、GLM-5、GLM-4.7 以及免费的 Flash 档位。可用性因线路而异——GLM-5.3 是先在 Coding Plan 与 ZCode 上线,之后才是 API 与开放权重。
大体是,但有时间上的保留。VentureBeat 核实 GLM-5.2 的核心权重以无限制的 MIT 许可证发布,可从 Hugging Face 下载用于自部署与微调。不过同一家媒体报道称 GLM-5.3 首先是作为仅限订阅的产品上线的,权重计划在发布约两周后、安全评估完成后再放出。请针对你需要的具体版本核实许可情况。
按每百万 token 计:GLM-5.3 与 GLM-5.2 输入 1.4 美元、输出 4.4 美元;GLM-5 为 1 与 3.2;GLM-4.7 为 0.6 与 2.2;GLM-4.7-FlashX 为 0.07 与 0.4。缓存输入便宜得多。GLM-4.7-Flash、GLM-4.5-Flash 与 GLM-4.6V-Flash 标注为免费。工具与媒体单独计价:网页搜索每次 0.01 美元,GLM-Image 每张 0.015 美元,CogVideoX-3 每条 0.2 美元。
每档都同时带两个限额。Lite 提供 5 小时 2,000 信用与每周 10,000;Pro 为 12,000 与 60,000;Max 为 28,000 与 140,000。5 小时信用在消耗后 5 小时刷新,周信用每 7 日重置。信用由输入、缓存输入与输出 token 分别乘以各模型倍率再除以 10,000 得出,其中输出权重最高。关键在于,非高峰时段按标准费率的 50% 计费,高峰定义为新加坡时间周一至周五 14:00 至 18:00。
只能等。官方 FAQ 写明系统不会从你的账户余额中扣款,配额用尽后必须等到下一个 5 小时周期刷新。这避免了意外扣费,但也意味着工作会停下而不是降档继续。另需注意该计划严格限定在官方支持的工具内使用。
实际上是的。条款要求你授权平台使用并存储不构成个人数据的 User Content,用于开发和改进其机器学习与人工智能技术,隐私政策也把训练与改进模型列入其用途。本次查阅的文档中未见退出机制。请把机密材料排除在免费聊天产品之外。
没有明示的最低年龄。条款只说依所在国家或州法律属于未成年人的用户应与法定监护人共同审阅条款,这是指引而非限制。唯一的硬性规定是禁止以违反 COPPA 的方式处理或存储 13 岁以下儿童的个人信息——这约束的是用户行为,而不是注册资格。
可以,而且这是刻意的设计目标。GLM Coding Plan 支持 Claude Code、Kilo Code、Cline 与 OpenCode 等,VentureBeat 也报道称 GLM-5.2 发布时即可在 20 多个第三方编码环境中使用。若要直接集成,API 兼容 OpenAI SDK,因此迁移既有的 OpenAI 集成通常只需要改 base URL 和密钥。