Z.ai Chat 是第一方的 GLM 對話助手——GLM 大型語言模型家族的官方對話入口。這個區別的分量比表面看來更重,因為絕大多數打著「免費 ChatGPT 替代品」旗號的網站,實際上是把別人的 API 包一層轉售。這個不是:它由打造模型的公司自己營運,首頁也把用途寫得相當直白——由 GLM 驅動的 AI 助理,可以建網站、寫程式、處理長週期任務、給出即時答案。
公司層面有三個名字需要理清,因為它們分別出現在不同地方。對外品牌是 Z.ai。VentureBeat 在報導 GLM-5.2 發布時獨立指出,這家公司是「中國 AI 新創 Z.ai(前身為智譜 AI)」——也就是說 Z.ai 是原智譜這個組織面向國際的身分。但合約相對方與資料控制主體既不是這兩個名字:服務條款把 Z.ai 定義為由 JINGSHENG HENGXING TECHNOLOGY PTE.LTD 營運的平台,這是一家登記在新加坡 International Plaza 的公司,隱私政策也把同一實體列為負責處理你個人資料的控制者。如果你的評估牽涉司法管轄或資料治理,法律意義上要看的是這家新加坡公司。
真正把這個產品與一眾免費聊天助理區隔開的,是它底層的模型大體上採開放權重。VentureBeat 查證 GLM-5.2 的核心權重以無限制的 MIT 開源授權釋出,可自 Hugging Face 下載用於本機微調與自架。因此這個聊天介面本質上是一扇便利的前門,通往一個你原則上可以自己跑起來的模型。能這麼說的免費助理非常少。
有一點需要在開頭釐清,因為這是最常見的混淆來源:Z.ai 同時經營著兩條容易被混為一談的商業線。chat.z.ai 上的對話介面是免費的消費級產品;另外還有一條付費的開發者線——按 token 計費的 API,以及每月 18 美元起的訂閱制 GLM Coding Plan。本文中的價格數字都會標明屬於哪條線,因為 API 價目表並不能說明你在聊天視窗裡要付多少錢。
Z.ai 沒有只端出一個不透明的「最佳模型」,而是把整個家族攤開讓你選。官方文件對目前分工寫得很清楚:GLM-5.3 被描述為最新旗艦,在軟體工程與智慧體能力上全面提升;GLM-5V-Turbo 是專長視覺程式設計的多模態編碼模型;GLM-Image 支援文生圖,官方稱在複雜場景下達到開源 SOTA;CogVideoX-3 負責影片生成。
對話介面頂端就有模型選擇器,切換是一次點擊而不是進設定裡翻找。這件事比聽起來更要緊:輕量模型往往更快,而且對日常問題完全夠用,能有意識地降一階,是實打實的使用體驗優勢。
產品自己的標題就把「Chatbot」與「Agent」並列,能力清單第一項就是長週期任務。這是這家公司投入最顯眼的方向。VentureBeat 對 GLM-5.2 的獨立報導稱,該模型專為在長週期自主編碼與工程任務上取得優勢而設計,給出的基準也正落在這個軸上——SWE-bench Pro 得分 62.1,高於 GPT-5.5 的 58.6;FrontierSWE 達到 74.4%,而後者正是為測試長週期任務完成度而設計的基準。
訂閱使用者還有一層額外的工具能力。GLM Coding Plan 提供專屬 MCP 權限,涵蓋視覺理解、網頁搜尋、網頁讀取與 Zread——也就是讓模型能去查資料、讀頁面,而不是只憑參數作答的那些能力。
VentureBeat 的報導指出 GLM-5.2 具備穩定的 100 萬 token 上下文視窗。值得注意的是這不只是個宣傳數字:同一篇報導描述了名為 IndexShare 的架構最佳化,它在每四個稀疏注意力層之間重複使用同一個索引器,從而在最大上下文長度下把每 token 的運算量降低約 2.9 倍。換句話說,這個長上下文是被工程化為「用得起」,而非名義上可用。
寫程式在這裡不是附帶能力,這個產品在定位上既是對話助理也是編碼智慧體。對話介面在模型選擇器旁設有專屬的 ZCode 入口,訂閱產品更是明確圍繞開發工作打造。依官方文件,GLM Coding Plan 可套用於 Claude Code、Cline、OpenCode 等編碼工具,支援自然語言程式設計——用平實的語言描述需求,自動產生方案、撰寫程式碼、除錯——以及即時的、具備上下文感知的程式碼補全。
對話介面在輸入框正下方預置了五個任務捷徑:著陸頁、科普與教案、3D 建模、小遊戲、個人部落格。這些與其說是獨立功能,不如說是新手引導的鷹架,但選得相當到位——每一個代表的都是「做出一個完整東西」的任務,而非問答式任務,這會把新使用者推向產品真正的強項。
平台自述為中英文使用者量身打造,實際算繪出的介面也印證了這一點:英文的控制項與中文的歡迎語、快捷情境混排。對於需要在這兩種語言之間往返工作的人來說,一個在訓練與產品設計上都把中文當作一等公民而非事後補丁的模型,是有意義的差異點。
對於想在模型之上做開發而不只是聊天的人,文件給出了完整路徑:相容所有程式語言的標準 RESTful HTTP API、官方 Python 與 Java SDK,以及為從 OpenAI 快速遷移而提供的 OpenAI SDK 相容層。端點是 api.z.ai/api/paas/v4/chat/completions,而 OpenAI 相容的形狀意味著既有整合通常只需替換 base URL 與金鑰。
證據最扎實的場景。ZCode 介面、第三方工具整合,加上集中在 SWE-bench Pro 與 FrontierSWE 上的基準表現,共同指向這裡——這是產品瞄準的方向,也是獨立證據最強之處。
這是開放權重廠商獨有、卻被低估的一條工作流。由於 GLM 權重可依 MIT 下載,正在考慮自架的團隊可以先用免費的聊天介面,在自己真實的問題上評估模型行為,再決定是否投入基礎設施。聊天視窗就此變成一個零成本的評估台。
公布的 API 價格把 GLM-4.7 定在每百萬輸入 token 0.6 美元、輸出 2.2 美元,另有若干 Flash 階標註為免費。對於高頻、低複雜度的負載——分類、擷取、例行摘要——這個定價會改變什麼在經濟上可行。
有了網頁搜尋與網頁讀取作為工具,助理可以把回答落在檢索到的頁面上,而不是只依賴參數記憶。適合處理時效性問題與文獻掃描,但要帶上那條標準提醒:檢索能減少但無法消除編造。
中英並重的定位使它成為翻譯、跨語言草擬與在地化審稿的務實選擇——在這類任務上,主要以英文資料訓練的模型常常產出技術正確但語感偏離的中文。
草擬、改寫、解釋、腦力激盪。這些構成了助理使用中最不光鮮的大多數,而它處理得稱職,且不收費。
前往 chat.z.ai。介面呈現的是輸入框、模型選擇器與五個任務捷徑。從捷徑入手是合理的第一步:它們比一個開放式提問更快地展示出這個產品「做出東西」的取向。
用模型選擇器,而不是預設接受當前項。快速的事實性問題用輕量模型回得更快;多步驟的編碼任務就選旗艦。養成把模型與任務配對的習慣,是單位時間品質提升最明顯的一個動作。
這個產品是為長時段自主工作最佳化的。與其拋出一連串小問題,不如描述完整目標、限制條件,以及一個完成品應該長什麼樣。這是順著架構使力,而不是逆著它。
凡是涉及時效或可外部驗證的內容,就用網頁搜尋與閱讀能力,而不是依賴模型的訓練資料。任何模型的參數知識都有截止時間,檢索正是繞開它的辦法。
介面本身固定掛著一條提示,聲明以上內容均由 AI 生成、僅供參考與借鏡。請把它當作實際操作指引而非法務套話——尤其是對程式碼、數字與引文而言。
如果你發現自己已經把聊天視窗當成一條工作流而非新鮮玩意兒,那兩條付費線就在那裡。API 按 token 計費、面向程式化整合;GLM Coding Plan 是訂閱制,用於在 Claude Code、Cline 等工具內部使用。在做選擇之前,請先讀「限制與注意事項」裡的配額機制。
這是最可操作、也最少被宣傳的一條。文件寫明離峰時段的模型用量按標準點數費率的 50% 計費,尖峰定義為新加坡時間週一至週五 14:00 至 18:00。把批次工作挪出那個工作日的四小時視窗,等於把有效配額直接翻倍。沒有任何一篇第三方評測提到過這一點。
訂閱配額以點數計量,算法是輸入 token 乘輸入倍率、加快取輸入乘其倍率、加輸出 token 乘輸出倍率,再除以 10,000。輸出的權重遠高於輸入——以 GLM-5.3 為例,倍率分別是輸入 6.9、快取 1.7、輸出 24。實際後果是:囉嗦的輸出比長輸入貴得多。要求簡潔的回答是一種配額策略,而不只是文風偏好。
無論在 API 價目表還是點數倍率裡,快取輸入的價格都只是全新輸入的一小部分。如果你反覆送出同一段系統提示或同一份文件,把穩定內容安排在可被快取的位置,能實質降低成本。
官方價目表裡有若干模型標註為零成本。對於高頻的簡單任務,把請求導向免費 Flash 階、把旗艦留給真正困難的問題,是很直白的經濟學。
模型可用性因線路而異。VentureBeat 報導稱 GLM-5.3 最初僅透過 GLM Coding Plan 與 ZCode 環境提供,API 存取與開放權重要稍後才跟上。在圍繞某個模型做規劃之前,先確認哪條線已經把它開放出來。
如果自架在考慮範圍內,就系統性地使用這個免費介面——同一批提示、同一套評分標準、跨模型階層跑一遍——再去下載權重。這是成本最低的一次部署前評估。
條款明確要求授權平台將不構成個人資料的 User Content 用於開發與改進其機器學習與人工智慧技術。這在免費的消費級 AI 產品中並不稀奇,但也正因如此,專有程式碼與機密文件不該出現在免費聊天視窗裡。
開發者與工程團隊。 適配度遙遙領先。編碼導向的基準、第三方工具整合,加上積極的定價,這個產品就是圍繞這批人打造的。
正在評估開放權重模型的團隊。 任何採購路徑可能終點是自架的人,都會受益於一個可以先免費試、之後又能依 MIT 下載的第一方介面。
成本敏感的打造者。 那些覺得前沿模型 API 定價難以承受的新創與個人,以及任何只是想要一個不用訂閱的好用免費 AI 助手的人。公布的費率與免費階層實質改變了這筆帳。
中英雙語使用者。 一個把中文當作一等語言而非翻譯目標來設計的模型。
研究者與分析人員。 檢索工具加上超大上下文視窗,適合文件密集的分析工作。
不建議使用的族群。 需要最深厚第三方外掛生態的人,仍會發現 ChatGPT 領先。有政策限制由中國關聯公司處理資料的組織,需要拿新加坡實體結構去比對自己的法遵規則,而不能假定「登記在新加坡」就把問題解決了。需要文件化企業級保障——SLA、經稽核的合規認證——的使用者應另行查證,本次查閱的公開文件並未涵蓋這些內容。
Z.ai Chat 是執行在瀏覽器中的網頁應用,網址為 chat.z.ai。周邊資產按職能拆分:z.ai 承載行銷站、訂閱入口與技術部落格;docs.z.ai 提供開發者文件;api.z.ai 承接 API 流量;法務協議則位於 chat.z.ai/legal-agreement/ 之下。
API 接入是按可移植性設計的。文件提供相容所有程式語言的標準 RESTful HTTP API、官方 Python 與 Java SDK,以及被明確定位為遷移路徑的 OpenAI SDK 相容層,端點為 api.z.ai/api/paas/v4/chat/completions。
觸及範圍遠超第一方介面。VentureBeat 報導稱 GLM-5.2 發布即上架 Hugging Face、Z.ai API 以及 20 多個第三方編碼環境——也就是說你往往可以在自己既有的工具裡用上這些模型。訂閱文件點名支援 Claude Code、Cline 與 OpenCode,訂閱頁還補上了 Kilo Code 等。
介面為雙語,平台自述為中英文使用者量身打造。本次查閱的資料中未見原生行動應用,因此本文不就行動端可用性作出任何斷言。
三條線,定價各不相同。把它們混為一談,是第三方介紹這個產品時最常犯的錯誤。
對話介面是免費的。 Z.ai 自己的主控台訊息把該產品描述為免費的、基於開源的 ChatGPT 替代方案。本次查閱的公開文件並未公布免費聊天階層的訊息則數上限或速率限制,因此本文不給出具體限額——沒有公布限制,並不等於證明不存在限制。
API 按 token 計費,單位為每百萬 token:GLM-5.3 與 GLM-5.2 輸入 1.4 美元、輸出 4.4 美元;GLM-5 為 1 與 3.2;GLM-4.7 為 0.6 與 2.2;GLM-4.7-FlashX 為 0.07 與 0.4。快取輸入便宜得多——旗艦階為 0.26 美元——快取輸入儲存則標註為限時免費。值得注意的是,GLM-4.7-Flash、GLM-4.5-Flash 與 GLM-4.6V-Flash 的輸入輸出均標註為免費。多模態能力單獨計價:網頁搜尋每次 0.01 美元,GLM-Image 每張 0.015 美元,CogVideoX-3 每則影片 0.2 美元,GLM-ASR-2512 約合每分鐘 0.0024 美元。
GLM Coding Plan 是訂閱制,依官方訂閱頁起價為每月 18 美元,涵蓋在 Claude Code、Kilo Code、Cline、OpenCode 等工具內使用 GLM-5.3、GLM-5.2 與 GLM-5-Turbo。共分三階並設雙重配額——Lite 為 5 小時 2,000 點數、每週 10,000;Pro 為 12,000 與 60,000;Max 為 28,000 與 140,000。5 小時點數在消耗後 5 小時動態重新整理,週點數自訂閱起每 7 日重設。技巧章節提到的離峰折扣,實際上讓安排在新加坡工作日下午之外的工作獲得了雙倍容量。
關於價格波動的一個參照:VentureBeat 2026 年 6 月的報導提到企業訂閱階層起價為每月 12.60 美元,低於目前標示的 18 美元。促銷價顯然會變動,請以當前費率為準,而不要依賴任何文章——包括本文——中引用的數字。
ChatGPT 仍是廣度上的標竿——最大的外掛與整合生態、最完善的行動體驗、最深厚的第三方工具鏈。Z.ai 競爭的是價格與開放權重,而非生態成熟度。
Claude 是編碼與長文件工作上最常見的對照物,而且值得注意的是 GLM Coding Plan 本身就設計成可在 Claude Code 內執行——對那些想保留工具鏈、只換掉背後模型的開發者來說,這兩個產品與其說是競品,不如說是互補品。
DeepSeek 是結構上最接近的類比:同樣是中國實驗室、同樣推出強力的開放權重模型、同樣定價積極。在兩者之間做選擇,通常取決於基準與你具體工作負載的契合度,而非某種範疇性的差別。
Gemini 提供深度的 Google Workspace 整合與超大上下文。VentureBeat 的基準報導顯示 GLM-5.2 在 Terminal-Bench 2.1 上明顯領先 Gemini 3.1 Pro——81.0 對 74.0——不過基準上的領先幅度很窄,且隨每次發布而變動。
直接自架 GLM 值得作為這家廠商獨有的替代方案單列。由於權重以 MIT 授權掛在 Hugging Face 上,一個組織可以在自己的基礎設施上跑同一個模型——沒有廠商鎖定、資料不出邊界,代價是 GPU 算力與維運投入。
誠實的總結是:Z.ai Chat 的差異化在於開放權重、積極定價與編碼導向的智慧體能力。相對 ChatGPT 的劣勢是生態深度與行動端打磨。對於一個具體且在擴大的族群——在意成本與可移植性的開發者——這筆交換是划算的。
廠商素材與愛好者報導往往呈現為一場完勝,而獨立報導要更有層次。VentureBeat 自己的基準表顯示 GLM-5.2 在部分指標上取得決定性優勢——SWE-bench Pro 62.1 對 GPT-5.5 的 58.6——但在另一些指標上落後:在原始的 Terminal-Bench 2.1 得分上它是 81.0,低於 Claude 4.8 的 85.0 與 GPT-5.5 的 84.0;而在同一指標上它又大幅領先 Gemini 3.1 Pro。準確的讀法是「處於前沿競爭位、並在長週期編碼上有特定強項」,而不是「全面輾壓」。另外基準本身也很快就會過時。
開放權重這個故事帶著一個重要的星號。VentureBeat 報導稱 GLM-5.3 最初僅透過 GLM Coding Plan 與 ZCode 環境提供,API 存取與開放權重要等安全評估與強化完成後才跟上,公司計畫在發布約兩週後放出權重。也就是說,最新的模型在一段時間內是封閉的、需訂閱才能用的產品。如果你的方案仰賴權重可下載,請針對具體版本查證可用性,不要假定整個家族的授權情況一律適用。
訂閱前有兩條明載規則值得注意。GLM Coding Plan 嚴格限定在官方支援的工具與產品內使用,訂閱者被告知不得在任何不受支援的工具或情境中使用訂閱權益——這不是一筆通用的點數餘額。而當配額用盡時,依官方 FAQ 的說法,你必須等到下一個 5 小時週期重新整理,系統不會從你的帳戶餘額中扣款。這一點可以說是對使用者友善的,因為它避免了意外扣費;但同時也意味著觸頂就是停工,而非降級繼續。
每個階層都同時帶有 5 小時限額與每週限額。完全可能出現週額度還有剩餘、卻被 5 小時視窗卡住的情況,反之亦然。任何計畫高強度衝刺使用的人,都應該把兩個限制一起算進去。
條款要求你明確授權該公司使用並儲存不構成個人資料的 User Content,用於開發與改進其機器學習與人工智慧技術。隱私政策另外把訓練與改進模型列為其合法利益用途之一,並說明可能從網際網路公開資訊中取得資料用於訓練模型。本次查閱的素材中未見任何退出機制。對免費階層的消費級 AI 而言這不算意外,但它應當影響你往視窗裡貼上什麼。
沒有任何明示的最低註冊年齡。條款只說,如果依你所在國家或州的法律你屬於未成年人,你應與法定監護人共同審閱本條款——這是指引,不是關卡。唯一與年齡掛鉤的硬性規定,是禁止使用者以違反 COPPA 的方式處理或儲存 13 歲以下兒童的個人資訊,而這約束的是使用者能做什麼,而非誰可以註冊。正在評估這個工具的家長,不應把「沒有關卡」讀作「適用性有保障」。
這個產品身上掛著三個名字:Z.ai 這個品牌、智譜 AI 這個舊稱,以及新加坡合約主體 JINGSHENG HENGXING TECHNOLOGY PTE.LTD,後者同時也是載明的資料控制者。對多數個人使用者來說這無關緊要;但對有資料落地或來源國政策的組織來說並非如此,而「登記在新加坡」本身並不能解決關於一家被 VentureBeat 描述為中國 AI 新創的機構的疑問。請按你實際的政策去評估,而不是看頁尾的一行字。
隱私政策允許向任何業務夥伴、投資人、受讓人或受讓方揭露資訊,以便利業務資產交易,範圍延伸至併購、收購或債務與資產出售。這在業界是標準做法,但值得知悉:你資料的保管方可能在你不參與的情況下發生變化。
對話介面底部固定的提示寫明所有內容均由 AI 生成、僅供參考。產品自己並不主張準確性,你也不應替它主張。
公開文件對 API 費率、點數倍率與配額機制寫得很細緻,而對免費聊天產品自身的限制則相對沉默。免費階層的訊息則數上限、速率限制,以及聊天對話的資料保留期限,在本次查閱的素材中均未找到。這是一處資訊缺口,此處如實指出,而非用猜測去填補。
在一次採集過程中,這個產品的頁面標題出現的是 GLM-5.2,模型選擇器裡是 GLM-4.7,而部落格連結與文件裡是 GLM-5.3。任何二手資料——包括本頁——裡的版本引用都會很快過時。請以介面上當前實際提供的為準。
對話介面可以免費使用,平台自己的主控台訊息也把它描述為免費的、基於開源的 ChatGPT 替代方案。有兩點需要釐清。第一,「免費」指的是聊天產品;API 按 token 計費,GLM Coding Plan 是每月 18 美元起的付費訂閱。第二,本次查閱的公開文件並未公布免費階層的訊息上限或速率限制,因此無法引用具體數字——這是可得資訊中的缺口,而非「無限使用」的保證。
是的,這是第一方產品。VentureBeat 在獨立報導中指出,這家公司是中國 AI 新創 Z.ai,前身為智譜 AI——也就是開發 GLM 模型的那個組織。條款與隱私政策中載明的合約與資料控制主體則是一家新加坡公司 JINGSHENG HENGXING TECHNOLOGY PTE.LTD。所以:Z.ai 是品牌,智譜 AI 是舊稱,新加坡實體是法律上的相對方。
文件目前把 GLM-5.3 定位為面向軟體工程與智慧體工作的旗艦,GLM-5V-Turbo 用於視覺程式設計,GLM-Image 用於文生圖,CogVideoX-3 用於影片。對話介面帶有模型選擇器,API 價目表涵蓋的範圍更廣,包括 GLM-5.2、GLM-5、GLM-4.7 以及免費的 Flash 階層。可用性因線路而異——GLM-5.3 是先在 Coding Plan 與 ZCode 上線,之後才是 API 與開放權重。
大體是,但有時間上的保留。VentureBeat 查證 GLM-5.2 的核心權重以無限制的 MIT 授權釋出,可自 Hugging Face 下載用於自架與微調。不過同一家媒體報導稱 GLM-5.3 首先是作為僅限訂閱的產品上線的,權重計畫在發布約兩週後、安全評估完成後再放出。請針對你需要的具體版本查證授權情況。
按每百萬 token 計:GLM-5.3 與 GLM-5.2 輸入 1.4 美元、輸出 4.4 美元;GLM-5 為 1 與 3.2;GLM-4.7 為 0.6 與 2.2;GLM-4.7-FlashX 為 0.07 與 0.4。快取輸入便宜得多。GLM-4.7-Flash、GLM-4.5-Flash 與 GLM-4.6V-Flash 標註為免費。工具與媒體單獨計價:網頁搜尋每次 0.01 美元,GLM-Image 每張 0.015 美元,CogVideoX-3 每則 0.2 美元。
每階都同時帶兩個限額。Lite 提供 5 小時 2,000 點數與每週 10,000;Pro 為 12,000 與 60,000;Max 為 28,000 與 140,000。5 小時點數在消耗後 5 小時重新整理,週點數每 7 日重設。點數由輸入、快取輸入與輸出 token 分別乘以各模型倍率再除以 10,000 得出,其中輸出權重最高。關鍵在於,離峰時段按標準費率的 50% 計費,尖峰定義為新加坡時間週一至週五 14:00 至 18:00。
只能等。官方 FAQ 寫明系統不會從你的帳戶餘額中扣款,配額用盡後必須等到下一個 5 小時週期重新整理。這避免了意外扣費,但也意味著工作會停下而非降階繼續。另需注意該方案嚴格限定在官方支援的工具內使用。
實際上是的。條款要求你授權平台使用並儲存不構成個人資料的 User Content,用於開發與改進其機器學習與人工智慧技術,隱私政策也把訓練與改進模型列入其用途。本次查閱的文件中未見退出機制。請把機密素材排除在免費聊天產品之外。
沒有明示的最低年齡。條款只說依所在國家或州法律屬於未成年人的使用者應與法定監護人共同審閱條款,這是指引而非限制。唯一的硬性規定是禁止以違反 COPPA 的方式處理或儲存 13 歲以下兒童的個人資訊——這約束的是使用者行為,而非註冊資格。
可以,而且這是刻意的設計目標。GLM Coding Plan 支援 Claude Code、Kilo Code、Cline 與 OpenCode 等,VentureBeat 也報導稱 GLM-5.2 發布時即可在 20 多個第三方編碼環境中使用。若要直接整合,API 相容 OpenAI SDK,因此遷移既有的 OpenAI 整合通常只需要改 base URL 與金鑰。