Пользовались этим инструментом? Оцените его
Пользовались этим инструментом? Оцените его
Z.ai Chat — это чат-бот GLM от первого лица, то есть официальный диалоговый интерфейс семейства больших языковых моделей GLM. Различие весит больше, чем кажется, поскольку большинство сайтов, объявляющих себя «бесплатной альтернативой ChatGPT», представляют собой перепродавцов, обернувших чужой API. Здесь не так: сервис ведёт та самая компания, которая создаёт модели, и главная страница называет назначение прямо — ИИ-ассистент на базе GLM, позволяющий собирать сайты, писать код, вести длительные задачи и получать мгновенные ответы.
В корпоративной картине три слоя, которые стоит распутать, поскольку каждый встречается в своём месте. Публичный бренд — Z.ai. VentureBeat в независимом материале о выходе GLM-5.2 называет компанию «китайским ИИ-стартапом Z.ai (ранее Zhipu AI)», то есть Z.ai — это международное лицо организации, прежде известной как Zhipu. Однако стороной договора и оператором персональных данных выступает ни одно из этих имён: условия использования определяют Z.ai как платформу, управляемую JINGSHENG HENGXING TECHNOLOGY PTE.LTD, сингапурской компанией с регистрацией в International Plaza, а политика конфиденциальности называет то же юридическое лицо контролёром, отвечающим за обработку ваших персональных данных. Если оценка затрагивает юрисдикцию или управление данными, юридически значима именно сингапурская компания.
Что выделяет этот продукт среди множества бесплатных чат-ассистентов — модели под ним преимущественно имеют открытые веса. VentureBeat подтверждает, что ключевые веса GLM-5.2 опубликованы под неограничительной открытой лицензией MIT и доступны для загрузки с Hugging Face ради локальной донастройки и самостоятельного развёртывания. Диалоговый интерфейс, таким образом, служит удобной парадной дверью к модели, которую вы в принципе могли бы запустить и сами. Очень немногие бесплатные ассистенты способны сказать о себе то же.
Одно уточнение сразу, поскольку это самый частый источник путаницы: Z.ai ведёт две коммерческие линии, которые легко смешать. Диалоговый интерфейс на chat.z.ai — бесплатный потребительский продукт. Отдельно существует платная платформа для разработчиков: API с потокенной тарификацией и подписочный GLM Coding Plan от 18 долларов в месяц. Цены в этом материале помечены по линиям, потому что прейскурант API не описывает, сколько вы платите за использование окна чата.
Вместо непрозрачной «лучшей модели» Z.ai раскрывает всё семейство и позволяет выбрать. Официальная документация чётко распределяет роли: GLM-5.3 описан как новейший флагман с комплексным продвижением в программной инженерии и агентных способностях; GLM-5V-Turbo — мультимодальная модель для кодинга со специализацией на визуальном программировании; GLM-Image поддерживает генерацию изображений по тексту с заявкой на уровень открытого SOTA в сложных сценах; CogVideoX-3 отвечает за генерацию видео.
В верхней части интерфейса есть селектор модели, так что переключение — один щелчок, а не раскопки в настройках. Это важнее, чем звучит: более лёгкая модель часто отвечает быстрее и вполне достаточна для рутинных вопросов, а возможность осознанно спуститься на ступень ниже — реальное эргономическое преимущество.
Само название продукта ставит рядом «Chatbot» и «Agent», а перечень возможностей открывается длительными задачами. Именно в эту ось компания вложилась заметнее всего. Независимый материал VentureBeat описывает GLM-5.2 как модель, спроектированную специально для доминирования в длительных автономных задачах кодинга и инженерии, и приводит результаты тестов ровно по этой оси: 62,1 в SWE-bench Pro против 58,6 у GPT-5.5 и 74,4 % в FrontierSWE — бенчмарке, созданном для проверки завершения длительных задач.
Подписчикам достаётся дополнительный слой инструментов. GLM Coding Plan предоставляет эксклюзивный доступ MCP к пониманию изображений, веб-поиску, чтению веб-страниц и Zread — возможностям, позволяющим модели искать и читать страницы, а не отвечать исключительно из параметров.
Материал VentureBeat приписывает GLM-5.2 весьма стабильное окно контекста в миллион токенов. Примечательно, что это не просто заголовочная цифра: та же публикация описывает архитектурную оптимизацию IndexShare, которая переиспользует один и тот же индексатор на каждые четыре слоя разрежённого внимания и тем самым снижает вычисления на токен примерно в 2,9 раза при максимальной длине контекста. Иначе говоря, длинный контекст сконструирован так, чтобы быть экономически пригодным, а не доступным лишь номинально.
Написание кода здесь не побочная способность: продукт позиционируется и как агент для кода, и как диалоговый ассистент. В интерфейсе рядом с селектором модели есть отдельная точка входа ZCode, а подписочный продукт прямо построен вокруг разработки. Согласно официальной документации, GLM Coding Plan применим к таким инструментам, как Claude Code, Cline и OpenCode, и поддерживает программирование на естественном языке — описание требований обычными словами для составления планов, написания кода и отладки — а также контекстно-зависимое автодополнение в реальном времени.
Интерфейс размещает прямо под полем ввода пять ярлыков задач: лендинги, научно-популярные объяснения и планы уроков, 3D-моделирование, небольшие игры и личные блоги. Это скорее ознакомительные подмостки, чем самостоятельные функции, но выбраны они удачно: каждый пункт представляет задачу, завершающуюся готовым результатом, а не простой вопрос-ответ, что подталкивает новичков к настоящей сильной стороне продукта.
Платформа описывает себя как созданную под пользователей китайского и английского языков, и отрисованный интерфейс это подтверждает: английские элементы управления соседствуют с китайскими приветствиями и ярлыками. Для тех, кто работает между этими языками, модель, у которой китайский и в обучении, и в продуктовом замысле выступает языком первого ряда, а не поздней добавкой, — значимое отличие.
Тем, кто хочет строить на моделях, а не беседовать с ними, документация выкладывает полный путь: стандартный RESTful HTTP API, совместимый со всеми языками программирования, официальные SDK для Python и Java, а также совместимость с OpenAI SDK для быстрой миграции с OpenAI. Конечная точка — api.z.ai/api/paas/v4/chat/completions, а совместимая с OpenAI форма означает, что существующей интеграции нередко хватает замены базового URL и ключа.
Наиболее обоснованный сценарий. Поверхность ZCode, интеграция со сторонними инструментами и результаты тестов, сосредоточенные на SWE-bench Pro и FrontierSWE, указывают сюда: продукт нацелен именно на это, и независимых свидетельств здесь больше всего.
Недооценённый рабочий процесс, свойственный только поставщикам с открытыми весами. Поскольку веса GLM загружаются по MIT, команды, обдумывающие self-hosting, могут через бесплатный интерфейс оценить поведение модели на собственных задачах, прежде чем вкладываться в инфраструктуру. Окно чата становится испытательным стендом с нулевой стоимостью.
Опубликованные тарифы ставят GLM-4.7 в 0,6 доллара за миллион входных токенов и 2,2 за выходные, а несколько моделей уровня Flash значатся бесплатными. Для больших объёмов низкой сложности — классификации, извлечения, рутинного реферирования — такая цена меняет то, что вообще экономически осуществимо.
Имея веб-поиск и чтение страниц как инструменты, ассистент способен опирать ответы на найденные страницы, а не только на параметрическую память. Полезно для вопросов о текущих событиях и просмотра литературы, с обычной оговоркой: поиск уменьшает выдумывание, но не устраняет его.
Ориентация на китайский и английский делает продукт практичным выбором для перевода, черновиков на нескольких языках и проверки локализации — задач, где модели, обученные преимущественно на английских данных, часто выдают технически верный, но интонационно чуждый китайский.
Черновики, переписывание, объяснения, генерация идей. Незрелищное большинство ассистентской работы, выполняемое компетентно и без оплаты.
Перейдите на chat.z.ai. Интерфейс показывает поле ввода, селектор модели и пять ярлыков задач. Начать с ярлыка — разумный первый ход: они демонстрируют направленность продукта на создание готовых вещей быстрее, чем открытый вопрос.
Пользуйтесь селектором, а не принимайте значение по умолчанию. На быстрый фактический вопрос легкая модель ответит скорее; для многошаговой задачи по коду выбирайте флагман. Привычка соотносить модель с задачей даёт наибольший прирост качества в единицу времени.
Продукт оптимизирован под продолжительную автономную работу. Вместо череды мелких вопросов опишите цель целиком, ограничения и то, как выглядит готовый результат. Так вы играете вместе с архитектурой, а не против неё.
Для всего, что чувствительно ко времени или проверяемо извне, используйте веб-поиск и чтение вместо обучающих данных модели. Параметрическое знание любой модели имеет предел по дате; поиск — способ его обойти.
В самом интерфейсе постоянно висит уведомление о том, что весь контент сгенерирован ИИ и предоставляется лишь для справки. Относитесь к этому как к действующему указанию, а не юридической формальности, особенно применительно к коду, числам и ссылкам.
Если окно чата стало у вас рабочим процессом, а не диковинкой, вас ждут две платные линии. API тарифицируется по токенам и предназначен для программной интеграции; GLM Coding Plan — подписка для работы внутри Claude Code, Cline и подобных инструментов. Перед выбором прочитайте механику квот в разделе об ограничениях.
Самый применимый и наименее разрекламированный совет. Документация указывает, что в непиковые часы использование моделей тарифицируется в 50 % стандартной ставки кредитов, а пиковыми считаются понедельник–пятница с 14:00 до 18:00 по стандартному времени Сингапура. Перенос пакетной работы за пределы этого четырёхчасового будничного окна буквально удваивает фактическую квоту. Ни один сторонний обзор продукта об этом не упоминает.
Подписочная квота выражена в кредитах: входные токены умножаются на входной множитель, кэшированный вход — на свой, выходные токены — на выходной, всё складывается и делится на 10 000. Вес выхода намного выше веса входа: у GLM-5.3 множители равны 6,9 для входа, 1,7 для кэша и 24 для выхода. Практический вывод: многословный вывод обходится куда дороже длинного ввода. Просьба отвечать сжато — это стратегия расходования квоты, а не только вопрос стиля.
И в прейскуранте API, и в множителях кредитов кэшированный вход стоит долю от свежего. Если вы раз за разом отправляете один и тот же системный промпт или документ, простое построение запросов так, чтобы неизменная часть попадала в кэшируемую позицию, ощутимо снижает расходы.
Несколько моделей в официальной таблице значатся с нулевой стоимостью. Для многочисленных простых задач направлять запросы на бесплатный уровень Flash, оставляя флагман по-настоящему трудным задачам, — простая экономика.
Доступность различается по линиям. VentureBeat сообщал, что GLM-5.3 сначала предлагался только через GLM Coding Plan и среду ZCode, а доступ к API и открытые веса появились позже. Прежде чем строить планы вокруг конкретной модели, проверьте, какая поверхность её открыла.
Если рассматривается самостоятельное развёртывание, используйте бесплатный интерфейс систематически — те же промпты, та же шкала, по всем уровням моделей — до загрузки весов. Это самая дешёвая из возможных проверок перед внедрением.
Условия прямо санкционируют использование пользовательского контента, не являющегося персональными данными, для разработки и улучшения технологий машинного обучения и ИИ компании. Для бесплатного потребительского ИИ это обычное дело — и одновременно причина держать проприетарный код и конфиденциальные документы вне бесплатного окна чата.
Разработчики и инженерные команды. Совпадение с большим отрывом. Ориентированные на код бенчмарки, интеграция со сторонними инструментами и агрессивные цены — всё выстроено вокруг этой аудитории.
Команды, оценивающие модели с открытыми весами. Всякий, чей путь закупки может завершиться самостоятельным развёртыванием, выигрывает от бесплатного интерфейса первой стороны к моделям, которые затем можно загрузить по MIT.
Создатели, чувствительные к затратам. Стартапы и частные лица, для которых цены API передовых моделей запретительны, и все, кому попросту нужен способный бесплатный ИИ-ассистент без подписки. Опубликованные ставки и бесплатные уровни существенно меняют арифметику.
Двуязычные пользователи китайского и английского. Модель, спроектированная с китайским как языком первого ряда, а не целью перевода.
Исследователи и аналитики. Поисковый инструментарий вместе с очень большим окном контекста подходит для аналитической работы с обилием документов.
Кому стоит поискать другое. Тем, кому нужна самая глубокая экосистема сторонних расширений, ChatGPT по-прежнему впереди. Организациям с политиками, ограничивающими обработку данных компаниями с китайской принадлежностью, следует сопоставлять сингапурскую структуру с собственными правилами комплаенса, а не считать, что регистрация в Сингапуре снимает вопрос. Тем, кому требуются задокументированные корпоративные гарантии — SLA, аудированные сертификаты соответствия, — нужно проверять их отдельно: рассмотренная здесь публичная документация их не охватывает.
Z.ai Chat — веб-приложение для браузера по адресу chat.z.ai. Смежные ресурсы разделены по функциям: z.ai содержит маркетинговый сайт, вход в подписку и технический блог; docs.z.ai несёт документацию для разработчиков; api.z.ai обслуживает трафик API; юридические соглашения расположены под chat.z.ai/legal-agreement/.
Доступ к API спроектирован ради переносимости. Документация предоставляет стандартный RESTful HTTP API, совместимый со всеми языками программирования, официальные SDK для Python и Java, а также совместимость с OpenAI SDK, прямо обозначенную как путь миграции; конечная точка — api.z.ai/api/paas/v4/chat/completions.
Охват заметно шире собственных поверхностей. VentureBeat сообщал, что GLM-5.2 сразу стал доступен на Hugging Face, через API Z.ai и более чем в двадцати сторонних средах для кодинга, то есть эти модели часто можно использовать в уже имеющихся у вас инструментах. Документация подписки называет среди поддерживаемых клиентов Claude Code, Cline и OpenCode, а страница подписки добавляет Kilo Code и другие.
Интерфейс двуязычный, платформа описывает себя как созданную под пользователей китайского и английского. В рассмотренных материалах не встретилось нативных мобильных приложений, поэтому никаких утверждений об их наличии здесь не делается.
Три линии с разной тарификацией. Смешивать их — самая частая ошибка сторонних описаний этого продукта.
Диалоговый интерфейс бесплатен. Собственные консольные сообщения Z.ai описывают продукт как бесплатную альтернативу ChatGPT на основе открытого кода. Рассмотренная публичная документация не публикует ни лимита сообщений, ни ограничения частоты для бесплатного уровня чата, поэтому конкретный предел здесь не указывается: отсутствие опубликованного ограничения не доказывает, что его нет.
API тарифицируется по токенам, из расчёта за миллион: GLM-5.3 и GLM-5.2 — 1,4 доллара за вход и 4,4 за выход; GLM-5 — 1 и 3,2; GLM-4.7 — 0,6 и 2,2; GLM-4.7-FlashX — 0,07 и 0,4. Кэшированный вход существенно дешевле — 0,26 доллара на флагманском уровне, — а его хранение обозначено как временно бесплатное. Примечательно, что GLM-4.7-Flash, GLM-4.5-Flash и GLM-4.6V-Flash значатся бесплатными и по входу, и по выходу. Мультимодальные возможности тарифицируются отдельно: веб-поиск 0,01 доллара за вызов, GLM-Image 0,015 за изображение, CogVideoX-3 0,2 за видео, GLM-ASR-2512 примерно 0,0024 за минуту.
GLM Coding Plan — подписка, начинающаяся, по официальной странице, от 18 долларов в месяц и покрывающая GLM-5.3, GLM-5.2 и GLM-5-Turbo внутри Claude Code, Kilo Code, Cline, OpenCode и других. Есть три уровня с двойными квотами: Lite — 2 000 пятичасовых кредитов и 10 000 недельных; Pro — 12 000 и 60 000; Max — 28 000 и 140 000. Пятичасовые кредиты динамически восполняются через пять часов после расходования, недельные обнуляются каждые семь дней с момента подписки. Упомянутая выше скидка в непиковые часы фактически удваивает ёмкость для работы, запланированной вне сингапурских будних вечеров.
Для оценки изменчивости цен: публикация VentureBeat от июня 2026 года называла корпоративные уровни подписки от 12,60 доллара в месяц, что ниже нынешних 18. Промо-цены явно меняются; проверяйте действующие ставки, а не полагайтесь на цифру из какой-либо статьи, включая эту.
ChatGPT остаётся эталоном широты: крупнейшая экосистема расширений и интеграций, наиболее отточенный мобильный опыт, самый глубокий сторонний инструментарий. Z.ai конкурирует ценой и открытыми весами, а не зрелостью экосистемы.
Claude — привычный объект сравнения для кода и длинных документов, и примечательно, что GLM Coding Plan спроектирован для работы внутри Claude Code: для разработчиков, желающих сохранить инструменты и сменить лишь модель под ними, эти продукты скорее дополняют друг друга, чем соперничают.
DeepSeek — структурно ближайший аналог: другая китайская лаборатория, выпускающая сильные модели с открытыми весами по агрессивным ценам. Выбор между ними обычно сводится к тому, чьи бенчмарки лучше отвечают вашей нагрузке, а не к категориальному различию.
Gemini предлагает глубокую интеграцию с Google Workspace и очень большой контекст. Материал VentureBeat поставил GLM-5.2 заметно выше Gemini 3.1 Pro в Terminal-Bench 2.1 — 81,0 против 74,0, — хотя такие преимущества невелики и меняются с каждым релизом.
Самостоятельное развёртывание GLM заслуживает упоминания как альтернатива, уникальная для этого поставщика. Поскольку веса выложены на Hugging Face под MIT, организация может запустить ту же модель на собственной инфраструктуре: без привязки к вендору, без выхода данных за периметр, ценой мощностей GPU и эксплуатационных усилий.
Честный итог: отличительные черты Z.ai Chat — открытые веса, агрессивные цены и агентные способности с уклоном в код. Слабые стороны против ChatGPT — глубина экосистемы и отделка мобильной версии. Для конкретной и растущей аудитории — разработчиков, которым важны стоимость и переносимость, — этот обмен выгоден.
Материалы поставщика и восторженные обзоры обычно рисуют полную победу. Независимая журналистика сложнее. Собственная таблица VentureBeat показывает, что GLM-5.2 решительно выигрывает по одним показателям — 62,1 в SWE-bench Pro против 58,6 у GPT-5.5, — но отстаёт по другим: в сырых баллах Terminal-Bench 2.1 он набрал 81,0 против 85,0 у Claude 4.8 и 84,0 у GPT-5.5, при этом существенно опережая по тому же показателю Gemini 3.1 Pro. Верное прочтение — «конкурентоспособен на переднем крае с особой силой в длительном кодинге», а не «побеждает всех». К тому же бенчмарки быстро устаревают.
У истории с открытыми весами есть важная сноска. VentureBeat сообщал, что GLM-5.3 изначально был доступен только через GLM Coding Plan и среду ZCode, а доступ к API и открытые веса появляются позже, по завершении оценки безопасности и усиления защиты, причём компания планировала опубликовать веса примерно через две недели после запуска. То есть новейшая модель какое-то время остаётся закрытым продуктом за подпиской. Если ваш план опирается на загружаемые веса, проверяйте доступность конкретной версии, а не считайте лицензирование семейства единообразным.
Перед оформлением стоит учесть два задокументированных правила. GLM Coding Plan строго ограничен официально поддерживаемыми инструментами и продуктами, и подписчикам сообщают, что они не вправе использовать преимущества подписки в неподдерживаемых инструментах или сценариях: это не универсальный кредитный баланс. А когда квота исчерпана, согласно официальному FAQ, приходится ждать следующего пятичасового цикла, и система не списывает средства с баланса счёта. С одной стороны, это дружелюбно к пользователю, поскольку исключает неожиданные списания; с другой — достижение потолка останавливает работу, а не переводит её на пониженный режим.
В каждом тарифе действуют одновременно пятичасовой и недельный лимиты. Вполне возможно, что недельная квота ещё есть, а пятичасовое окно уже блокирует работу, или наоборот. Всякому, кто планирует интенсивные рывки, следует учитывать оба ограничения.
Условия требуют явного разрешения на использование и хранение пользовательского контента, не являющегося персональными данными, для разработки и улучшения технологий машинного обучения и искусственного интеллекта компании. Политика конфиденциальности отдельно перечисляет обучение и улучшение моделей среди целей на основании законного интереса и указывает, что общедоступная информация из интернета может собираться для обучения моделей. Механизм отказа в рассмотренных материалах не задокументирован. Для бесплатного потребительского ИИ это не редкость, но должно влиять на то, что вы вставляете в окно.
Минимальный возраст регистрации не указан. Условия говорят лишь, что если вы несовершеннолетний по законам страны или штата проживания, вам следует ознакомиться с условиями вместе с законным представителем: это рекомендация, а не заслон. Единственное твёрдое правило, связанное с возрастом, запрещает пользователям обрабатывать или хранить персональные данные детей младше 13 лет способом, нарушающим COPPA, что регулирует действия пользователей, а не круг тех, кто может зарегистрироваться. Родителям, оценивающим этот инструмент, не стоит читать отсутствие заслона как гарантию пригодности.
С продуктом связаны три имени: бренд Z.ai, прежняя идентичность Zhipu AI и сингапурская договорная сторона JINGSHENG HENGXING TECHNOLOGY PTE.LTD, она же названный контролёр данных. Большинству частных пользователей это безразлично; организациям с требованиями к месту хранения данных или стране происхождения — нет, а сингапурская регистрация сама по себе не снимает вопросов о компании, которую VentureBeat называет китайским ИИ-стартапом. Оценивайте по своей реальной политике, а не по строке в подвале сайта.
Политика конфиденциальности разрешает раскрытие любому деловому партнёру, инвестору, правопреемнику или потенциальному правопреемнику для облегчения сделок с активами бизнеса, включая слияние, поглощение либо продажу долга или активов. В отрасли это стандарт, но знать полезно: хранитель ваших данных может смениться без вашего участия.
Постоянное уведомление внизу интерфейса гласит, что весь контент сгенерирован ИИ и предоставляется для справки. Продукт не заявляет о точности — и вам не стоит заявлять о ней вместо него.
Публичная документация обстоятельна в части тарифов API, множителей кредитов и механики квот — и сравнительно молчалива о собственных ограничениях бесплатного чат-продукта. Лимиты сообщений, ограничения частоты и сроки хранения переписок в рассмотренных материалах не обнаружены. Это пробел в сведениях, обозначенный здесь, а не заполненный догадками.
За одну исследовательскую сессию продукт показал GLM-5.2 в заголовке страницы, GLM-4.7 в селекторе модели и GLM-5.3 в ссылке на блог и документации. Упоминания версий в любом вторичном источнике, включая эту страницу, устаревают стремительно. Смотрите в самом интерфейсе, что предлагается сейчас.
Диалоговым интерфейсом можно пользоваться бесплатно, и консольные сообщения платформы описывают его как бесплатную альтернативу ChatGPT на основе открытого кода. Важны две оговорки. Во-первых, «бесплатно» относится к чат-продукту; API тарифицируется по токенам, а GLM Coding Plan — платная подписка от 18 долларов в месяц. Во-вторых, рассмотренная публичная документация не публикует лимитов сообщений и ограничений частоты для бесплатного уровня, поэтому конкретных цифр привести нельзя: это пробел в доступных сведениях, а не гарантия безлимитного использования.
Да, это продукт первой стороны. VentureBeat в независимом материале называет компанию китайским ИИ-стартапом Z.ai, ранее Zhipu AI, — той самой организацией, которая разрабатывает модели GLM. Договорной стороной и контролёром данных в условиях и политике конфиденциальности названа сингапурская компания JINGSHENG HENGXING TECHNOLOGY PTE.LTD. Итого: Z.ai — бренд, Zhipu AI — прежнее имя, сингапурское юрлицо — юридический контрагент.
Документация сейчас определяет GLM-5.3 как флагман для программной инженерии и агентной работы, GLM-5V-Turbo — для визуального программирования, GLM-Image — для генерации изображений по тексту, CogVideoX-3 — для видео. В интерфейсе есть селектор модели, а прейскурант API охватывает более широкий набор, включая GLM-5.2, GLM-5, GLM-4.7 и бесплатные уровни Flash. Доступность различается по линиям: GLM-5.3 появился в Coding Plan и ZCode раньше, чем в API и в виде открытых весов.
По большей части, с оговоркой о сроках. VentureBeat подтвердил, что ключевые веса GLM-5.2 опубликованы под неограничительной лицензией MIT и доступны на Hugging Face для самостоятельного развёртывания и донастройки. Однако то же издание сообщило, что GLM-5.3 сначала вышел как продукт только по подписке, а веса планировались примерно через две недели после запуска, по итогам оценки безопасности. Проверяйте лицензирование конкретной нужной версии.
За миллион токенов: GLM-5.3 и GLM-5.2 — 1,4 доллара за вход и 4,4 за выход; GLM-5 — 1 и 3,2; GLM-4.7 — 0,6 и 2,2; GLM-4.7-FlashX — 0,07 и 0,4. Кэшированный вход существенно дешевле. GLM-4.7-Flash, GLM-4.5-Flash и GLM-4.6V-Flash значатся бесплатными. Инструменты и медиа тарифицируются отдельно: веб-поиск 0,01 доллара за вызов, GLM-Image 0,015 за изображение, CogVideoX-3 0,2 за видео.
В каждом уровне действуют два одновременных лимита. Lite даёт 2 000 пятичасовых кредитов и 10 000 недельных; Pro — 12 000 и 60 000; Max — 28 000 и 140 000. Пятичасовые кредиты восполняются через пять часов после расходования, недельные обнуляются каждые семь дней. Кредиты вычисляются из входных, кэшированных и выходных токенов, умноженных на множители конкретной модели и делённых на 10 000, причём вес выхода наибольший. Принципиально, что в непиковые часы тариф составляет 50 % стандартного, а пик — понедельник–пятница с 14:00 до 18:00 по сингапурскому времени.
Приходится ждать. Официальный FAQ указывает, что система не спишет средства с баланса счёта и что по исчерпании квоты нужно дождаться следующего пятичасового цикла. Это предотвращает неожиданные расходы, но и означает, что работа останавливается, а не продолжается на пониженном уровне. Учтите также, что тариф строго ограничен официально поддерживаемыми инструментами.
По сути да. Условия требуют разрешить использование и хранение пользовательского контента, не являющегося персональными данными, для разработки и улучшения технологий машинного обучения и ИИ компании, а политика конфиденциальности перечисляет обучение и улучшение моделей среди своих целей. Механизм отказа в рассмотренной документации отсутствует. Держите конфиденциальные материалы вне бесплатного чат-продукта.
Явный минимальный возраст не указан. Условия говорят лишь, что несовершеннолетним по законам их страны или штата следует изучить условия вместе с законным представителем, и это рекомендация, а не ограничение. Единственное твёрдое правило запрещает обрабатывать или хранить персональные данные детей младше 13 лет в нарушение COPPA — ограничение поведения пользователей, а не заслон при регистрации.
Да, и это сознательная цель разработки. GLM Coding Plan поддерживает в числе прочего Claude Code, Kilo Code, Cline и OpenCode, а VentureBeat сообщал, что на момент выпуска GLM-5.2 был доступен более чем в двадцати сторонних средах для кодинга. Для прямой интеграции API совместим с OpenAI SDK, поэтому перенос существующей интеграции с OpenAI чаще всего сводится к смене базового URL и ключа.