Почему я вообще полез в z.ai
Я искал нормальную замену Claude и GPT для ежедневного кодинга.
Не “поболтать с чатиком вечером”, а именно работать:
* гонять Claude Code;
* подключать OpenCode;
* рефакторить Laravel-проекты;
* разбирать чужой код;
* писать тесты;
* чинить баги;
* давать агенту большие задачи и не сидеть рядом с огнетушителем.
На бумаге z.ai выглядел нормально: GLM-модели, тарифы для кодинга, API, поддержка агентов. Думаю: ну всё, сейчас найду дешёвый аналог Claude, подключу и буду жить как белый человек.
Ага. Сейчас.
Лимиты закончились быстрее, чем энтузиазм
Главная боль — лимиты.
Я заплатил около $70 и рассчитывал, что смогу нормально работать хотя бы месяц. Не безлимит, понятно. Но хотя бы без ощущения, что каждый запрос надо согласовывать с внутренним бухгалтером.
В итоге активная работа через coding-агентов съела лимиты примерно за 4 дня.
В кабинете красиво написано:
Weekly Quota — 100% Used
И всё. Приехали.
Сиди теперь, смотри на reset time и размышляй о смысле жизни, капитализме и почему опять нельзя просто нормально кодить.
Особенно весело, что Usage Details показывают огромные числа по токенам. У меня за период набежало больше 259 миллионов токенов. Звучит солидно, но итог простой: лимит закончился, работа встала.
Пиковые часы по Москве — как раз когда хочется работать
Отдельный прикол — время расхода квоты.
В подсказке z.ai написано, что GLM-5.1 и GLM-5-Turbo расходуют квоту быстрее:
* в пиковые часы — **3×**;
* вне пиковых часов — **2×**;
* временно вне пика считают как **1×**, но только до конца июня.
Пиковые часы указаны как 14:00–18:00 UTC+8.
По Москве это примерно 09:00–13:00 МСК.
То есть ровно то самое время, когда ты сел с кофе, открыл проект, сказал себе “сейчас нормально поработаю” — и модель начинает жрать лимит с коэффициентом 3×.
Очень удобно. Особенно если ты не ночной енот и не хочешь кодить строго после обеда, когда мозг уже просит борща и тишины.
А потом квоты станут ещё хуже
Самое смешное — текущие условия ещё не финальная боль.
Сейчас у них есть временная поблажка: off-peak usage временно считается как 1× до конца июня.
Но в той же подсказке написано, что обычная логика такая:
* пик — **3×**;
* вне пика — **2×**.
То есть после окончания акции даже “нормальное” время может начать стоить в два раза дороже по квоте.
Получается, сейчас сервис уже съедает лимиты слишком быстро. А потом, если они реально уберут временный бонус, будет ещё веселее.
Не “мы улучшим условия”, а “держитесь, скоро гайки докрутим”.
Спасибо, очень мотивирует продлевать подписку.
Качество моделей тоже не спасает
Если бы модели были уровня Claude или GPT, можно было бы хотя бы сказать:
Да, лимиты жёсткие, зато мозги хорошие.
Но нет.
GLM-модели нормальные. Не мусор. Иногда помогают. Но как основной мозг для разработки — слабовато.
Особенно это заметно на задачах, где нужно:
* держать контекст проекта;
* аккуратно менять архитектуру;
* не ломать старую логику;
* понимать Laravel-код не как набор файлов, а как систему;
* не писать уверенную ерунду с лицом senior architect из LinkedIn.
Claude и GPT в таких задачах ощущаются сильнее. Они лучше держат цель, лучше понимают контекст и реже делают “ну почти правильно, только теперь всё горит”.
С GLM результат приходится чаще перепроверять. А если я плачу за AI-кодинг, я хочу ускоряться, а не нанимать себе ещё одного джуна, только без кофе и с лимитами.
Что получилось по факту
Мой сценарий был простой:
* Подключить z.ai к coding-инструментам.
* Использовать как альтернативу Claude/GPT.
* Снизить расходы.
* Получить больше рабочего времени.
Получилось иначе:
* Подключил.
* Покодил несколько дней.
* Лимиты закончились.
* Качество не впечатлило.
* $70 сказали: “До свидания, мы ушли в облако”.
Самое обидное — сервис не полностью бесполезный. Он работает. Просто ожидание было другое.
Я хотел инструмент для активной разработки. А получил сервис, который больше похож на запасной вариант.
Где z.ai ещё можно использовать
Полностью выкидывать z.ai из схемы я бы не стал.
Он может пригодиться:
* для мелких задач;
* для черновиков;
* для простых объяснений;
* для несложного кода;
* как fallback-модель;
* когда Claude/GPT заняты, дорогие или закончились;
* для экспериментов с OpenCode, Roo Code, Cline и похожими штуками.
Но делать z.ai основным провайдером для ежедневного AI-кодинга я бы не стал.
Нормальная схема скорее такая:
brain: Claude / GPT
code: Claude / GPT
cheap: GLM
fallback: GLM
experiments: z.ai
То есть z.ai — не главный двигатель, а запаска в багажнике. Ехать на ней можно, но в отпуск на юг я бы не рискнул.
Итог
Мой вывод простой: z.ai не стал заменой Claude и GPT для активной разработки.
На бумаге всё выглядит вкусно:
* модели GLM;
* API;
* поддержка coding-агентов;
* тарифы для разработки;
* красивый кабинет.
На практике:
* лимиты сгорают быстро;
* недельная квота может улететь за несколько дней;
* пиковые часы по Москве попадают примерно на **09:00–13:00**;
* топовые модели едят квоту с коэффициентом до **3×**;
* временная поблажка вне пика действует только до конца июня;
* потом расход вне пика может стать **2×**;
* качество хуже Anthropic и GPT;
* за $70 ожидал сильно больше.
Для лёгкого использования z.ai можно рассматривать. Для плотного кодинга через Claude Code или OpenCode — я бы не советовал делать на него ставку.
Мой эксперимент закончился просто: деньги потрачены, лимиты съедены, иллюзии сняты.
z.ai — не катастрофа, но и не спасение. Скорее сервис из категории “пусть будет в запасе, но основную работу я ему больше не доверю”.