GLM в Claude Code: как кодить почти бесплатно на китайской модели (2026)
GLM Coding Plan от z.ai подключается к Claude Code за пять минут и стоит от 18 долларов в месяц вместо 20 за один Claude Pro. Разбираю, что за модель GLM-5.2, как прописать две env-переменные и заставить Claude Code ходить на китайский эндпоинт, как оплатить из России, и где GLM реально тянет наравне с Claude, а где сыпется. С честной таблицей цен и лимитов.
Один Claude Pro стоит 20 долларов в месяц и требует зарубежную карту. А есть способ получить почти тот же Claude Code, только под капотом будет крутиться китайская модель GLM-5.2, и обойдётся это от 18 долларов в месяц с лимитами, которых на рабочий день хватает с запасом. Подключается за пять минут через две переменные окружения: разворачиваешь Claude Code на эндпоинт z.ai, и агент работает как обычно, просто отвечает другая модель.
Разберём по шагам: что за GLM и почему про неё столько шума, как прописать конфиг и заставить Claude Code ходить на китайский сервер, как честно оплатить из России, и главное, где GLM реально тянет наравне с Claude, а где начинает сыпаться. С таблицей цен по GLM, Qwen, DeepSeek и Claude и без единой выдуманной цифры. Если ты только присматриваешься к самому Claude Code и не понимаешь, зачем он нужен, сначала загляни в гайд Claude Code для не программистов, а тут мы уже подключаем к нему дешёвую модель.
GLM-5.2 от китайской z.ai (Zhipu AI) подключается к Claude Code через две переменные: `ANTHROPIC_BASE_URL` на `https://api.z.ai/api/anthropic` и `ANTHROPIC_AUTH_TOKEN` со своим ключом. Тариф GLM Coding Plan Lite стоит 18 долларов в месяц (около 12,6 при годовой оплате), лимит примерно 80 запросов за 5 часов. На рутине и багфиксах GLM почти вровень с Claude, на сложной архитектуре и длинных цепочках инструментов заметно слабее. Из России платить нужно зарубежной картой или через сервис оплаты подписок.
вход в GLM Coding Plan Lite против 20 долларов за один Claude Pro
SWE-bench Pro у GLM-5.2 против 63% у Claude Sonnet 5, разница в процент
контекст GLM-5.2, можно закинуть весь проект целиком
параметров в MoE-модели, но на запрос активируется лишь часть
Коротко: что нужно знать перед стартом
- GLM-5.2 - флагманская модель китайской компании z.ai (бренд Zhipu AI), вышла в июне 2026, заточена под код и агентные задачи, держит контекст до 1 млн токенов.
- GLM Coding Plan - подписка z.ai, которая даёт доступ к GLM внутри сторонних инструментов: Claude Code, Cline, Roo Code и ещё двух десятков.
- ANTHROPIC_BASE_URL - переменная окружения, которая говорит Claude Code, на какой сервер слать запросы. Меняешь её на адрес z.ai, и Claude Code начинает общаться с GLM, думая, что это Anthropic.
- Лимит запросов - сколько промптов в окно времени разрешает тариф. На Lite это примерно 80 запросов за 5 часов.
- Эндпоинт - конкретный адрес API, куда уходят запросы. У z.ai для Claude Code это
https://api.z.ai/api/anthropic.
Что за модель GLM и почему о ней столько говорят
GLM это семейство моделей от Zhipu AI, одной из крупнейших ИИ-компаний Китая (публичный бренд z.ai). Актуальная версия на середину 2026 - GLM-5.2, она вышла 16 июня 2026 и стала флагманом линейки под код. До неё были GLM-5 в феврале, GLM-5.1 в апреле, а совсем старая GLM-4.6 из сентября 2025 уже музейный экспонат, хотя в старых гайдах её ещё поминают.
Шум вокруг GLM держится на одной простой вещи: цена к качеству. По независимым замерам на SWE-bench Pro (это набор реальных задач из репозиториев GitHub, где модель чинит настоящие баги) GLM-5.2 берёт около 62,1%, а Claude Sonnet 5 - около 63,2%. Разница в один процент, а разница в цене может быть кратной. За эти деньги ты получаешь модель, которая по бенчмаркам идёт почти вровень с топами, при этом веса у неё открытые, а подписка стоит как один кофе в неделю.
Технически GLM-5.2 это Mixture-of-Experts на 745 млрд параметров: модель огромная, но на каждый запрос активируется только часть, поэтому она быстрая и относительно дешёвая в обслуживании. Для тебя как пользователя важны две вещи: контекст до 1 млн токенов (можно закинуть весь проект целиком) и заточенность под агентные сценарии, то есть под работу внутри Claude Code, где модель сама читает файлы, правит их и запускает команды.
Важно не путать модель и подписку. GLM-5.2 - это сама модель. GLM Coding Plan - это тариф z.ai, который открывает доступ к модели внутри инструментов. Есть ещё оплата напрямую по API за токены, но для Claude Code почти всегда берут именно подписку: там фиксированная цена и понятный лимит вместо счётчика, который тикает с каждым запросом.
Сколько это стоит на самом деле
Тут придётся быть честным, потому что интернет забит старыми цифрами. Легендарный старт GLM Coding Plan за 3 доллара в месяц действительно был, но в феврале 2026 z.ai сбросила цены и подняла базовые тарифы. Если видишь где-то обещание «GLM за 3 доллара», это устаревшая инфа: промо убрали.
Актуальная сетка GLM Coding Plan на середину 2026:
| Тариф | Цена в месяц | Годовая оплата (≈30% скидка) | Лимит запросов |
|---|---|---|---|
| Lite | 18 $ | ≈ 12,6 $/мес (151 $/год) | ≈ 80 за 5 часов, ≈ 400 в неделю |
| Pro | 72 $ | ≈ 50,4 $/мес (605 $/год) | ≈ 400 за 5 часов, ≈ 2000 в неделю |
| Max | 160 $ | ≈ 112 $/мес (1344 $/год) | ≈ 1600 за 5 часов, ≈ 8000 в неделю |
Цены проверены по нескольким источникам-агрегаторам в июле 2026. Актуальную сетку всегда сверяй прямо на сайте z.ai, тарифы там пересматривают.
Что это значит по-человечески. Тариф Lite за 18 долларов - это порог входа, и для одного разработчика на обычных задачах его чаще всего хватает. 80 запросов за пять часов звучит немного, но один «запрос» в Claude Code - это целая реплика агента, внутри которой он может прочитать десяток файлов, внести правки и прогнать тесты. За рабочий день на Lite реально закрыть кучу мелких и средних задач.
Сравни с прямой ценой: Claude Pro стоит 20 долларов в месяц, и это только чат. Claude Code с оплатой по API считает каждый токен, и на активной работе счёт легко перевалит за те же 20 долларов за пару дней. GLM Lite за 18 в месяц с фиксированным лимитом на этом фоне выглядит спокойнее для кошелька, особенно если ты только учишься и жжёшь токены на экспериментах. Подробнее про то, как вообще устроена оплата самого Claude Code, я разбирал в гайде подписка Claude Code, тут же речь про альтернативный движок под ним.
Лимит на GLM-5.2 расходуется быстрее, чем на младших моделях. В пиковые часы (14:00-18:00 по пекинскому времени, UTC+8) GLM-5.2 и GLM-5-Turbo съедают квоту в 2-3 раза быстрее обычной. То есть заявленные 80 запросов за 5 часов на Lite - это для рутинных моделей, а на топовой GLM-5.2 в пик реальное число будет меньше. Планируй тяжёлые задачи на непиковое время или бери тариф повыше.
Как подключить GLM к Claude Code по шагам
Весь фокус в том, что Claude Code умеет ходить не только на серверы Anthropic. Он читает две переменные окружения и, если их подменить, начинает слать запросы куда скажешь. z.ai специально держит Anthropic-совместимый эндпоинт, поэтому Claude Code даже не замечает подмены.
Шаг 1. Поставить Claude Code, если ещё не стоит.
Одной командой в терминале:
npm install -g @anthropic-ai/claude-code
Если Claude Code уже установлен, шаг пропускаешь. Как поставить его с нуля именно из России, по шагам расписано в гайде Claude Code с нуля из России.
Шаг 2. Получить ключ на z.ai.
Зарегистрируйся на z.ai, оплати GLM Coding Plan (про оплату из России - следующий раздел) и в личном кабинете создай API-ключ. Скопируй его, он понадобится в конфиге. Ключ выглядит как длинная строка, храни его как пароль.
Шаг 3. Прописать две переменные окружения.
Самый быстрый способ - положить их в конфиг Claude Code. Открой файл ~/.claude/settings.json (если его нет, создай) и впиши блок env:
{
"env": {
"ANTHROPIC_BASE_URL": "https://api.z.ai/api/anthropic",
"ANTHROPIC_AUTH_TOKEN": "твой-ключ-с-z.ai",
"ANTHROPIC_DEFAULT_SONNET_MODEL": "glm-5.2",
"ANTHROPIC_DEFAULT_OPUS_MODEL": "glm-5.2",
"API_TIMEOUT_MS": "3000000"
}
}
Разберём, что тут что. ANTHROPIC_BASE_URL - это тот самый адрес китайского эндпоинта, куда теперь уходят все запросы. ANTHROPIC_AUTH_TOKEN - твой ключ z.ai вместо ключа Anthropic. Две строки с MODEL подменяют внутренние имена моделей Claude Code (там, где он ждёт Sonnet или Opus, будет подставляться GLM-5.2). API_TIMEOUT_MS задаёт большой таймаут, чтобы длинные ответы модели не обрывались.
Шаг 4. Перезапустить терминал.
Это тот шаг, который забывают все. Переменные окружения подхватываются только при старте. Закрой все окна Claude Code и открой новый терминал, иначе изменения не применятся, и ты будешь гадать, почему всё по-старому.
Шаг 5. Проверить, что работает.
Запусти claude в папке проекта и дай простую задачу, например «покажи структуру этого проекта». Если ответ пришёл и в счётчике на z.ai появился расход - готово, Claude Code теперь работает на GLM.
Не хочешь мешать GLM с основным Claude? Держи два конфига. Оставь обычный `~/.claude/settings.json` под настоящий Claude, а под GLM сделай отдельную папку проекта со своим локальным `.claude/settings.json` или запускай Claude Code с этими переменными через отдельный шелл-скрипт, который экспортирует `ANTHROPIC_BASE_URL` только в этой сессии. Так на серьёзных задачах у тебя Claude, а на рутине - дешёвый GLM, и они не путаются.
Отдельная тонкость про контекст. Если хочешь задействовать полное окно на 1 млн токенов, у z.ai для этого есть отдельный идентификатор модели glm-5.2[1m] с суффиксом в квадратных скобках. Обычный glm-5.2 работает на стандартном контексте, суффикс [1m] разблокирует максимум. На старте оставь обычный, миллион токенов нужен редко и жрёт квоту.
Подключить GLM - это полдела, дальше надо уметь давать Claude Code внятные задачи, иначе экономия на модели уйдёт в переделки. Пройди мини-курс «Claude за вечер»: от установки до первых результатов на твоих задачах, чтобы любой движок под капотом приносил тебе готовый результат.
Пройти мини-курс →Как оплатить GLM Coding Plan из России честно
Разберём прямо, без «просто оплатите». На сайте z.ai оплата идёт зарубежной картой, российские карты напрямую не проходят из-за санкционных ограничений платёжных систем. Это факт, и обходится он несколькими законными путями.
Вариант первый: попросить друга за границей. Если у кого-то из знакомых есть зарубежная карта, он оплачивает подписку, ты возвращаешь деньги. Самый дешёвый путь, ноль комиссии, но нужен человек с картой и доверие.
Вариант второй: выпустить виртуальную зарубежную карту. Есть сервисы, которые выпускают виртуальные карты иностранных банков на твоё имя. Заводишь такую, кладёшь на неё денег и платишь z.ai напрямую. Как это устроено и какие сервисы рабочие, я разбирал в гайде виртуальная карта для нейросетей. Плюс: платишь сам и контролируешь карту. Минус: выпуск и пополнение тоже стоят денег и требуют возни.
Вариант третий: сервис оплаты подписок. Если возиться с картой не хочется, за тебя платёж проведёт сервис оплаты подписок (реферальная ссылка: тебе тот же прайс, мне небольшой процент). Ты отдаёшь рубли, они оплачивают подписку z.ai на твой аккаунт зарубежной картой. Удобно, когда нужно быстро и без танцев с виртуалками, но заложи их комиссию сверху цены тарифа.
Отдельно про VPN, чтобы не было путаницы. Для самого доступа к API z.ai из России VPN не нужен: эндпоинт `api.z.ai` открывается и так, Claude Code спокойно ходит на него без обхода блокировок. VPN может понадобиться только чтобы зайти на сайт z.ai для регистрации, если он не открывается, и тогда бери рабочий VPN. Но платить с включённым VPN зарубежной картой иногда наоборот мешает: банк видит несовпадение страны карты и IP и режет платёж. Тут действуй по ситуации.
Честное сравнение качества: где GLM тянет, а где нет
Теперь самое важное, ради чего вся статья. GLM-5.2 - хорошая модель, но она не Claude, и продавать её как полную замену было бы враньём. Разберём по задачам, где она реально выручает, а где начинает подводить.
Где GLM тянет наравне
- рутинный код и багфиксы
- генерация по шаблону: CRUD, типовой компонент, тесты по образцу
- работа с большим контекстом до 1 млн токенов
Где заметно слабее Claude
- сложная архитектура на несколько слоёв вперёд
- длинные цепочки вызова инструментов
- качество интерфейса и мелкая доводка
Где GLM тянет наравне или почти наравне:
Рутинный код и багфиксы. Починить валидацию, переписать функцию, добавить обработку ошибки, подправить SQL-запрос - на таких задачах GLM-5.2 отрабатывает ровно, и разницы с Claude ты чаще всего не заметишь. По SWE-bench Pro отставание всего в процент, а это как раз тесты на реальные баги.
Генерация по шаблону. Собрать CRUD-эндпоинт, накидать типовой компонент, написать тесты по образцу существующих - GLM справляется. Тут работает натренированность на огромном корпусе кода, и модель просто выдаёт то, что видела тысячу раз.
Работа с большим контекстом. Миллион токенов - это реальное преимущество. Можно закинуть весь проект и просить модель ориентироваться в нём целиком, не нарезая на куски.
Где GLM заметно слабее Claude:
Сложная архитектура. Когда задача требует продумать структуру на несколько слоёв вперёд, выбрать паттерн, увязать несколько модулей - Claude рассуждает глубже и реже загоняет себя в тупик. GLM склонна хвататься за первое решение.
Длинные цепочки вызова инструментов. В агентных сценариях, где надо последовательно вызвать пять-шесть инструментов и не потерять нить, Claude держит контекст цепочки надёжнее. У GLM выше процент ошибок и галлюцинаций на длинных агентных прогонах, там где Claude Sonnet выдаёт около 96% точности на мультиинструментальных цепочках, GLM ошибается ощутимо чаще.
Качество интерфейса и мелкая доводка. По независимым замерам Claude Sonnet 5 стабильно впереди GLM-5.2 по качеству UI (6,8 против 6,3) и обработке ошибок (4,1 против 3,7 по десятибалльной шкале). То есть на «последней миле», где важно чтобы всё держалось красиво и надёжно, Claude собирает результат лучше.
Правило выбора: рутину, багфиксы и типовой код отдавай GLM и экономь. Сложную архитектуру, длинные агентные задачи и финальную доводку продукта делай на Claude. Держи оба движка под рукой и переключай под задачу, вместо того чтобы молиться на одну модель.
Практический вывод простой. GLM отлично заходит новичку, который учится и жжёт токены на экспериментах, и разработчику на потоке однотипных задач. Но если ты строишь что-то сложное с нуля и цена ошибки высокая, экономия на модели может обернуться часами разгребания того, что GLM напортачила на архитектуре. Тут дешевле заплатить за Claude.
GLM против Qwen, DeepSeek и Claude: таблица
Раз уж речь про дешёвые альтернативы, сравним четыре популярных варианта для Claude Code и подобных инструментов. Все цифры - на середину 2026, проверены по агрегаторам цен.
| Модель / сервис | Цена входа | Формат оплаты | Качество кода | Где сильна |
|---|---|---|---|---|
| GLM-5.2 (z.ai) | от 18 $/мес | подписка Coding Plan, фикс-лимит | ≈62% SWE-bench Pro | агентные задачи, контекст 1M, цена |
| Qwen (Alibaba) | от 10 $/мес | подписка Coder Plan, фикс-лимит | сильная, чуть ниже GLM | дешевизна входа, открытые веса |
| DeepSeek | от 0,14 $/1M токенов | только API, оплата по токенам | добротная на рутине | самая низкая цена за токен |
| Claude (Anthropic) | 20 $/мес (Pro) | подписка или API | ≈63% SWE-bench Pro, топ | сложная архитектура, надёжность |
Как читать таблицу. GLM и Qwen устроены одинаково: продают coding-подписку с фиксированным лимитом запросов, платишь ровно раз в месяц и не считаешь токены. Qwen дешевле на входе (от 10 против 18), но GLM-5.2 сейчас сильнее в агентных сценариях и держит контекст в 1 млн токенов, поэтому под Claude Code чаще берут именно GLM. Про Qwen подробнее в гайде Qwen Code как альтернатива Claude Code.
DeepSeek выбивается из ряда: отдельной подписки под код у него нет, только оплата API по токенам от 0,14 доллара за миллион. Это самый дешёвый вариант за единицу работы, но платёж тикает с каждым запросом, и предсказать месячный счёт сложнее. Плюс DeepSeek заметно слабее в длинных агентных прогонах. Разбор, как он ведёт себя именно в связке с Claude Code, лежит в гайде DeepSeek против Claude Code.
Claude здесь эталон качества и заодно точка отсчёта по цене. Он дороже всех по совокупности, зато на сложных задачах не подводит. Смысл всей этой затеи с GLM в том, чтобы рутину делать на дешёвой модели, а на Claude оставить только то, где реально нужна его голова. Если хочешь так же аккуратно подключить другую китайскую модель, тот же принцип с подменой эндпоинта разобран в гайде Cline против Claude Code.
Лимиты и подводные камни, о которых молчат
Чтобы не разочароваться после оплаты, держи в голове несколько неочевидных вещей.
Лимит считается в запросах, а токены тут ни при чём. GLM Coding Plan меряет промпты. Условные 80 запросов за 5 часов на Lite - это 80 реплик агента, независимо от того, сколько кода в каждой. Для рутины отлично, но если гоняешь длинные автономные задачи, лимит вычерпывается быстрее, чем ждёшь.
Топовая модель ест квоту быстрее. Как уже говорил, GLM-5.2 в пиковые часы расходует лимит в 2-3 раза быстрее младших моделей. Если упираешься в потолок, часть задач можно отдавать более лёгкой GLM-5-Turbo, поменяв имя модели в конфиге, она экономнее по квоте.
Веб-поиск лимитирован отдельно. На Lite доступно около 100 вызовов веб-поиска и чтения ссылок через MCP в месяц. Если твой воркфлоу завязан на то, чтобы модель лазила в интернет, этот лимит закончится раньше основного.
Эндпоинты нельзя путать. У z.ai два разных адреса: Anthropic-совместимый https://api.z.ai/api/anthropic для Claude Code и OpenAI-совместимый /api/paas/v4/chat/completions для прямых интеграций. Если подставишь второй в Claude Code, ничего не заработает. Для нашей задачи нужен только первый.
Данные уходят в Китай. Очевидное, но проговорю: запросы идут на серверы z.ai. Не отправляй через GLM то, что не должно покидать твой контур: секреты, коммерческие тайны, персональные данные клиентов. Для учебных и пет-проектов это не проблема, для чувствительного продакшена подумай дважды.
Не клади API-ключ z.ai в файлы, которые уходят в git. `settings.json` с ключом легко случайно закоммитить в публичный репозиторий, и тогда ключом воспользуется кто угодно, а деньги спишутся с тебя. Держи ключ в глобальном `~/.claude/settings.json` вне проекта или в `.env`, добавленном в `.gitignore`. Утёкший ключ дороже любой сэкономленной минуты.
Чек-лист: что у тебя теперь есть
Пройди по списку. Если всё сделал по гайду, пункты закрыты.
- Понимаешь разницу между моделью GLM-5.2 и подпиской GLM Coding Plan.
- Знаешь реальную цену: Lite от 18 долларов в месяц, тогда как мифические 3 доллара убрали ещё в феврале 2026.
- Прописал в
~/.claude/settings.jsonдве ключевые переменные:ANTHROPIC_BASE_URLна эндпоинт z.ai иANTHROPIC_AUTH_TOKENсо своим ключом. - Указал модель
glm-5.2и перезапустил терминал, чтобы переменные подхватились. - Проверил, что Claude Code реально ходит на GLM (ответ пришёл, расход на z.ai появился).
- Выбрал способ оплаты из России: друг с картой, виртуальная карта или сервис оплаты подписок.
- Держишь в голове границу: рутина и багфиксы на GLM, сложная архитектура и доводка на Claude.
- Помнишь про лимиты: считаются запросы, топовая модель ест квоту быстрее, веб-поиск идёт отдельным счётчиком.
- Не отправляешь через GLM чувствительные данные и не коммитишь ключ в git.
Дальше логика простая. GLM в Claude Code - это способ учиться и делать рутину почти бесплатно, не сжигая деньги на топовой модели там, где хватит средней. Держи два движка под рукой: дешёвый GLM на поток и Claude на задачи, где цена ошибки высокая. А чтобы любой из них выдавал готовый результат, нужен навык внятно ставить задачу агенту, и это уже отдельная история, которую быстрее всего пройти на практике.
Рассылка
Подпишись на еженедельную рассылку
Полезные материалы и скиллы, которые усилят твою работу с нейросетями и помогут больше зарабатывать. Раз в неделю, без воды и спама.
человек уже подписались
Готово! Ты в списке.
Первое письмо придёт в ближайшую рассылку. Отписка в один клик.
Частые вопросы
Что такое GLM Coding Plan и сколько он стоит?
Это подписка от китайской компании z.ai (Zhipu AI), которая даёт доступ к модели GLM-5.2 внутри инструментов вроде Claude Code, Cline и Roo Code. Тариф Lite стоит 18 долларов в месяц, при годовой оплате около 12,6 доллара. Раньше был промо-старт за 3 доллара, но его убрали при сбросе цен в феврале 2026.
Как подключить GLM к Claude Code?
Прописать две переменные окружения: ANTHROPIC_BASE_URL со значением https://api.z.ai/api/anthropic и ANTHROPIC_AUTH_TOKEN со своим ключом z.ai. Дальше указать модель glm-5.2 в конфиге ~/.claude/settings.json. Claude Code думает, что говорит с Anthropic, а на деле запросы уходят на китайский эндпоинт. Перезапустить терминал, чтобы переменные подхватились.
GLM реально не хуже Claude в коде?
На рутине почти вровень: по SWE-bench Pro GLM-5.2 берёт около 62% против 63% у Claude Sonnet 5. На простом коде, багфиксах и генерации по шаблону разницу не почувствуешь. На сложной архитектуре, длинных цепочках вызова инструментов и качестве интерфейса Claude уверенно впереди, там GLM ошибается чаще.
Можно ли оплатить GLM Coding Plan из России?
На сайте z.ai нужна зарубежная карта, российские напрямую не проходят. Варианты: попросить оплату у друга за границей, выпустить виртуальную зарубежную карту или воспользоваться сервисом оплаты подписок, который проведёт платёж за тебя за небольшой процент. VPN для самого доступа к API не нужен, эндпоинт z.ai из России открывается.
Чем GLM отличается от Qwen и DeepSeek для кода?
GLM и Qwen продают именно coding-подписку с фиксированным лимитом запросов: GLM Lite от 18 долларов, Qwen от 10. У DeepSeek подписки под код нет, только оплата API по токенам от 0,14 доллара за миллион. GLM-5.2 сейчас сильнее в агентных задачах и держит контекст до 1 млн токенов, поэтому под Claude Code берут чаще именно его.