Каждый день в Telegram-канале - что нового в вайб-кодинге: инструменты, примеры, ошибки. Подпишись, чтобы быть в курсе.
Что такое GLM-5.2 и почему о ней говорят все?
Две недели назад в кодинг-сообществе случилась редкая вещь: открытая модель из Китая встала вровень с самым дорогим Claude. GLM-5.2 за пару дней собрала тысячи обсуждений на Reddit и Hacker News, а независимые тесты подтвердили - это не маркетинг.
Вот суть. GLM - огромная модель: 753 миллиарда параметров, но под каждый запрос включается только малая часть (около 40 миллиардов), поэтому она быстрая и дешёвая, хоть и большая. Контекст - 1 миллион токенов, это примерно книга на 700 страниц за один заход. Сделала её Z.ai, компания из Пекина, выросшая из университета Цинхуа. Главное: модель выложена в открытый доступ. У GLM-5.2 лицензия MIT, у GLM-5.3 - собственная GLM-5.3 License, по духу такая же свободная: бери и пользуйся, а единственное ограничение касается гигантов - сервисам с выручкой от $10 миллиардов в год нужно пройти проверку безопасности Z.ai. Региональных блокировок нет, в отличие от Claude.
Тайминг сыграл на руку. За день до выхода правительство США директивой заставило Anthropic экстренно отрубить две топовые модели.
Мы получили директиву от правительства сегодня в 17:21 по восточному времени. Чтобы соблюсти требования, мы вынуждены резко отключить Fable 5 и Mythos 5 для всех наших клиентов.
На следующий день вышла GLM-5.2 - открытая, без локов, дешёвая. Аналитики Artificial Analysis поставили её на первое место среди открытых моделей.
GLM-5.2 - ведущая открытая модель в индексе Intelligence Index v4.1. С результатом 51 она лидирует.
На тот момент в общем зачёте она была четвёртой - позади Fable 5, Opus 4.8 и GPT-5.5. Но среди тех, что можно скачать и крутить без разрешения разработчика, она лучшая. Для предпринимателя это значит одно: появился сильный конкурент Claude, который стоит как чашка кофе.
Дальше линейки пошли вразнос. 24 июля Anthropic выпустила Opus 5 по той же цене - $5 и $25 за миллион токенов. 14 августа вышла GLM-5.3: те же 753 миллиарда параметров и миллионный контекст, но заметно сильнее в коде - плюс 50% к GLM-5.2 на внутреннем тесте Z.ai. 1 сентября Anthropic показала Fable 5.1 и Mythos 5.1. Поэтому дальше в статье цифры уже про актуальную версию - GLM-5.3.
Догнала ли GLM-5.2 Claude по коду на самом деле?
Цифры ниже - из официальной карточки GLM-5.3 на HuggingFace. Z.ai сравнивает свою модель с Opus 4.8, а не с Opus 5 - держи это в голове, это их таблица.
| Тест | GLM-5.3 | GLM-5.2 | Opus 4.8 | Что видно |
|---|---|---|---|---|
| Terminal-Bench 2.1 (работа в терминале) | 88.2 | 81.0 | 85.0 | GLM-5.3 впереди |
| Terminal-Bench 3.0 | 28.3 | 4.6 | 21.1 | рывок в 6 раз, Opus 4.8 позади |
| DeepSWE (реальные задачи из репозиториев) | 66.9 | 46.2 | 58.0 | GLM-5.3 впереди |
| FrontierSWE (средние задачи) | 78.1 | 67.5 | 66.5 | GLM-5.3 впереди |
| NL2Repo (правки в большом проекте) | 58.0 | 48.9 | 69.7 | Opus всё ещё лучше |
| SWE-Marathon (многочасовые задачи) | 42.5 | 19.4 | 48.8 | разрыв сократился вдвое |
| CyberGym (поиск уязвимостей) | 84.5 | 77.2 | 78.1 | GLM лучшая |
Картина такая: GLM-5.3 выигрывает у Opus 4.8 почти везде и уступает там, где надо переписать кусок большого проекта целиком или держать многочасовую задачу без потери нити. Причём на многочасовых задачах отрыв сократился вдвое. Длинная автономная работа - последний рубеж, где Opus держится уверенно.
В июне, когда GLM-5.2 только вышла, команда Cline дала ей и Opus 4.8 починить реальный баг из своего проекта.
Обе модели починили баг, но GLM выиграл по цене и качеству кода: GLM потратил вдвое больше токенов, но обошёлся вдвое дешевле. А Opus оставил ошибки типов, которые прошли тесты, но сломали сборку в проде.
Любопытно, что на узких задачах GLM иногда обгоняет Claude. Компания по безопасности Semgrep (не разработчик GLM, незаинтересованная сторона) гоняла модели на поиске уязвимостей и нашла, что голая GLM-5.2 обходит агента на Opus. Но у них же есть отрезвляющая оговорка, которую стоит запомнить.
Это один прогон на одном датасете. Оснастка вокруг модели важнее самой модели.
Запомни эту оговорку - оснастка важнее модели. Вывод по тестам: GLM-5.3 догнала и обогнала Opus 4.8 на повседневном коде, на самом сложном - почти вровень. Как она против Opus 5 - скажем, когда появятся независимые замеры. Для большинства задач предпринимателя и текущего запаса хватает.
Насколько GLM-5.2 дешевле Claude?
Вот ради чего вся история. Сравним цены за миллион токенов.
| Модель | Вход ($/1M) | Выход ($/1M) |
|---|---|---|
| GLM-5.3 (Z.ai напрямую) | $1.40 | $4.40 |
| GLM-5.3 (через OpenRouter, у части провайдеров скидка около 20%) | от $1.13 | от $3.56 |
| Claude Sonnet 5 | $2.00 | $10.00 |
| Claude Opus 5 | $5.00 | $25.00 |
| Claude Mythos 5.1 (самый дорогой Claude) | $10.00 | $50.00 |
Разница по цене огромная: выход у GLM дешевле в 6-8 раз. В июне агрегатор EdenAI считал месячный счёт при нагрузке около 50 миллионов токенов: выходило примерно $145 у GLM против $750 у Opus. Цены с тех пор не изменились, так что пропорция держится.
GLM-5.2 стоит $1.40 за миллион токенов на входе и $4.40 на выходе. Для сравнения, Claude Opus 4.5-4.8 - $5 и $25.
Но честно про подвох. GLM настроена перепроверять себя перед сдачей, поэтому тратит заметно больше токенов на ту же задачу (у GLM-5.3 режим рассуждения включён всегда, выключить его нельзя). В июньском тесте Cline она сожгла 1.1 миллиона токенов против 660 тысяч у Opus - и всё равно вышла вдвое дешевле ($0.41 против $0.81). А вот разработчик Michael Tefula на своей задаче получил разницу в 7.5 раза.
GLM оказался в 7.5 раза дешевле Opus 4.8 ($0.31 против $2.33). Opus был чуть более отполированным. Но GLM шёл очень близко. Обе модели отличные, я бы спокойно начал с любой.
Итого реальная экономия на конкретной задаче - где-то от 2 до 7 раз, в зависимости от того, насколько GLM придётся себя перепроверять. Меньше «в 5 раз», обещанных ценой, но всё равно деньги, которые остаются у тебя в кармане. GLM - один из способов платить меньше: про DeepSeek и другие дешёвые модели для кода у меня есть отдельные разборы.
Сэкономить на одной модели - это только начало. Куда важнее собрать систему, где Claude перестаёт галлюцинировать на любой модели. Выбор модели - движок. Машину делает то, что ты кладёшь в контекст.
На практикуме за 3 эфира собираешь полную связку: Контекст-инжиниринг + Второй мозг + ИИ-клон. Это 3 кита, без которых ИИ галлюцинирует хоть на дорогом Opus, хоть на дешёвой GLM.
Как подключить GLM-5.2 в Claude Code за 5 минут?
Самое приятное: ты не меняешь инструмент. Claude Code остаётся, меняется только то, какая модель отвечает под капотом. Подключение - это пара строк в настройках.
Путь 1 - подписка Z.ai (для ежедневной работы)
У Z.ai есть специальная подписка GLM Coding Plan, заточенная под кодинг-инструменты. Цена фиксированная, а сам адрес API говорит на родном для Claude Code языке.
Оформи подписку
Зайди на z.ai/subscribe, выбери тариф. Lite - от $18 в месяц (хватает на день плотной работы), есть тарифы дороже для тех, кто кодит целыми днями.Создай ключ
На z.ai в разделе API Keys нажми «Create a new API key» и скопируй его.Пропиши настройки
Открой файл ~/.claude/settings.json и вставь блок ниже, подставив свой ключ.Перезапусти терминал
Открой новый терминал, запусти claude, введи /status для проверки.
{
"env": {
"ANTHROPIC_AUTH_TOKEN": "твой_ключ_z_ai",
"ANTHROPIC_BASE_URL": "https://api.z.ai/api/anthropic",
"ANTHROPIC_DEFAULT_HAIKU_MODEL": "glm-5.3-flash[1m]",
"ANTHROPIC_DEFAULT_SONNET_MODEL": "glm-5.3[1m]",
"ANTHROPIC_DEFAULT_OPUS_MODEL": "glm-5.3[1m]",
"API_TIMEOUT_MS": "3000000"
}
}Две частые ошибки из чужих гайдов. Первая: переменная называется ANTHROPIC_AUTH_TOKEN, а не ANTHROPIC_API_KEY. Вторая: адрес для Claude Code - именно https://api.z.ai/api/anthropic (формат Anthropic). Голый /api/paas/v4 с подпиской работать не будет.
После этого Claude Code будет показывать названия «Opus» и «Sonnet», но под капотом крутить GLM - Z.ai подменяет модель на своей стороне. Если в настройках у тебя осталась прописанной glm-5.2 - не страшно: Z.ai сам маршрутизирует запросы к GLM-5.2 и 5.1 на GLM-5.3, а к GLM-4.7 - на GLM-5.3-Flash.
Путь 2 - через OpenRouter (удобно для оплаты из России)
OpenRouter умеет говорить с Claude Code напрямую, локальный посредник не нужен.
Заведи ключ
Зайди на openrouter.ai через Google или GitHub, создай ключ вида sk-or-v1-... на странице openrouter.ai/keys.Пополни баланс
На openrouter.ai/credits закинь денег. Из России - криптой в USDC, карта не нужна (подробнее в разделе про оплату).Пропиши настройки
В ~/.claude/settings.json вставь блок ниже - в нём модель GLM уже задана.Запусти Claude Code
Открой новый терминал и запусти claude. Переключиться на лету можно командой /model.
{
"env": {
"ANTHROPIC_BASE_URL": "https://openrouter.ai/api",
"ANTHROPIC_AUTH_TOKEN": "sk-or-v1-ТВОЙ-КЛЮЧ",
"ANTHROPIC_API_KEY": "",
"ANTHROPIC_DEFAULT_OPUS_MODEL": "z-ai/glm-5.3",
"ANTHROPIC_DEFAULT_SONNET_MODEL": "z-ai/glm-5.3"
}
}Точный адрес модели в OpenRouter - z-ai/glm-5.3 (префикс z-ai). Базовый адрес - https://openrouter.ai/api без /v1 на конце. И поле ANTHROPIC_API_KEY оставь пустой строкой - иначе будет конфликт.
Важная оговорка: сам OpenRouter предупреждает, что идеальную работу Claude Code обещает только с моделями Anthropic. С GLM вызовы инструментов в основном работают, но иногда могут сбоить. Если упрётся - есть запасной вариант через локальный посредник claude-code-router. Для большинства задач этого не понадобится.
Запустить локально дома - честно, нереально
Раз веса открытые, напрашивается вопрос: а можно скачать и крутить бесплатно у себя? Для предпринимателя без своего сервера - нет.
GLM-5.3 на те же 753 миллиарда параметров требует сервер уровня восьми видеокарт H200 (это больше терабайта видеопамяти и сотни тысяч долларов железа). Даже на топовом ноутбуке она просто не запустится. Открытая лицензия тут про другое: ценовая конкуренция и отсутствие блокировок. А пользоваться всё равно через API.
Когда брать GLM-5.2, а когда оставить Claude Opus?
Не нужно выбирать одну модель навсегда. Умные вайб-кодеры держат обе и переключаются по задаче. Вот рабочее правило, собранное из отзывов практиков.
Бери GLM, когда:
- Черновая работа и итерации - накидать, посмотреть, переделать.
- Фронтенд, вёрстка, типовой код для базы данных.
- Большой объём дешёвой рутины, где не жалко переделать.
- Нужен большой контекст за копейки.
- Просто хочется платить меньше за те 80% задач, что попроще.
Оставляй Opus, когда:
- Финальный сложный архитектурный код.
- Длинная многошаговая задача, где агент не должен залипнуть.
- Критичная логика, где цена ошибки высокая.
- Нужно с первого раза - Opus требует вдвое меньше правок.
У GLM-5.2 была документированная слабость: на длинных многошаговых задачах она иногда зацикливалась, повторяя одни и те же действия. В GLM-5.3 разрыв на таких задачах сократился вдвое (SWE-Marathon 42.5 против 48.8 у Opus 4.8), но полностью он не исчез. Поэтому для долгой автономной работы Opus по-прежнему надёжнее.
И тут ловушка: самый дешёвый инструмент не всегда даёт самую дешёвую работу. Если GLM трижды сделала криво и пришлось доделывать руками, дешёвая модель вышла дороже Opus, который сделал бы сразу. Считай не цену за токен, а цену за готовый результат. А если остаёшься на Claude - какую модель брать под задачу, Sonnet или Opus, я разбираю отдельно.
Можно ли пользоваться GLM-5.2 из России?
Это важный плюс для нашей аудитории. Claude Anthropic официально не поддерживает Россию и банит тех, кто заходит через VPN. С GLM ситуация мягче.
Через OpenRouter - самый низкий порог: он принимает крипту в USDC, и это ключевое. Карта не нужна, VPN не нужен. Криптовалюту покупаешь за рубли через P2P, пополняешь баланс. Есть и рублёвый посредник через систему быстрых платежей, если с криптой возиться не хочется.
Через подписку Z.ai - дешевле, но оплата сложнее: российские карты не проходят. Реальные пути - иностранная виртуальная карта (Казахстан, Армения, Грузия) или рублёвый посредник, который оплатит за тебя за комиссию. Сам сайт и API при этом открываются из России без VPN.
Если ты уже знаком с криптой - начни с OpenRouter, там меньше всего возни. Если нужна самая дешёвая фиксированная подписка под Claude Code и есть иностранная карта - бери Z.ai Coding Plan.
Какие риски и подводные камни?
Дешевизна не бывает совсем бесплатной. Что нужно знать заранее.
Приватность. Международный сервис Z.ai оформлен на сингапурскую компанию, и по API-доступу политика приличная: заявлено, что материалы не хранятся и не используются для тренировки моделей без твоего явного согласия. Но это обещания политики, а не аудированные гарантии - публичного сертификата безопасности у них нет. Материнская компания китайская, и теоретически китайское право может требовать доступ к данным. Плюс в январе 2025 Zhipu внесли в экспортный список США - это ограничивает, что компания может покупать у США, а не запрет пользоваться её моделями, но как сигнал стоит держать в голове.
Стабильность - самый ощутимый минус. В середине июня, на старте GLM-5.2, API лежал пару дней из-за жёстких ограничений на нагрузку: в пиковые часы доходило до того, что отклонялась половина запросов. Для боевой работы это значит: держи Claude как запасной вариант, не завязывайся на одну модель целиком.
Общий совет по безопасности. Он касается любого стороннего ИИ, а китайского - с двойным вниманием. Никогда не отправляй в промпт секреты и личные данные: ключи API, содержимое файла с паролями, реальные почты и телефоны клиентов, дампы боевой базы. Политики - это обещания, а не криптозамок. Подробнее про защиту проекта я разбираю в гайде про безопасность вайб-кодинга.
Стоит ли переходить на GLM-5.2?
С выходом GLM-5.3 ставки выросли: открытая модель снова стоит в разы дешевле и доступна из России, только теперь в таблице Z.ai она уже впереди Opus 4.8. Для предпринимателя, который боится сжечь весь бюджет на лимитах Claude, это прямой ответ.
Но я бы предостерёг от иллюзии, что дело только в выборе модели. Вспомни оговорку Semgrep - оснастка важнее модели. Та же мысль звучит у всех практиков: вайб-кодинг ломается чаще всего по одной причине: модели не дали контекст. Я видел, как люди берут дешёвую GLM, не настраивают контекст-инжиниринг и получают мусор - а потом винят модель.
GLM-5.2 - первая открытая модель, которая ощущается уместной в кодинг-инструментах как агент общего назначения.
Так что мой совет простой. Подключи GLM сегодня, погоняй на своих задачах неделю, оставь Opus для сложного. И параллельно займись тем, что реально решает - управлением контекстом. Тогда даже дешёвая модель будет давать стабильный результат.
Источники
- Z.ai - карточка модели GLM-5.3 (HuggingFace)
- OpenRouter - GLM-5.3: цены и провайдеры
- Z.ai - GLM Coding Plan
- Z.ai - официальный блог о GLM-5.2 (HuggingFace)
- Z.ai - карточка модели GLM-5.2
- Z.ai - цены API
- Z.ai - подключение к Claude Code (документация)
- OpenRouter - интеграция с Claude Code
- Anthropic - цены Claude
- Anthropic - заявление об отключении Fable 5 и Mythos 5
- Artificial Analysis - GLM-5.2 как ведущая открытая модель
- Cline - тест GLM-5.2 против Opus 4.8 на реальном баге
- Semgrep - GLM-5.2 в тестах на безопасность
- Michael Tefula - две недели с GLM-5.2 против Opus
- Digital Applied - тесты GLM-5.2 против Opus
- Simon Willison - разбор GLM-5.2
- Interconnects - почему GLM-5.2 это сдвиг для открытых агентов
Дешёвая модель экономит деньги. Стабильный результат даёт связка: Контекст-инжиниринг + Второй мозг + ИИ-клон. Полная схема по вайб-кодингу за вечер - 3 эфира, 2 000 ₽. Записи остаются у тебя.
Новые материалы - дайджестом, без спама
Гайды выходят регулярно. Подпишись, чтобы не пропускать: пришлю подборку в Telegram или на email. Раз в неделю или каждый день - выбираешь сам.

