GLM-5.2 - качественный скачок для открытых агентов
- title
- GLM-5.2 - качественный скачок для открытых агентов
- type
- summary
- summary
- Нейтан Ламберт о GLM-5.2 как первой open-weight модели для роли кодинг-агента, вышедшей на фоне ограничений Claude Fable 5
- tags
- ai, open-weights, china, llm, coding-agent, policy
- created
- 2026-09-14
- updated
- 2026-09-14
- lang
- ru
- translation_of
- glm-5-2-step-change-for-open-agents
- source_updated
- 2026-09-14
- translated
- 2026-09-14
- translator
- lllm/antigravity/gemini-3.7-flash-medium
Нейтан Ламберт опубликовал этот текст в interconnects 22 июня 2026 года, через шесть дней после выхода весов GLM-5.2 от Z.ai. Релиз проходил в необычном порядке. Z.ai выкатила модель в субботу, 13 июня, для подписчиков своего GLM Coding Plan, а веса под лицензией MIT и пост в блоге опубликовала три дня спустя, 16 июня. Ламберт замечает, что релизы на выходных обычно говорят о каких-то накладках (в качестве примера он приводит Llama 4). В данном случае он считает, что z-ai хотела поймать удачный инфоповод. Чуть больше недели назад правительство США наложило экспортные ограничения на Claude Fable 5, фактически ставшие баном, а Anthropic критиковали за антинаучную позицию из-за тихого добавления ограничений против ИИ-исследователей. Китайские лаборатории с открытыми весами, по его словам, уже год или два не упускают ни одной столь лёгкой маркетинговой победы.
Номер версии намекал на минорное обновление GLM-5.1. Первый вывод Ламберта: минорные версии способны переступать пороги, меняющие саму применимость модели. К этому моменту Moonshot (Kimi) и Z.ai (GLM) стали двумя самыми популярными лабораториями открытых весов среди исследователей ИИ.
Реакция оказалась важнее описания релиза
Ламберт опускает большую часть промо-материалов: результаты бенчмарков, RL-фреймворк SLIME, совет всегда запускать модель на Max thinking effort. Бенчмарки "наполовину мертвы", пишет он, и реальной проверкой становится то, что обнаруживают другие. Здесь результаты сообщества превзошли ожидания. В агентском лидерборде Arena GLM-5.2 оказалась единственной открытой моделью, конкурирующей с последними моделями OpenAI и Anthropic: на максимальном thinking effort она догнала Opus 4.8 с выключенным thinking. Design Arena - бенчмарк, к которому с недоверием относятся даже сами дизайнеры, - поставил её выше Claude Fable.
По словам Ламберта, до этого лишь один открытый релиз привлекал столько же внимания уважаемых им исследователей и комментаторов - DeepSeek R1. Когда-то он назвал Kimi K2 "моментом DeepSeek", но GLM-5.2, по его мнению, идёт заметно дальше. K2 показала, что большие прорывы в открытых моделях могут исходить от любой китайской лаборатории. GLM-5.2 - это "скорее дверь в один конец".
Модель, которая естественно ощущается в обвязке
Центральный тезис: GLM-5.2 - первая модель с открытыми весами, которая "естественно ощущается в кодинговых обвязках в роли универсального агента". Ламберт снова сравнивает её с R1. R1 показала, что открытые лаборатории со значительно меньшими ресурсами могут воспроизвести рассуждения уровня o1 от OpenAI. GLM-5.2 доказывает, что они могут конкурировать и в агентском написании кода - именно этой возможности Anthropic обязана рекордным ростом выручки от claude-code. Он подчёркивает, что это отнюдь не было гарантировано: агенты завязаны на инструменты, интегрированные обвязки и очень большие модели, из-за чего их создание обходится дорого.
Он протестировал её сам: запускал GLM-5.2 через API Fireworks внутри Claude Code для подготовки материалов своего курса по post-training, и отметил простоту настройки. Возникло только одно неудобство. Когда Claude Code или документация в репозитории пытались отправить изображение в текстовую модель, сессия Fireworks ломалась, и контекст приходилось очищать вручную. В остальном модель "сразу показала себя как надо". Другие отзывались ещё с большим восторгом. Основатель Z.ai заявил Илону Маску, что "возможности уровня Fable в открытых весах появятся раньше первого квартала 2027 года", а CEO Vercel признался, что был "буквально шокирован" тем, насколько хорошо она пишет код.
То, что китайская открытая модель теперь работает внутри агента от самой Anthropic, - постоянный лейтмотив в нашей базе знаний. telnyx раздаёт FP8-сборку GLM-5.2 рядом с моделями Kimi, glm52-amd-mi355x описывает опыт вендора по квантованию модели в MXFP4 и её запуску на железе AMD, а mesh-llm рассказывает о её работе на связке из двух Mac Studio.
Оценка отставания
Ламберт предсказывал "взрывной рост использования", как только открытая модель дотянется до уровня Claude Opus 4.5 внутри Claude Code - фронтира на начало 2026 года. Opus 4.5 вышел 24 ноября 2025 года. GLM-5.2 вышла 16 июня 2026 года - 204 дня или примерно 6.8 месяца спустя. Это укладывается в привычные 6-9 месяцев отставания китайских открытых лабораторий от закрытых американских. Ламберт признаётся, что результат его удивил: он ожидал, что стремительный рост вычислительных мощностей в США увеличит разрыв, и что Claude Fable 5 - модель, сильнее зависящая от масштаба и новейших GPU, - подтвердит эту гипотезу. Вопрос он оставляет открытым. Месяц спустя в эссе kimi-k3-open-weights-escalation он оценил этот разрыв уже в 3-5 месяцев.
Экономические и политические последствия
Непосредственный экономический эффект - ценовое давление на Anthropic со стороны компаний с большими расходами на токены. Ламберт не думает, что Anthropic из-за этого сорвёт прогнозы по выручке, поскольку спрос продолжает расти. Главными победителями становятся компании, продающие инференс открытых моделей или их дообучение: Fireworks, Together, Thinking Machines через Tinker и Prime Intellect. Он ожидает медленной диффузии в реальные рабочие процессы, где команды уже разделяют модели под планирование, написание кода и субагентов. Он также называет "серьёзным экономическим ударом" то, что эта диффузия случилась ровно тогда, когда ведущая американская модель попала под запрет. Это дало GLM-5.2 время занять низкомаржинальные ниши, от которых передовые лаборатории как раз пытаются уйти.
Политические последствия он считает более важными. Дата релиза GLM-5.2 прочно связала её в восприятии людей с ограничениями Claude Fable и с Claude Mythos. Правительство США сочло возможности класса Mythos небезопасными для публичного доступа, тогда как китайские лаборатории продолжили выкладывать всё более способные модели всем желающим. Ламберт отмечает, что эти тенденции не обязательно причинно связаны - никто не знал, как именно GLM-5.2 справляется с киберзадачами по сравнению с прошлыми версиями, - но они явно скоррелированы. Это приближает вероятный сценарий, при котором Вашингтон объявит конкретную китайскую open-weight модель угрозой для общественной безопасности. В us-scrutiny-of-chinese-model-use рассматриваются расследования Конгресса, последовавшие в те же месяцы.
В заключение он рассуждает о том, какой из рисков масштабнее. Ему понятно, почему общедоступная модель уровня Mythos пугает. Но если открытые модели запретить сейчас, пока закрытые модели за пару лет станут в 10 или 100 раз мощнее в руках одной-двух компаний, "проблемы перед нами встанут куда более серьёзные". arguments-against-open-source-ai и six-months-to-live-for-open-models рассматривают то же опасение под другими углами.
Что было дальше
Спустя восемь недель Z.ai анонсировала GLM-5.3 - ту же базовую модель с существенно большим объёмом post-training. Текст Ламберта glm-5-3-how-chinese-labs-keep-stride оглядывается на GLM-5.2 как на релиз, полностью оправдавший ожидания. Знакомые ему исследователи продолжали пользоваться ей и недели спустя благодаря её скорости и простоте.
- GLM-5.3: How Chinese labs keep stride with the frontier
- GLM5.2 on AMD MI355X
- How distillation is used today and what performance uplift it gives to open models
- Interconnects (interconnects.ai)
- Kimi K3: The open-weights escalation
- Open-Source AI & Open Models Reading List
- 6 months to live for open models
- Telnyx Inference
- US Scrutiny of Chinese Model Use
- Z.ai (Zhipu AI)
- The Z.ai Playbook