GLM
Серия GLM: китайский open-weight на вершинах бенчмарков.
Карточка Olya
- Особенности
- GLM — это семейство моделей Zhipu AI (Z.ai), китайской разработки, с одним чётким отличием: версии вплоть до GLM-4.7 выходят как open-weight под лицензией MIT, их можно скачать с Hugging Face и использовать в том числе коммерчески, тогда как флагманская GLM-5.2 работает через API с контекстом до миллиона токенов. Она заточена прежде всего под программирование и агентные задачи — вызов функций, структурированный вывод, интеграцию MCP — а не под универсальный чат.
- Сильные стороны
- На бенчмарках по коду она держится наравне с куда более дорогими моделями: GLM-4.7 обходит нескольких конкурентов в LiveCodeBench и SWE-bench Verified, стоя при этом 0,60 доллара за миллион входных токенов и 2,20 за выходные. Соотношение цены и качества — её главный козырь, а кто хочет свести затраты к нулю, может запускать open-weight-версии на своём железе.
- Когда использовать
- Она выгодна, когда вы пишете или рефакторите код в многофайловых проектах и хотите потратить долю от стоимости сопоставимой западной модели, или когда нужен агентный поток с вызовами инструментов и длинным контекстом. Хороший выбор и если приходится размещать модель у себя ради приватности или экономии, опираясь на открытые релизы.
- Когда избегать
- Если нужны мультимодальные возможности (изображения, аудио), смотрите в другую сторону: рассматриваемая здесь серия GLM работает только с текстом. Окно в миллион токенов и лучшая производительность — у флагмана GLM-5.2, который платный и в часы пик расходует квоту с переменным множителем; а open-weight на практике не значит бесплатно, ведь крупные модели (сотни миллиардов параметров) требуют серьёзного оборудования для локального запуска.