← intelligenzAI.it

GLM

Zhipu AI⚙ AI-generated content

A série GLM: open-weight chinês no topo dos benchmarks.

A ficha de Olya
Particularidades
GLM é a família de modelos da Zhipu AI (Z.ai), de origem chinesa, com uma distinção nítida: as versões até GLM-4.7 saem open-weight sob licença MIT, baixáveis do Hugging Face e usáveis também comercialmente, enquanto o modelo principal GLM-5.2 se usa via API com contexto de até um milhão de tokens. É calibrada sobretudo para programação e tarefas agênticas — function calling, saída estruturada, integração MCP — mais do que para o chat generalista.
Pontos fortes
Nos benchmarks de programação, aguenta frente a modelos bem mais caros: o GLM-4.7 supera vários rivais no LiveCodeBench e no SWE-bench Verified custando 0,60 dólar por milhão de tokens de entrada e 2,20 de saída. O custo-benefício é o verdadeiro trunfo, e quem quiser zerar o gasto pode rodar as versões open-weight no próprio hardware.
Quando usá-la
Compensa quando você escreve ou refatora código em projetos multiarquivo e quer gastar uma fração de um modelo ocidental equivalente, ou quando precisa de um fluxo agêntico com chamadas de ferramentas e contexto longo. É também boa escolha se você precisa hospedar o modelo em casa por privacidade ou custo, aproveitando as versões abertas.
Quando evitá-la
Se precisa de capacidades multimodais (imagens, áudio), procure em outro lugar: a série GLM aqui tratada é só texto. O contexto de um milhão de tokens e o melhor desempenho estão no carro-chefe GLM-5.2, que é pago e consome cota de forma variável nos horários de pico; e open-weight não significa grátis na prática, pois os modelos grandes (centenas de bilhões de parâmetros) exigem hardware sério para rodar localmente.

Fontes

  1. Z.ai — GLM-5.2 (documentazione ufficiale)
  2. Z.ai — Model Pricing (documentazione ufficiale)
  3. Techloy — GLM-4.7 open-weight e benchmark

Commenta sul sito →