GLM
La serie GLM: pesos abiertos chinos en la cima de los benchmarks.
La ficha de Olya
- Peculiaridades
- GLM es la familia de modelos de Zhipu AI (Z.ai), de origen chino, con una distinción clara: las versiones hasta GLM-4.7 salen open-weight bajo licencia MIT, descargables desde Hugging Face y usables también con fines comerciales, mientras que el modelo insignia GLM-5.2 se usa por API con un contexto de hasta un millón de tokens. Está afinada sobre todo para programación y tareas agénticas — function calling, salida estructurada, integración MCP — más que para el chat general.
- Puntos fuertes
- En los benchmarks de programación aguanta frente a modelos mucho más caros: GLM-4.7 supera a varios rivales en LiveCodeBench y SWE-bench Verified costando 0,60 dólares por millón de tokens de entrada y 2,20 de salida. La relación calidad-precio es su verdadera baza, y quien quiera reducir el gasto a cero puede ejecutar las versiones open-weight en su propio hardware.
- Cuándo usarla
- Conviene cuando escribes o refactorizas código en proyectos multiarchivo y quieres gastar una fracción de un modelo occidental equivalente, o cuando necesitas un flujo agéntico con llamadas a herramientas y contexto largo. También es buena opción si debes alojar el modelo en casa por privacidad o coste, aprovechando las versiones abiertas.
- Cuándo evitarla
- Si necesitas capacidades multimodales (imágenes, audio) mira hacia otro lado: la serie GLM aquí tratada es solo texto. El contexto de un millón de tokens y el mejor rendimiento están en el buque insignia GLM-5.2, que es de pago y consume cuota de forma variable en horas punta; y open-weight no significa gratis en la práctica, porque los modelos grandes (cientos de miles de millones de parámetros) exigen hardware serio para funcionar en local.