GLM
De GLM-serie: Chinese open-weight bovenaan de benchmarks.
De fiche van Olya
- Bijzonderheden
- GLM is de modellenfamilie van Zhipu AI (Z.ai), Chinees, met één duidelijk onderscheid: versies tot GLM-4.7 verschijnen open-weight onder een MIT-licentie, te downloaden van Hugging Face en ook commercieel bruikbaar, terwijl het vlaggenschip GLM-5.2 via API draait met een context tot een miljoen tokens. Ze is vooral afgestemd op coderen en agentische taken — function calling, gestructureerde output, MCP-integratie — meer dan op algemene chat.
- Sterke punten
- Op codeer-benchmarks houdt ze stand tegen veel duurdere modellen: GLM-4.7 verslaat meerdere rivalen op LiveCodeBench en SWE-bench Verified tegen 0,60 dollar per miljoen invoertokens en 2,20 voor uitvoer. De prijs-kwaliteitverhouding is de echte kracht, en wie de kosten naar nul wil brengen, kan de open-weight-versies op eigen hardware draaien.
- Wanneer te gebruiken
- Ze loont wanneer je code schrijft of refactort in projecten met meerdere bestanden en een fractie van een vergelijkbaar westers model wilt uitgeven, of wanneer je een agentische flow met tool-aanroepen en lange context nodig hebt. Ook een goede keuze als je zelf moet hosten om redenen van privacy of kosten, gebruikmakend van de open releases.
- Wanneer te vermijden
- Heb je multimodale mogelijkheden nodig (beeld, audio), kijk dan elders: de hier behandelde GLM-serie is alleen tekst. Het venster van een miljoen tokens en de beste prestaties zitten in het vlaggenschip GLM-5.2, dat betaald is en tijdens piekuren wisselend quota verbruikt; en open-weight betekent in de praktijk niet gratis, want de grote modellen (honderden miljarden parameters) vragen serieuze hardware om lokaal te draaien.