Alle AI-Trends
Direkt in dein Postfach
Erhalte exklusive AI-Tutorials, Praxistipps und KI-News direkt in dein Postfach.
*Mit deiner Anmeldung akzeptierst du unsere Datenschutzrichtlinien.
Jetzt neu: Byte Pulse – Token-Limits von Claude Code, Codex & Co. tracken! 

GLM 5.2

Veröffentlichung
Juni 2026
Kontextfenster
1,05 Mio. Token
API-Preis In / Out
1,40 $ / 4,40 $
Parameter
753 Mrd.
Daten aktualisiert: 19. Juni 2026

GLM-5.2 Modell-Übersicht

GLM-5.2 ist das aktuelle Flaggschiff von Z.ai (ehemals Zhipu AI) und folgt auf GLM-5.1. Im Vergleich zum Vorgänger kann GLM-5.2 mit Kontextfenstern von bis zu 1 Mio. Token arbeiten und kombiniert dabei zwei verschiedene Thinking-Effort-Stufen (High und Max). Z.ai positioniert das Modell klar für Agentic Coding über ganze Repositories hinweg. Anwendungsgebiete sind z.B. Refactorings, die Quellcode, Tests und Konfiguration gemeinsam im Kontext halten. GLM-5.2 setzt sich an die Spitze der Open Weights Modelle und überholt laut namhaften Researchern wie Jeremy Howard teilweise sogar proprietäre Modelle wie Claude Opus 4.8 oder GPT-5.5.

Features & Modalitäten

Nicht verfügbar
Multimodalität
Verfügbar
ReasoningToolsWebsucheStrukturierte AusgabenQuellenangabenFinetuning
Input:Text
Output:TextJson

Features & Modalitäten

Reasoning, Tool-Nutzung und strukturierte Ausgaben gehören 2026 zum Standard aktueller LLMs. Interessant wird es bei Abweichungen und die unterstützten Modalitäten.

Fähigkeiten mit grünem Haken sind verfügbar, rot markierte fehlen dem Modell. Details zu jeder Fähigkeit kannst du über das jeweilige Info-Symbol einsehen.

Details zum Modell

Max. Input
1,05 Mio. Token
Max. Output
131,07k Token
Input-Preis / 1M Token
1,40 $
Output-Preis / 1M Token
4,40 $
Parameter
753 Mrd.
Dateigröße
1403,19 GB
Vokabular
154,88k

API-Preise einordnen

Eine typische Antwort (ca. 1.000 Wörter, kurzer Prompt) kostet über die API rund 0,0064 $.

Als Reasoning-Modell erzeugt es zusätzlich Thinking-Tokens, die als Output abgerechnet werden. Die realen Kosten liegen je nach Aufgabe deutlich darüber.

Dein eigenes Nutzungsprofil kannst du mit dem Kosten-Rechner, den wir unter der Tabelle verlinkt haben, berechnen.

GLM-5.2 Benchmark Scores



Benchmarks & Performance

Im KI-Kontext bezeichnet Performance die Leistungsfähigkeit eines Modells in Bereichen wie Sprachverständnis, Logik oder Programmierung, gemessen anhand standardisierter Benchmarks für eine objektive Vergleichbarkeit.

Achte beim Vergleichen darauf, ob die LLMs Tools oder mehrere Durchläufe („Pass@k“) nutzen durften. Benchmark Scores lassen sich untereinander nur vergleichen, wenn sie der gleichen Methodik zugrunde liegen.

Technologie & Daten

Technische Spezifikationen

ArchitekturMoE-Transformer
Input Kontextlänge1,05 Mio.
Output Kontextlänge131,07k
TokenizerProprietärer GLM-Tokenizer

Besonderheiten

Großes KontextfensterBis zu 1 Mio. Token Kontextfenster, 5x von GLM-5.1
Anthropic-kompatibler EndpointLässt sich über einen Anthropic-kompatiblen Endpoint und das Model Context Protocol (MCP) in bestehende Agent-Workflows einbinden.
Context CachingImplizites Caching senkt die Kosten wiederkehrender Kontexte in langen Konversationen.

Vorteile & Nachteile

Vorteile

  • Großes 1 Mio. Token-Kontextfenster
    Mit 1 Mio. Token fasst GLM-5.2 das Fünffache von GLM-5.1 (200K) und kann ein mittelgroßes Repository inklusive Tests und Verlauf in einer Session halten, statt ständig zusammenzufassen.
  • Deutlich günstiger als westliche Frontier-Modelle
    Mit $1,40 / $4,40 pro 1 Mio. Input-/Output-Token und Cached Input für $0,26/M liegt GLM-5.2 deutlich unter vergleichbaren Modellen. Der GLM Coding Plan startet bei $18/Monat.
  • Offene Gewichte unter MIT-Lizenz
    Die Weights von GLM-5.2 sind frei unter der MIZ-Lizenz (kommerziell) nutzbar und lokal deploybar, insofern man die notwendige Hardware aufbringen kann.
  • Breite Agentic-Coding-Integration
    Über einen Anthropic-kompatiblen Endpoint und MCP arbeitet GLM-5.2 direkt mit Claude Code, Cline, OpenCode, Roo Code, Kilo Code, Crush und Goose zusammen.

Nachteile

  • Nur Text, keine Bildverarbeitung
    GLM-5.2 verarbeitet ausschließlich Text. Für Vision-Aufgaben verweist Z.ai auf separate Modelle wie GLM-5V-Turbo, was der Haupt-Nachteil von GLM-5.2 ist.

Vergleiche GLM-5.2 mit anderen LLMs

Vergleiche GLM-5.2 mit anderen Sprachmodellen anhand wichtiger Metriken wie Kontextgröße, Preisen und Benchmark-Leistung.


Alle Modelle vergleichen

GLM-5.2 ausprobieren

Du musst kein Entwickler sein: GLM-5.2 ist auch direkt in GLM Coding Plan nutzbar.

App
GLM Coding Plan
Kostenlose Nutzung
Ja
Pro-Abo / Monat
18,00 $

Provider & APIs

Du kannst Z.ai GLM-5.2 über die API folgender Anbieter nutzen.




Häufige Fragen zu GLM-5.2

Kann ich GLM-5.2 kostenlos nutzen?

Ja, GLM-5.2 ist in GLM Coding Plan auch mit einem kostenlosen Konto nutzbar — allerdings meist mit Nutzungslimits.

Ist GLM-5.2 Open Source?

GLM-5.2 wird unter der Lizenz „MIT“ veröffentlicht. Details stehen in den Lizenzbedingungen des Anbieters.

Welche Eingabeformate versteht GLM-5.2?

GLM-5.2 verarbeitet folgende Eingabeformate: Text.

Was kostet GLM-5.2 über die API?

Über die API kostet GLM-5.2 1,40 $ pro 1 Mio. Input-Token und 4,40 $ pro 1 Mio. Output-Token. Bei Reasoning-Modellen kommen Thinking-Tokens hinzu, die als Output abgerechnet werden.

Wie groß ist das Kontextfenster von GLM-5.2?

GLM-5.2 verarbeitet bis zu 1,05 Mio. Token in einer Anfrage.

Was ist der Vorgänger von GLM-5.2?

Der direkte Vorgänger von GLM-5.2 ist GLM-5.1 (erschienen April 2026). Einen tabellarischen Vergleich der beiden Modelle findest du auf dieser Seite im Abschnitt „Vergleiche“.