Alle AI-Trends
Direkt in dein Postfach
Erhalte exklusive AI-Tutorials, Praxistipps und KI-News direkt in dein Postfach.
*Mit deiner Anmeldung akzeptierst du unsere Datenschutzrichtlinien.
Jetzt neu: Byte Pulse – Token-Limits von Claude Code, Codex & Co. tracken! 

GLM-4.5

Veröffentlichung
Juli 2025
Kontextfenster
131,07k Token
API-Preis In / Out
0,60 $ / 2,20 $
Knowledge Cutoff
Oktober 2023
Daten aktualisiert: 15. Juni 2026

GLM-4.5 Modell-Übersicht

GLM-4.5 ist ein Open-Source Mixture-of-Experts Sprachmodell mit 355 Mrd. (und 32 Mrd. aktiven) Parametern. GLM-4.5 ist ein hybrides LLM, das sowohl mit Reasoning, als auch ohne Reasoning arbeiten kann. In Benchmarks erreichte das Modell vom Entwickler Z.AI starke Ergebnisse in Coding- und Agent-Tests und konnte sogar mit proprietären Modellen wie Claude Sonnet 4, Grok 4 und OpenAI o4-mini mithalten.

Features & Modalitäten

Verfügbar
ReasoningToolsMultimodalitätWebsucheStrukturierte AusgabenQuellenangabenFinetuning
Input:TextBild
Output:Text

Features & Modalitäten

Reasoning, Tool-Nutzung und strukturierte Ausgaben gehören 2026 zum Standard aktueller LLMs. Interessant wird es bei Abweichungen und die unterstützten Modalitäten.

Fähigkeiten mit grünem Haken sind verfügbar, rot markierte fehlen dem Modell. Details zu jeder Fähigkeit kannst du über das jeweilige Info-Symbol einsehen.

Details zum Modell

Max. Input
131,07k Token
Max. Output
131,07k Token
Input-Preis / 1M Token
0,60 $
Output-Preis / 1M Token
2,20 $
Parameter
355 Mrd.
Dateigröße
667,46 GB
Vokabular
151,55k
Trainingsdaten
23.000 Mrd.

API-Preise einordnen

Eine typische Antwort (ca. 1.000 Wörter, kurzer Prompt) kostet über die API rund 0,0032 $.

Als Reasoning-Modell erzeugt es zusätzlich Thinking-Tokens, die als Output abgerechnet werden. Die realen Kosten liegen je nach Aufgabe deutlich darüber.

Dein eigenes Nutzungsprofil kannst du mit dem Kosten-Rechner, den wir unter der Tabelle verlinkt haben, berechnen.

GLM-4.5 Benchmark Scores



Benchmarks & Performance

Im KI-Kontext bezeichnet Performance die Leistungsfähigkeit eines Modells in Bereichen wie Sprachverständnis, Logik oder Programmierung, gemessen anhand standardisierter Benchmarks für eine objektive Vergleichbarkeit.

Achte beim Vergleichen darauf, ob die LLMs Tools oder mehrere Durchläufe („Pass@k“) nutzen durften. Benchmark Scores lassen sich untereinander nur vergleichen, wenn sie der gleichen Methodik zugrunde liegen.

Technologie & Daten

Technische Spezifikationen

ArchitekturMoE-Transformer-Decoder
Input Kontextlänge131,07k
Output Kontextlänge131,07k
TokenizerUnbekannt

Besonderheiten

BesonderheitInferenz-Beschleunigung über spekulatives Decoding

Vorteile & Nachteile

Vorteile

  • Benchmark Scores im SOTA-Bereich
    GLM-4.5 erreicht in den gängigen Benchmarks ähnliche Ergebnisse wie Flaggschiff-Modelle westlicher Entwickler.
  • Open Weights Model
    Die GLM Model-Weights lassen sich frei auf Hugging Face herunterladen und finetunen.
  • Günstige Inferenz
    Durch die MoE-Architektur benötigt GLM-4.5 weniger Rechenleistung für die Inferenz und ist deutlich günstiger als vergleichbare Modelle.
  • Verschiedene Modellgrößen
    Neben GLM-4.5 und GLM-4.5 Air gibt es auch noch eine FP8-Quantisierte Version, die man sogar lokal gut ausführen kann.

Nachteile

  • Politischer Bias
    Wie andere chinesische Modelle auch reflektiert GLM-4.5 den politischen Bias der chinesischen Regierung.
  • Gefühlte Qualität schlechter als gemessene Qualität
    In unseren subjektiven Einschätzungen erreicht der Output von GLM-4.5 trotz hervorragender Benchmark Scores nicht die Qualität von OpenAI-o3 oder Claude Opus 4.
  • Kein Datenschutz über den Chatbot
    Wer GLM-4.5 über die offizielle Website oder App verwendet, gibt seine Daten preis.

Vergleiche GLM-4.5 mit anderen LLMs

Vergleiche GLM-4.5 mit anderen Sprachmodellen anhand wichtiger Metriken wie Kontextgröße, Preisen und Benchmark-Leistung.


Alle Modelle vergleichen

GLM-4.5 ausprobieren

Du musst kein Entwickler sein: GLM-4.5 ist auch direkt in GLM Coding Plan nutzbar.

App
GLM Coding Plan
Kostenlose Nutzung
Ja
Pro-Abo / Monat
18,00 $

Provider & APIs

Du kannst Z.ai GLM-4.5 über die API folgender Anbieter nutzen.

Das Modell ist derzeit bei keinen Anbietern verfügbar.

Häufige Fragen zu GLM-4.5

Kann ich GLM-4.5 kostenlos nutzen?

Ja, GLM-4.5 ist in GLM Coding Plan auch mit einem kostenlosen Konto nutzbar — allerdings meist mit Nutzungslimits.

Ist GLM-4.5 Open Source?

GLM-4.5 wird unter der Lizenz „MIT“ veröffentlicht. Details stehen in den Lizenzbedingungen des Anbieters.

Welche Eingabeformate versteht GLM-4.5?

GLM-4.5 verarbeitet folgende Eingabeformate: Text, Bild.

Was kostet GLM-4.5 über die API?

Über die API kostet GLM-4.5 0,60 $ pro 1 Mio. Input-Token und 2,20 $ pro 1 Mio. Output-Token. Bei Reasoning-Modellen kommen Thinking-Tokens hinzu, die als Output abgerechnet werden.

Wie groß ist das Kontextfenster von GLM-4.5?

GLM-4.5 verarbeitet bis zu 131,07k Token in einer Anfrage.

Wie aktuell ist das Wissen von GLM-4.5?

Der Wissensstand (Knowledge Cutoff) von GLM-4.5 reicht bis Oktober 2023. Über die integrierte Websuche kann das Modell zusätzlich aktuelle Informationen abrufen.