Alle AI-Trends
Direkt in dein Postfach
Erhalte exklusive AI-Tutorials, Praxistipps und KI-News direkt in dein Postfach.
*Mit deiner Anmeldung akzeptierst du unsere Datenschutzrichtlinien.
Jetzt neu: Byte Pulse – Token-Limits von Claude Code, Codex & Co. tracken! 

MiniMax-M2.5

Veröffentlichung
Februar 2026
Kontextfenster
204,8k Token
API-Preis In / Out
0,30 $ / 1,20 $
Parameter
230 Mrd.
Daten aktualisiert: 15. Juni 2026

MiniMax-M2.5 Modell-Übersicht

MiniMax M2.5 ist das neueste Flaggschiff-Modell von MiniMax (Hailuo AI), das speziell für Workflows von KI-Agenten und Coding-Aufgaben entwickelt wurde. M2.5 ist der Nachfolger von MiniMax-M2.1 und wurde nativ auf das Tool-Calling trainiert. Im Gegensatz zum zeitgleich veröffentlichten GLM-5 kommt MiniMax-M2.5 mit nur 10B aktiven Parametern aus einer 230B MoE-Architektur aus. Damit ist erreicht es vergleichbare Leistung zu GLM-5 und ist deutlich günstiger als Proprietäre Modelle wie Claude Opus 4.6.

Features & Modalitäten

Verfügbar
ReasoningToolsMultimodalitätWebsucheStrukturierte AusgabenQuellenangabenFinetuning
Input:TextBild
Output:TextJson

Features & Modalitäten

Reasoning, Tool-Nutzung und strukturierte Ausgaben gehören 2026 zum Standard aktueller LLMs. Interessant wird es bei Abweichungen und die unterstützten Modalitäten.

Fähigkeiten mit grünem Haken sind verfügbar, rot markierte fehlen dem Modell. Details zu jeder Fähigkeit kannst du über das jeweilige Info-Symbol einsehen.

Details zum Modell

Max. Input
204,8k Token
Max. Output
131,07k Token
Input-Preis / 1M Token
0,30 $
Output-Preis / 1M Token
1,20 $
Parameter
230 Mrd.
Dateigröße
214,33 GB

API-Preise einordnen

Eine typische Antwort (ca. 1.000 Wörter, kurzer Prompt) kostet über die API rund 0,0017 $.

Als Reasoning-Modell erzeugt es zusätzlich Thinking-Tokens, die als Output abgerechnet werden. Die realen Kosten liegen je nach Aufgabe deutlich darüber.

Dein eigenes Nutzungsprofil kannst du mit dem Kosten-Rechner, den wir unter der Tabelle verlinkt haben, berechnen.

MiniMax-M2.5 Benchmark Scores



Benchmarks & Performance

Im KI-Kontext bezeichnet Performance die Leistungsfähigkeit eines Modells in Bereichen wie Sprachverständnis, Logik oder Programmierung, gemessen anhand standardisierter Benchmarks für eine objektive Vergleichbarkeit.

Achte beim Vergleichen darauf, ob die LLMs Tools oder mehrere Durchläufe („Pass@k“) nutzen durften. Benchmark Scores lassen sich untereinander nur vergleichen, wenn sie der gleichen Methodik zugrunde liegen.

Technologie & Daten

Technische Spezifikationen

ArchitekturSparse MoE-Transformer
Input Kontextlänge204,8k
Output Kontextlänge131,07k
TokenizerMiniMax Tokenizer

Besonderheiten

Forge RL FrameworkAgent-natives Reinforcement-Learning-Framework
Lightning-VarianteModellvariante mit doppeltem Throughput (100 TPS statt 50 TPS)
Sichtbares ThinkingThinking-Tokens in transparent einsehbar
Office-UnterstützungMiniMax 2.5 kann MS Office Dateien erstellen und bearbeiten
Expert CustomizationFramework für benutzerdefinierte Experten mit bereits über 10.000 erstellten Expert-Konfigurationen.

Vorteile & Nachteile

Vorteile

  • Sehr gutes Preis-Leistungs-Verhältnis
    MiniMax-M2.5 erreicht eine Vergleichbare Leistung von proprietären Modellen wie Claude Opus 4.6 oder GPT-5.3-Codex, bei nur 1/10 bis 1/20 der Kosten.
  • Stark in Tool-Calling Benchmarks
    MiniMax-M2.5 erreicht 76.8% im BFCL Multi-Turn Benchmark und liegt damit 13 Prozentpunkte vor Claude Opus 4.6. M2.5 erledigte Multi-Step-Tasks in 20% weniger Durchläufen.
  • Starkes Coding-LLM
    Gemeinsam mit GLM-5 führt MiniMax-M2.5 die Coding-Benchmarks der Open-Source Modelle an. Beide Modelle erreichen nahezu die Ergebnisse der proprietären US-Modelle.
  • Open Weights mit MIT-Lizenz
    MiniMax-M2.5 ist vollständig open-source und die Gewichte lassen sich auf HuggingFace lokal herunterladen, sodass du das Modell (mit passender Hardware) offline auf deinem PC-System ausführen kannst.
  • Hoher Durchsatz
    M2.5 erreicht über die Standard-API 50 TPS, bzw. 100 TPS über die teurere "Lightning-API", was durch die reduzierte Anzahl an aktiven Parametern erreicht wird. M2.5 hat damit einen ca. 3x höheren Throughput als Opus 4.6.

Nachteile

  • Hohe Hardware-Anforderungen für lokales Deployment
    Auch wenn MiniMax-M2.5 deutlich kleiner als GLM-5 ist, werden für das lokale Betreiben des 230B-Parameter-Modells mehrere High-End-GPUs benötigt.
  • Politischer Bias
    Wie bei anderen Modellen chinesischer LLM-Entwickler muss davon ausgegangen werden, dass politische Einflüsse in die Antworten mit einfließen.

Vergleiche MiniMax-M2.5 mit anderen LLMs

Vergleiche MiniMax-M2.5 mit anderen Sprachmodellen anhand wichtiger Metriken wie Kontextgröße, Preisen und Benchmark-Leistung.


Alle Modelle vergleichen

MiniMax-M2.5 ausprobieren

Du musst kein Entwickler sein: MiniMax-M2.5 ist auch direkt in MiniMax Code nutzbar.

App
MiniMax Code
Kostenlose Nutzung
Ja
Pro-Abo / Monat
20,00 $

Provider & APIs

Du kannst MiniMax MiniMax-M2.5 über die API folgender Anbieter nutzen.

Das Modell ist derzeit bei keinen Anbietern verfügbar.

Häufige Fragen zu MiniMax-M2.5

Kann ich MiniMax-M2.5 kostenlos nutzen?

Ja, MiniMax-M2.5 ist in MiniMax Code auch mit einem kostenlosen Konto nutzbar — allerdings meist mit Nutzungslimits.

Ist MiniMax-M2.5 Open Source?

MiniMax-M2.5 wird unter der Lizenz „MIT“ veröffentlicht. Details stehen in den Lizenzbedingungen des Anbieters.

Welche Eingabeformate versteht MiniMax-M2.5?

MiniMax-M2.5 verarbeitet folgende Eingabeformate: Text, Bild.

Was kostet MiniMax-M2.5 über die API?

Über die API kostet MiniMax-M2.5 0,30 $ pro 1 Mio. Input-Token und 1,20 $ pro 1 Mio. Output-Token. Bei Reasoning-Modellen kommen Thinking-Tokens hinzu, die als Output abgerechnet werden.

Wie groß ist das Kontextfenster von MiniMax-M2.5?

MiniMax-M2.5 verarbeitet bis zu 204,8k Token in einer Anfrage.

Was ist der Vorgänger von MiniMax-M2.5?

Der direkte Vorgänger von MiniMax-M2.5 ist MiniMax-M2.1 (erschienen Dezember 2025). Einen tabellarischen Vergleich der beiden Modelle findest du auf dieser Seite im Abschnitt „Vergleiche“.