Alle AI-Trends
Direkt in dein Postfach
Erhalte exklusive AI-Tutorials, Praxistipps und KI-News direkt in dein Postfach.
*Mit deiner Anmeldung akzeptierst du unsere Datenschutzrichtlinien.
Jetzt neu: Byte Pulse – Token-Limits von Claude Code, Codex & Co. tracken! 

Qwen 3.8 Max

Veröffentlichung
August 2026Neu
Kontextfenster
1 Mio. Token
API-Preis In / Out
2,00 $ / 6,00 $
Parameter
2.400 Mrd.
Daten aktualisiert: 3. August 2026

Qwen 3.8 Max Modell-Übersicht

Qwen 3.8 Max ist das neueste Flaggschiff von Alibaba und Nachfolger von Qwen 3.7 Max. Es ist ein Sparse-Mixture-of-Experts-Modell (MoE) mit 2,4 Billionen Parametern, von denen 95 Mrd. pro Token-Inferenz aktiviert werden. Neu gegenüber dem Vorgänger ist native visuelle Verarbeitung (Text, Bild, Video, Dokumente) im Billionen-Parameter-Bereich sowie der Post-Training-Fokus auf langen, Coding-Aufgaben als KI-Agent. Alibaba stuft Qwen 3.8 Max selbstebewusst hinter Anthropics Fable 5 auf Platz zwei ein. Wir gehen aber von einem subjektiven Empfinden aus, dass Modelle wie GPT-5.6 Sol (max) noch einmal intelligenter sein werden, als Qwen 3.8. Die Open Weights von Qwen 3.8 max hat Alibaba für die Woche nach Veröffentlichung des Modells angekündigt.

Features & Modalitäten

Verfügbar
ReasoningToolsMultimodalitätWebsucheStrukturierte AusgabenQuellenangabenFinetuning
Input:TextBildVideo
Output:TextJson

Features & Modalitäten

Reasoning, Tool-Nutzung und strukturierte Ausgaben gehören 2026 zum Standard aktueller LLMs. Interessant wird es bei Abweichungen und die unterstützten Modalitäten.

Fähigkeiten mit grünem Haken sind verfügbar, rot markierte fehlen dem Modell. Details zu jeder Fähigkeit kannst du über das jeweilige Info-Symbol einsehen.

Details zum Modell

Max. Input
1 Mio. Token
Max. Output
128k Token
Input-Preis / 1M Token
2,00 $
Output-Preis / 1M Token
6,00 $
Parameter
2.400 Mrd.

API-Preise einordnen

Eine typische Antwort (ca. 1.000 Wörter, kurzer Prompt) kostet über die API rund 0,0088 $.

Als Reasoning-Modell erzeugt es zusätzlich Thinking-Tokens, die als Output abgerechnet werden. Die realen Kosten liegen je nach Aufgabe deutlich darüber.

Dein eigenes Nutzungsprofil kannst du mit dem Kosten-Rechner, den wir unter der Tabelle verlinkt haben, berechnen.

Qwen 3.8 Max Benchmark Scores



Benchmarks & Performance

Im KI-Kontext bezeichnet Performance die Leistungsfähigkeit eines Modells in Bereichen wie Sprachverständnis, Logik oder Programmierung, gemessen anhand standardisierter Benchmarks für eine objektive Vergleichbarkeit.

Achte beim Vergleichen darauf, ob die LLMs Tools oder mehrere Durchläufe („Pass@k“) nutzen durften. Benchmark Scores lassen sich untereinander nur vergleichen, wenn sie der gleichen Methodik zugrunde liegen.

Technologie & Daten

Technische Spezifikationen

ArchitekturSparse MoE-Transformer
Input Kontextlänge1 Mio.
Output Kontextlänge128k
TokenizerUnbekannt

Besonderheiten

Native VisionVerarbeitet Bild, Video und Dokumente nativ im selben Modell.
Tool-Use & Structured OutputUnterstützt Function Calling und strukturierte JSON-Ausgaben.

Vorteile & Nachteile

Vorteile

  • Starke Benchmark Scores
    Wenn sich die Benchmark-Ergebnisse von Qwen 3.8 max bestätigen, dann erreicht es die Intelligenz von Claude Opus 4.8, nur 3 Monate nach dessen Veröffentlichung. Open Weights Modelle können weiterhin innerhalb kürzester Zeit zu den proprietären Frontier-Modellen aufschließen.
  • Sehr großes Kontextfenster
    Mit rund 1 Mio. Token Kontextfenster kann Qwen 3.8 max sehr lange Inputs, wie ultralange Dokumente oder ganze Codebases in einem Durchgang verarbeiten.
  • Günstiges Pricing für Flaggschiff-Modell
    Mit $2,00 / $6,00 pro 1 Mio. Input-/Output-Token liegt Qwen 3.8 max deutlich unter den Pricing des vergleichbaren Opus 4.8 ($5,00 / $25,00).
  • Multimodal im Billionen-Bereich
    Erstes Qwen-Modell, das mit über einer Billion Parameter nativer auch andere Modalitäten außer Text verarbeiten kann. Dies dürfte in einer höheren Qualität in der Verarbeitung von Bildern, Videos und Audio resultieren.

Nachteile

  • Benchmark Scores noch unbelegt
    Eine Bestätigung der Benchmark-Ergebnisse. inkl. subjektivem Empfinden, steht noch aus.
  • Kein Technical Report
    Die Veröffentlichung eines technischen Reports / einer Model Cards und den Open Weights steht noch aus.

Vergleiche Qwen 3.8 Max mit anderen LLMs

Vergleiche Qwen 3.8 Max mit anderen Sprachmodellen anhand wichtiger Metriken wie Kontextgröße, Preisen und Benchmark-Leistung.


Alle Modelle vergleichen

Provider & APIs

Du kannst Alibaba Qwen 3.8 Max über die API folgender Anbieter nutzen.

Das Modell ist derzeit bei keinen Anbietern verfügbar.

Häufige Fragen zu Qwen 3.8 Max

Ist Qwen 3.8 Max Open Source?

Nein, Qwen 3.8 Max ist proprietär. Es gibt keine offenen Gewichte, die Nutzung läuft über Apps oder die API von Alibaba.

Welche Eingabeformate versteht Qwen 3.8 Max?

Qwen 3.8 Max verarbeitet folgende Eingabeformate: Text, Bild, Video.

Was kostet Qwen 3.8 Max über die API?

Über die API kostet Qwen 3.8 Max 2,00 $ pro 1 Mio. Input-Token und 6,00 $ pro 1 Mio. Output-Token. Bei Reasoning-Modellen kommen Thinking-Tokens hinzu, die als Output abgerechnet werden.

Wie groß ist das Kontextfenster von Qwen 3.8 Max?

Qwen 3.8 Max verarbeitet bis zu 1 Mio. Token in einer Anfrage.