Qwen3.8 27B
Qwen3.8 27B Modell-Übersicht
Qwen3.8 27B ist ein dichtes Vision-Language-Modell aus Alibabas Qwen-3.8-Reihe, veröffentlicht am 14. August 2026 als Open Weights Modell unter Apache 2.0. Anders als die großen MoE-Geschwister der 3.8-Generation, allen voran Qwen 3.8 Max, zielt es bewusst auf die lokale Ausführung: Die 27 Mrd. Parameter passen in BF16 bzw. FP8 auf eine einzelne GPU mit rund 24 GB VRAM. Das Modell versteht Text, Bilder und laut Alibaba sogar stundenlange Videos und bringt einen pro Request steuerbaren Thinking-Modus mit. Laut Anbieter übertrifft es das ältere und größere Qwen 3.7 Plus bei Coding- und Office-Aufgaben. Damit tritt Qwen3.8 27B direkt gegen Gemma 4 31B und Muse Glimmer 30B an. Die Klasse der lokal lauffähigen 30B-Modelle wird damit innerhalb weniger Wochen spürbar enger, was für Nutzer mit eigener Hardware eine gute Nachricht ist.
Features & Modalitäten
Qwen3.8 27B Benchmark Scores
Technologie & Daten
Technische Spezifikationen
| Architektur | Dense Transformer mit Vision-Encoder |
|---|---|
| Input Kontextlänge | 262,14k |
| Output Kontextlänge | 262,13k |
| Tokenizer | Byte-level BPE-Tokenizer der Qwen-Familie |
Besonderheiten
| Flexible Thinking Control | Thinking-Modus standardmäßig aktiv, pro Request abschaltbar. |
|---|---|
| Preserved Thinking | Behält Reasoning-Blöcke über den Verlauf einer Konversation bei. |
| Native Vision & Video | Versteht Bilder, Diagramme, Dokumente und stundenlange Videos. |
Vorteile & Nachteile
Vorteile
- Läuft lokal auf einer Consumer-GPUMit 27 Mrd. Parametern in BF16 bzw. FP8 zielt das Modell auf Hardware mit rund 24 GB VRAM. Unterstützt werden u. a. vLLM, SGLang, LM Studio und Ollama.
- Apache-2.0-LizenzDie Gewichte stehen auf Hugging Face und ModelScope unter Apache 2.0 bereit und lassen sich kommerziell nutzen und finetunen.
- Multimodal inklusive VideoAls natives Vision-Language-Modell verarbeitet es Text, Bilder und stundenlange Videos. Diese Modalität decken viele Modelle dieser Klasse nicht ab.
- Großes Kontextfenster262K Token nativ und per YaRN bis zu 1 Mio. Token, deutlich mehr als bei vielen lokal lauffähigen Modellen dieser Größe.
- Steuerbares ReasoningThinking lässt sich pro Request abschalten und über reasoning_effort (low/medium/xhigh) dosieren, was Latenz und Kosten für einfache Anfragen senkt.
Nachteile
- Kein offizieller API-PreisEin gehosteter Qwen-Cloud-Dienst war zum Release nur angekündigt. Wer nicht selbst hostet, ist auf Drittanbieter wie OpenRouter (ca. $0,45 / $3,20 pro 1 Mio. Input-/Output-Token) angewiesen.
- Viele Kennzahlen nicht dokumentiertKnowledge Cutoff, Vokabulargröße und Trainingsdatenvolumen nennt Alibaba nicht. Die Benchmark-Angaben stammen bislang überwiegend aus Sekundärquellen.
- Sehr junges ModellErst seit dem 14. August 2026 verfügbar, belastbares Langzeit-Feedback aus der Community fehlt noch.
Vergleiche Qwen3.8 27B mit anderen LLMs
Vergleiche Qwen3.8 27B mit anderen Sprachmodellen anhand wichtiger Metriken wie Kontextgröße, Preisen und Benchmark-Leistung.
Qwen3.8 27B ausprobieren
Qwen3.8 27B hat offene Gewichte: Du kannst das Modell herunterladen und selbst hosten — oder es bei einem der API-Provider unten nutzen.
Provider & APIs
Du kannst Alibaba Qwen3.8 27B über die API folgender Anbieter nutzen.
Das Modell ist derzeit bei keinen Anbietern verfügbar.
Häufige Fragen zu Qwen3.8 27B
Ist Qwen3.8 27B Open Source?
Qwen3.8 27B wird unter der Lizenz „Apache 2.0“ veröffentlicht. Details stehen in den Lizenzbedingungen des Anbieters.
Welche Eingabeformate versteht Qwen3.8 27B?
Qwen3.8 27B verarbeitet folgende Eingabeformate: Text, Bild, Video.
Was kostet Qwen3.8 27B über die API?
Über die API kostet Qwen3.8 27B 0,45 $ pro 1 Mio. Input-Token und 3,20 $ pro 1 Mio. Output-Token. Bei Reasoning-Modellen kommen Thinking-Tokens hinzu, die als Output abgerechnet werden.
Wie groß ist das Kontextfenster von Qwen3.8 27B?
Qwen3.8 27B verarbeitet bis zu 262,14k Token in einer Anfrage.
Was ist der Vorgänger von Qwen3.8 27B?
Der direkte Vorgänger von Qwen3.8 27B ist Qwen3.8 2.4T A95B (erschienen August 2026). Einen tabellarischen Vergleich der beiden Modelle findest du auf dieser Seite im Abschnitt „Vergleiche“.