Hy3
Hy3 Modell-Übersicht
Hy3 ist die dritte Generation der Hunyuan-Modelle von Tencent und seit dem 6. Juli 2026 als Open Weights Modell unter Apache 2.0 verfügbar. Technisch ist Hy3 ein Mixture-of-Experts-Modell (MoE) mit 295 Mrd. Gesamtparametern, von denen pro Token 21 Mrd. aktiv sind. Dazu kommen ein natives 256K-Kontextfenster und drei umschaltbare Reasoning-Modi (no_think, low, high). Der Fokus liegt auf agentischen Coding- und Tool-Use-Aufgaben. Mit $0,14 / $0,58 pro 1 Mio. Input-/Output-Token ist Hy3 sehr günstig und tritt damit in derselben Gewichtsklasse an wie DeepSeek V4 Flash 0731 (284 Mrd. Parameter, $0,14 / $0,28), das allerdings mit 1 Mio. Token Kontext und dem halben Output-Preis daherkommt. Nach unserer Einschätzung ist Hy3 vor allem für kostensensible, langlaufende Agenten-Workflows interessant. Die starken Benchmark-Werte (u. a. 90,4 % in GPQA Diamond) stammen bislang aber ausschließlich aus Tencents eigener Model Card.
Features & Modalitäten
Hy3 Benchmark Scores
Technologie & Daten
Technische Spezifikationen
| Architektur | Sparse MoE-Transformer |
|---|---|
| Input Kontextlänge | 262,14k |
| Output Kontextlänge | 262,14k |
| Tokenizer | Tokenizer mit 120.832 Token Vokabular |
Besonderheiten
| Drei Reasoning-Modi | no_think (direkte Antwort), low (schnelles Denken) und high (tiefes Chain-of-Thought). |
|---|---|
| Multi-Token Prediction (MTP) | Separate 3,8-Mrd.-Parameter-Schicht zur parallelen Vorhersage mehrerer Token. |
| Agentic Tool-Calling | Tool-Call-Parsing mit Auto-Tool-Choice für zuverlässige Function-Calls. |
Vorteile & Nachteile
Vorteile
- Apache-2.0-LizenzHy3 ist vollständig mit Open Weights (BF16 und FP8) auf Hugging Face veröffentlicht und lässt sich kommerziell nutzen, finetunen und selbst hosten.
- Sehr günstiges PricingMit $0,14 / $0,58 pro 1 Mio. Input-/Output-Token liegt Hy3 weit unter westlichen Flaggschiffen und eignet sich damit für hochfrequente, langlaufende Agenten-Workflows.
- Effiziente MoE-ArchitekturVon den 295 Mrd. Parametern werden pro Token nur 21 Mrd. aktiviert (192 Experten, Top-8). Das hält die Inferenzkosten niedrig, ohne die Modellkapazität zu beschneiden.
- Flexible Reasoning-KontrolleDie drei Modi no_think, low und high erlauben es, Reasoning-Tiefe und Kosten pro Anfrage gezielt zu steuern.
Nachteile
- Nur Text, keine MultimodalitätHy3 verarbeitet ausschließlich Text. Bild-, Audio- oder Video-Eingaben werden laut Model Card nicht unterstützt.
- Hoher Hardware-Bedarf beim Self-HostingDie BF16-Gewichte umfassen rund 598 GB (FP8: ca. 300 GB), Tencent empfiehlt etwa 8 GPUs wie die H20-3e. Lokaler Betrieb ist damit nur mit Datacenter-Hardware realistisch.
- Benchmark Scores noch unbelegtWerte wie 90,4 % in GPQA Diamond oder 78 % in SWE-bench Verified stammen aus Tencents eigener Model Card. Unabhängige Tests zu Latenz, Tool-Use und Zuverlässigkeit stehen noch aus.
- Kleineres Kontextfenster als die KonkurrenzMit 256K Token bietet Hy3 nur ein Viertel des Kontexts von DeepSeek V4 Flash oder Qwen 3.8 Max (je 1 Mio. Token).
Vergleiche Hy3 mit anderen LLMs
Vergleiche Hy3 mit anderen Sprachmodellen anhand wichtiger Metriken wie Kontextgröße, Preisen und Benchmark-Leistung.
Hy3 ausprobieren
Du musst kein Entwickler sein: Hy3 ist auch direkt in Tencent Yuanbao nutzbar.
Provider & APIs
Du kannst Tencent Hy3 über die API folgender Anbieter nutzen.
Häufige Fragen zu Hy3
Kann ich Hy3 kostenlos nutzen?
Ja, Hy3 ist in Tencent Yuanbao auch mit einem kostenlosen Konto nutzbar — allerdings meist mit Nutzungslimits.
Ist Hy3 Open Source?
Hy3 wird unter der Lizenz „Apache 2.0“ veröffentlicht. Details stehen in den Lizenzbedingungen des Anbieters.
Welche Eingabeformate versteht Hy3?
Hy3 verarbeitet folgende Eingabeformate: Text.
Was kostet Hy3 über die API?
Über die API kostet Hy3 0,14 $ pro 1 Mio. Input-Token und 0,58 $ pro 1 Mio. Output-Token. Bei Reasoning-Modellen kommen Thinking-Tokens hinzu, die als Output abgerechnet werden.
Wie groß ist das Kontextfenster von Hy3?
Hy3 verarbeitet bis zu 262,14k Token in einer Anfrage.