Gemini 2.5 Flash
Gemini 2.5 Flash Modell-Übersicht
Gemini 2.5 Flash ist das mittlere LLM aus der Gemini 2.5 Modellfamilie. 2.5 Flash ist ein hybrides Thinking-Modell auf Basis einer MoE Transformer-Architektur. Das Modell eignet sich durch ein hervorragendes Preis-Leistungs-Verhältnis für ein breites Spektrum an Aufgaben.
Features & Modalitäten
Gemini 2.5 Flash Benchmark Scores
Technologie & Daten
Technische Spezifikationen
| Architektur | Hybrider MoE-Transformer |
|---|---|
| Input Kontextlänge | 1,05 Mio. |
| Output Kontextlänge | 65,54k |
| Tokenizer | SentencePiece-Unigram-Tokenizer |
Besonderheiten
| Besonderheit 1 | Adaptive Thinking |
|---|---|
| Besonderheit 2 | Tool-Use Kapazitäten |
| Besonderheit 3 | Großes Kontextfenster |
Vorteile & Nachteile
Vorteile
- Extrem großes KontextfensterMit bis zu 1 Mio. Tokens kann Gemini 2.5 Flash ganze Codebasen oder Bücher als Input verarbeiten.
- Günstige PreiseIm Gegensatz zu Gemini 2.5 Pro werden die Kosten bei größeren Kontextfenstern für Gemini 2.5 Flash nicht erhöht.
- Unterstützt viele ModalitätenNeben Text- und Bildeingaben kann Gemini 2.5 Flash auch Audio- und Video-Input nativ im selben Modell verarbeiten.
- Flexibles ReasoningDas hybride Reasoning-LLM lässt sich stufenweise konfigurieren, sodass hochkomplexe Aufgaben genauso sorgfältig bearbeitet werden, wie kleinere Tasks schnell umgesetzt werden können.
- Hohe GeschwindigkeitGemini 2.5 Flash bietet selbst mit aktiviertem "Thinking" einen hohen Token-Throughput von ca. 100 Token pro Sekunde.
Nachteile
- Geringer OutputMit nur 64k Token ist die Länge des Outputs in Gemini 2.5 Flash deutlich eingeschränkt.
- API für Entwickler unübersichtlichDie Einrichtung sowie der Zugriff auf API-Schnittstellen ist bei Google deutlich umständlicher, als bei anderen LLM-Entwicklern.
Vergleiche Gemini 2.5 Flash mit anderen LLMs
Vergleiche Gemini 2.5 Flash mit anderen Sprachmodellen anhand wichtiger Metriken wie Kontextgröße, Preisen und Benchmark-Leistung.
Gemini 2.5 Flash ausprobieren
Du musst kein Entwickler sein: Gemini 2.5 Flash ist auch direkt in Gemini nutzbar.
Provider & APIs
Du kannst Google DeepMind Gemini 2.5 Flash über die API folgender Anbieter nutzen.
Das Modell ist derzeit bei keinen Anbietern verfügbar.
Häufige Fragen zu Gemini 2.5 Flash
Kann ich Gemini 2.5 Flash kostenlos nutzen?
Ja, Gemini 2.5 Flash ist in Gemini auch mit einem kostenlosen Konto nutzbar — allerdings meist mit Nutzungslimits.
Ist Gemini 2.5 Flash Open Source?
Nein, Gemini 2.5 Flash ist proprietär. Es gibt keine offenen Gewichte, die Nutzung läuft über Apps oder die API von Google DeepMind.
Welche Eingabeformate versteht Gemini 2.5 Flash?
Gemini 2.5 Flash verarbeitet folgende Eingabeformate: Text, Bild, Audio, Video, PDF.
Was kostet Gemini 2.5 Flash über die API?
Über die API kostet Gemini 2.5 Flash 0,30 $ pro 1 Mio. Input-Token und 2,50 $ pro 1 Mio. Output-Token. Bei Reasoning-Modellen kommen Thinking-Tokens hinzu, die als Output abgerechnet werden.
Wie groß ist das Kontextfenster von Gemini 2.5 Flash?
Gemini 2.5 Flash verarbeitet bis zu 1,05 Mio. Token in einer Anfrage.
Wie aktuell ist das Wissen von Gemini 2.5 Flash?
Der Wissensstand (Knowledge Cutoff) von Gemini 2.5 Flash reicht bis Januar 2025. Über die integrierte Websuche kann das Modell zusätzlich aktuelle Informationen abrufen.
Was ist der Vorgänger von Gemini 2.5 Flash?
Der direkte Vorgänger von Gemini 2.5 Flash ist Gemini Diffusion (erschienen Mai 2025). Einen tabellarischen Vergleich der beiden Modelle findest du auf dieser Seite im Abschnitt „Vergleiche“.