Alle AI-Trends
Direkt in dein Postfach
Erhalte exklusive AI-Tutorials, Praxistipps und KI-News direkt in dein Postfach.
*Mit deiner Anmeldung akzeptierst du unsere Datenschutzrichtlinien.
Jetzt neu: Byte Pulse – Token-Limits von Claude Code, Codex & Co. tracken! 

Fugu Ultra

Veröffentlichung
Juni 2026
Kontextfenster
1 Mio. Token
API-Preis In / Out
5,00 $ / 30,00 $
Parameter
7 Mrd.
Daten aktualisiert: 22. Juni 2026

Fugu Ultra Modell-Übersicht

Fugu Ultra ist die leistungsorientierte Variante von Sakana Fugu, einem LLM-Orchestrierungs-Systems von Sakana AI. Fugu Ultra ist selbst kein Frontier-Modell sondern eher ein kleines LLM mit rund 7 Mrd. Parameter, das einen Pool externer Modelle als Agenten ansteuert, Aufgaben delegiert, Ergebnisse verifiziert und zusammenführt. Je nach Schwierigkeit routet der Orchestrierungs-Agent zwischen einem und drei Sub-Agenten, was die Qualität erhöhen, aber sich auch spürbar auf Kosten und Latenz auswirkt. Laut Sakana AI selbst liegt das System auf Augenhöhe mit Fable 5, Mythos Preview, Opus 4.8 und Gemini 3.1 Pro. Auf subjektiver Basis berichteten aber bereits am Tag der Veröffentlichung viele User, dass sie vom Output nicht überzeugt bzw. enttäuscht waren. Für schnellere, günstigere Anfragen wurde ein Schwestermodell Fugu (ohne Ultra) veröffentlicht.

Features & Modalitäten

Nicht verfügbar
QuellenangabenFinetuning
Verfügbar
ReasoningToolsMultimodalitätWebsucheStrukturierte Ausgaben
Input:TextBild
Output:Text

Features & Modalitäten

Reasoning, Tool-Nutzung und strukturierte Ausgaben gehören 2026 zum Standard aktueller LLMs. Interessant wird es bei Abweichungen und die unterstützten Modalitäten.

Fähigkeiten mit grünem Haken sind verfügbar, rot markierte fehlen dem Modell. Details zu jeder Fähigkeit kannst du über das jeweilige Info-Symbol einsehen.

Details zum Modell

Max. Input
1 Mio. Token
Max. Output
1 Mio. Token
Input-Preis / 1M Token
5,00 $
Output-Preis / 1M Token
30,00 $
Parameter
7 Mrd.

API-Preise einordnen

Eine typische Antwort (ca. 1.000 Wörter, kurzer Prompt) kostet über die API rund 0,042 $.

Als Reasoning-Modell erzeugt es zusätzlich Thinking-Tokens, die als Output abgerechnet werden. Die realen Kosten liegen je nach Aufgabe deutlich darüber.

Dein eigenes Nutzungsprofil kannst du mit dem Kosten-Rechner, den wir unter der Tabelle verlinkt haben, berechnen.

Fugu Ultra Benchmark Scores



Benchmarks & Performance

Im KI-Kontext bezeichnet Performance die Leistungsfähigkeit eines Modells in Bereichen wie Sprachverständnis, Logik oder Programmierung, gemessen anhand standardisierter Benchmarks für eine objektive Vergleichbarkeit.

Achte beim Vergleichen darauf, ob die LLMs Tools oder mehrere Durchläufe („Pass@k“) nutzen durften. Benchmark Scores lassen sich untereinander nur vergleichen, wenn sie der gleichen Methodik zugrunde liegen.

Technologie & Daten

Technische Spezifikationen

ArchitekturOrchestrator LLM
Input Kontextlänge1 Mio.
Output Kontextlänge1 Mio.
Tokenizerunbekannt

Besonderheiten

Gelernte OrchestrierungEntscheidet selbst, ob eine Anfrage direkt beantwortet oder an mehrere Spezialmodelle delegiert wird.
Rekursiver Agenten-Pool1-3 Agenten
Integrierte Web-SucheBuilt-in web_search-Tool
Steuerbares Reasoning-Budgethigh, xhigh, max
API-KompatibilitätOpenAI-kompatibel

Vorteile & Nachteile

Vorteile

  • Frontier-Niveau ohne eigenes Frontier-Modell
    Statt ein riesiges Modell zu trainieren, orchestriert ein ~7B-Modell fremde Spitzenmodelle. Sakana AI gibt an, dass das System über Fugu-Ultra in Benchmarks wie GPQA-Diamond und LiveCodeBench v6 auf Augenhöhe mit Fable 5, Opus 4.8 und Gemini 3.1 Pro steht.
  • Sehr großes multimodales Kontextfenster
    1 Mio. Token Kontext und Bild-Eingabe (Vision) decken lange Dokumente, Codebases und multimodale Aufgaben ab.
  • KI-Agenten out-of-the-Box
    Tool-Calls, integrierte Web-Suche, strukturierte JSON-Ausgabe und steuerbares Reasoning sind ohne eigene Orchestrierungs-Logik nutzbar.

Nachteile

  • Teuer, besonders bei langem Kontext
    Mit $5,00 / $30,00 pro 1 Mio. Input-/Output-Token liegt Ultra deutlich über dem günstigeren Schwestermodell Fugu; ab >272K Token verdoppeln sich die Preise sogar auf $10,00 / $45,00.
  • Intransparenter Agenten-Pool
    Sakana legt nicht offen, welche Fremdmodelle Fugu im Hintergrund ansteuert. Das erschwert Reproduzierbarkeit, Datenschutz-Bewertung und schafft eine Abhängigkeit von Drittanbieter-Modellen.
  • Latenz und Variabilität durch Delegation
    Das extra Routen an Sub-Agenten und mehrere zugehörige Verifikationsschritte kosten sehr viel Zeit. Ultra ist explizit auf Qualität statt Geschwindigkeit ausgelegt, die interaktive Nutzung macht deswegen eher weniger Spaß.
  • Bislang keine unabhängigen Tests
    Nahezu alle Benchmark-Zahlen stammen vom Entwickler selbst und sind bislang kaum unabhängig verifiziert. Das Feedback der AI-Community war eher gemischt.

Vergleiche Fugu Ultra mit anderen LLMs

Vergleiche Fugu Ultra mit anderen Sprachmodellen anhand wichtiger Metriken wie Kontextgröße, Preisen und Benchmark-Leistung.


Alle Modelle vergleichen

Fugu Ultra ausprobieren

Du musst kein Entwickler sein: Fugu Ultra ist auch direkt in Sakana Chat nutzbar.

App
Sakana Chat
Kostenlose Nutzung
Nein
Pro-Abo / Monat
20,00 $
Deine Daten
Opt-out möglich

Provider & APIs

Du kannst Sakana AI Fugu Ultra über die API folgender Anbieter nutzen.

Das Modell ist derzeit bei keinen Anbietern verfügbar.

Häufige Fragen zu Fugu Ultra

Kann ich Fugu Ultra kostenlos nutzen?

Nein, für Fugu Ultra benötigst du in Sakana Chat ein kostenpflichtiges Abo oder Zugang über die API.

Ist Fugu Ultra Open Source?

Nein, Fugu Ultra ist proprietär. Es gibt keine offenen Gewichte, die Nutzung läuft über Apps oder die API von Sakana AI.

Welche Eingabeformate versteht Fugu Ultra?

Fugu Ultra verarbeitet folgende Eingabeformate: Text, Bild.

Was kostet Fugu Ultra über die API?

Über die API kostet Fugu Ultra 5,00 $ pro 1 Mio. Input-Token und 30,00 $ pro 1 Mio. Output-Token. Bei Reasoning-Modellen kommen Thinking-Tokens hinzu, die als Output abgerechnet werden.

Wie groß ist das Kontextfenster von Fugu Ultra?

Fugu Ultra verarbeitet bis zu 1 Mio. Token in einer Anfrage.