OrcaRouter: Fusion Mini

orcarouter/fusion-mini
Mini
Text-Eingabe · Text-Ausgabe · 1M ctx

Fable 5 wurde eingestellt. Fusion baut dieses Niveau neu auf — aus den Modellen, die Sie noch aufrufen können, zu einem Bruchteil der Kosten.

Übersicht

Warten Sie nicht auf das nächste Modell — der nächste Fähigkeitssprung kommt von einem Panel, nicht von einem Checkpoint. Fusion schickt Ihre schwierigsten Prompts an mehrere Spitzenmodelle gleichzeitig, dann wägt ein Bewerter ab, wo sie übereinstimmen, erkennt Widersprüche und gibt die stärkste einzelne Antwort zurück — gegen die übrigen gegengeprüft. Greifen Sie darauf bei der Arbeit zurück, die wirklich zählt — tiefes Denken, schwieriges Coding, Recherche, Experten-Review — überall, wo ein Fehler mehr kostet als ein paar zusätzliche Generierungen.

So funktioniert es

1

Nach Aufgabe routen

Lockerer Chat geht direkt an ein günstigeres Standardmodell. Coding-, Agenten- und werkzeugnutzende Anfragen fächern auf das Panel auf — dort, wo eine zweite Meinung sich wirklich auszahlt.

2

Auf ein Panel auffächern

Ihr Prompt erreicht mehrere Spitzenmodelle gleichzeitig — unabhängige Versuche, die jeweils auffangen, was die anderen übersehen.

3

Die beste Antwort wählen

Ein Bewerter liest jeden Kandidaten und gibt den stärksten einzelnen zurück — gegen die anderen gegengeprüft, nicht der erste Versuch eines einzelnen Modells.

Nur dort, wo es sich lohnt. Fusion verteilt Anfragen ans Panel bei Coding-, agentischen, werkzeugnutzenden und anspruchsvollen Aufgaben — einfache Unterhaltungen gehen direkt an eine günstigere Standardoption, sodass Sie das Panel nur bei den Anfragen bezahlen, bei denen eine zweite Meinung wirklich Mehrwert bringt.

Warum ein Panel ein einzelnes Modell übertrifft

Ein einzelnes Modell liefert Ihnen einen einzigen Versuch auf Ihre Anfrage — und keine Möglichkeit, Fehler zu erkennen. Fusion lässt mehrere führende Modelle gleichzeitig auf dieselbe Anfrage ansetzen; anschließend liest ein unabhängiger Bewerter jede Antwort und gibt die stärkste zurück, gegengeprüft mit den übrigen. Uneinigkeit zwischen starken Modellen ist ein Signal: Sie zeigt die schwierigen Fälle auf, bei denen ein einzelnes Modell stillschweigend falsch liegen würde.

Einzelnes Modell

Ein Modell, eine Antwort. Keine zweite Meinung — ist sie falsch, liefern Sie das Falsche aus.

Auto-Router

Wählt pro Anfrage ein Modell, um Kosten zu sparen. Klügere Auswahl — aber weiterhin nur eine Antwort.

Fusion

Ein Panel antwortet parallel; ein Bewerter gibt die stärkste Antwort zurück, gegengeprüft mit den übrigen.

Panel + Bewerter (Mixture-of-Agents)65.1%
Einzelnes Spitzenmodell (GPT-4o)57.5%
AlpacaEval 2.0 längenbereinigter Gewinnanteil — ein Modell-Panel mit Aggregator übertrifft ein einzelnes Spitzenmodell. Mixture-of-Agents, Wang et al. 2024

Modelle in diesem Router

ModellRolleKontext
Claude Opus 4.8Panel · Richter1M
GPT-5.5Panel1M

Möchten Sie eine andere Kombination? Erstellen Sie Ihr eigenes Panel aus den "Claude Fable 5 Level"-Vorlagen im Routing-DSL-Editor.

Basierend auf der Routing-DSL

Fusion ist kein Sonderfall — es ist eine integrierte Konfiguration unserer Routing-DSL, einer kleinen, isolierten Sprache zur genauen Definition des Routings jeder Anfrage. Klonen Sie die Vorlage „Fable 5 Level" und passen Sie Panel, Bewerter, die Steuerungsregel oder die Auswahl des Gewinners an.

Bestes von NFusion-Standard

Ein Bewertermodell ordnet alle Kandidaten und gibt den stärksten unverändert zurück — niemals eine verwässerte Zusammenfassung.

Mehrheitsentscheid

Das Panel stimmt über eine strukturierte Antwort ab — ohne zusätzlichen Bewerteraufruf.

Zusammenfassen

Ein Aggregatormodell vereint die Kandidaten zu einer verbesserten Antwort (Mixture-of-Agents).

Tests bestanden

Für Code: Der Kandidat, dessen Patch Ihr Test-Framework tatsächlich besteht, gewinnt.

Erster

Ein Wettlauf — das Segment mit der geringsten Latenz gewinnt, wenn Geschwindigkeit am meisten zählt.

Keine Black Box. Erstellen Sie Ihren eigenen Router auf der DSL, und jede Auffächerung wird aufgezeichnet — welche Modelle gegeneinander angetreten sind, die Latenz und der Status jedes Teilabschnitts sowie welche Antwort der Bewerter ausgewählt hat — sodass Sie in der Konsole genau nachvollziehen können, warum eine Antwort gewonnen hat.

Routing-DSL-Editor öffnen

Code-Beispiele

import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="orcarouter/fusion-mini",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Abrechnung

Da Fusion jedes Panel-Mitglied plus einen Richter ausführt, wird eine aufgefächerte Anfrage als Summe dieser zugrunde liegenden Completions abgerechnet statt als einzelnes Modell — und nur bei den Anfragen, die sich tatsächlich auffächern. Null Aufschlag.

FAQ

Wo bekomme ich Zugang zur Claude Fable 5 API?
Die Claude Fable 5 API wurde entfernt und eingeschränkt und ist daher nicht mehr breit aufrufbar. OrcaRouter: Fusion Mini ist eine sofort einsatzbereite, OpenAI-kompatible Alternative: Sie führt ein Panel von Spitzenmodellen parallel aus, und ein Bewerter gibt die stärkste Antwort zurück — eine Option auf Fable-5-Niveau, die Sie heute als orcarouter/fusion-mini aufrufen können.
Was ist OrcaRouter: Fusion Mini?
Ein kuratierter Multi-Modell-Router. Bei echter Arbeit führt er ein Panel von Modellen parallel aus, und ein Bewerter wählt die beste Antwort, gegengeprüft mit den übrigen; einfache Anfragen gehen an ein günstigeres Standardmodell.
Wie wird abgerechnet?
Als Summe der Panel-Mitglieder plus des tatsächlich ausgeführten Bewerters, nur bei Anfragen, die sich auffächern. Null Aufschlag.
Fasst Fusion die Antworten zusammen?
Nein. Der Bewerter wählt den stärksten Kandidaten und gibt ihn unverändert zurück — Sie erhalten immer die echte Antwort eines Modells, niemals eine gemittelte oder vermischte.
Was passiert, wenn eines der Modelle ausfällt?
Die anderen Segmente laufen weiter und der Bewerter wählt aus den erfolgreichen Ergebnissen; das Routing schaltet zudem auf die nächstbeste Bereitstellung um, sodass ein Ausfall eines Anbieters die Anfrage nicht scheitern lässt.
Wird für jede Anfrage das gesamte Panel ausgeführt?
Nein – nur Coding-, agentische, werkzeugnutzende und anspruchsvolle Anfragen werden auf das Panel verteilt. Einfache Chats werden an eine günstigere Standardoption weitergeleitet, sodass das Panel nur dort in Rechnung gestellt wird, wo eine zweite Meinung wirklich hilfreich ist.