Fable 5 wurde eingestellt. Fusion baut dieses Niveau neu auf — aus den Modellen, die Sie noch aufrufen können, zu einem Bruchteil der Kosten.
Warten Sie nicht auf das nächste Modell — der nächste Fähigkeitssprung kommt von einem Panel, nicht von einem Checkpoint. Fusion schickt Ihre schwierigsten Prompts an mehrere Spitzenmodelle gleichzeitig, dann wägt ein Bewerter ab, wo sie übereinstimmen, erkennt Widersprüche und gibt die stärkste einzelne Antwort zurück — gegen die übrigen gegengeprüft. Greifen Sie darauf bei der Arbeit zurück, die wirklich zählt — tiefes Denken, schwieriges Coding, Recherche, Experten-Review — überall, wo ein Fehler mehr kostet als ein paar zusätzliche Generierungen.
Lockerer Chat geht direkt an ein günstigeres Standardmodell. Coding-, Agenten- und werkzeugnutzende Anfragen fächern auf das Panel auf — dort, wo eine zweite Meinung sich wirklich auszahlt.
Ihr Prompt erreicht mehrere Spitzenmodelle gleichzeitig — unabhängige Versuche, die jeweils auffangen, was die anderen übersehen.
Ein Bewerter liest jeden Kandidaten und gibt den stärksten einzelnen zurück — gegen die anderen gegengeprüft, nicht der erste Versuch eines einzelnen Modells.
Nur dort, wo es sich lohnt. Fusion verteilt Anfragen ans Panel bei Coding-, agentischen, werkzeugnutzenden und anspruchsvollen Aufgaben — einfache Unterhaltungen gehen direkt an eine günstigere Standardoption, sodass Sie das Panel nur bei den Anfragen bezahlen, bei denen eine zweite Meinung wirklich Mehrwert bringt.
Ein einzelnes Modell liefert Ihnen einen einzigen Versuch auf Ihre Anfrage — und keine Möglichkeit, Fehler zu erkennen. Fusion lässt mehrere führende Modelle gleichzeitig auf dieselbe Anfrage ansetzen; anschließend liest ein unabhängiger Bewerter jede Antwort und gibt die stärkste zurück, gegengeprüft mit den übrigen. Uneinigkeit zwischen starken Modellen ist ein Signal: Sie zeigt die schwierigen Fälle auf, bei denen ein einzelnes Modell stillschweigend falsch liegen würde.
Ein Modell, eine Antwort. Keine zweite Meinung — ist sie falsch, liefern Sie das Falsche aus.
Wählt pro Anfrage ein Modell, um Kosten zu sparen. Klügere Auswahl — aber weiterhin nur eine Antwort.
Ein Panel antwortet parallel; ein Bewerter gibt die stärkste Antwort zurück, gegengeprüft mit den übrigen.
| Modell | Rolle | Kontext |
|---|---|---|
| Claude Opus 4.8 | Panel · Richter | 1M |
| GPT-5.5 | Panel | 1M |
| Gemini 3.1 Pro | Panel | 1M |
Möchten Sie eine andere Kombination? Erstellen Sie Ihr eigenes Panel aus den "Claude Fable 5 Level"-Vorlagen im Routing-DSL-Editor.
Fusion ist kein Sonderfall — es ist eine integrierte Konfiguration unserer Routing-DSL, einer kleinen, isolierten Sprache zur genauen Definition des Routings jeder Anfrage. Klonen Sie die Vorlage „Fable 5 Level" und passen Sie Panel, Bewerter, die Steuerungsregel oder die Auswahl des Gewinners an.
Ein Bewertermodell ordnet alle Kandidaten und gibt den stärksten unverändert zurück — niemals eine verwässerte Zusammenfassung.
Das Panel stimmt über eine strukturierte Antwort ab — ohne zusätzlichen Bewerteraufruf.
Ein Aggregatormodell vereint die Kandidaten zu einer verbesserten Antwort (Mixture-of-Agents).
Für Code: Der Kandidat, dessen Patch Ihr Test-Framework tatsächlich besteht, gewinnt.
Ein Wettlauf — das Segment mit der geringsten Latenz gewinnt, wenn Geschwindigkeit am meisten zählt.
Keine Black Box. Erstellen Sie Ihren eigenen Router auf der DSL, und jede Auffächerung wird aufgezeichnet — welche Modelle gegeneinander angetreten sind, die Latenz und der Status jedes Teilabschnitts sowie welche Antwort der Bewerter ausgewählt hat — sodass Sie in der Konsole genau nachvollziehen können, warum eine Antwort gewonnen hat.
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="orcarouter/fusion",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)Da Fusion jedes Panel-Mitglied plus einen Richter ausführt, wird eine aufgefächerte Anfrage als Summe dieser zugrunde liegenden Completions abgerechnet statt als einzelnes Modell — und nur bei den Anfragen, die sich tatsächlich auffächern. Null Aufschlag.