OrcaRouter: Fusion

orcarouter/fusion
איכות
טקסט בכניסה · טקסט ביציאה · 1M ctx

Fable 5 הוסר. Fusion בונה מחדש את אותה רמה — מתוך המודלים שעדיין אפשר לקרוא להם, בשבריר מהעלות.

סקירה כללית

תפסיקו לחכות למודל הבא — הקפיצה הבאה ביכולות היא פאנל, לא נקודת ציון (checkpoint). Fusion שולח את הפרומפטים הקשים ביותר שלכם למספר מודלים מובילים בו-זמנית, ואז שופט שוקל היכן הם מסכימים, מאתר היכן הם סותרים, ומחזיר את התשובה החזקה ביותר — כשהיא מאומתת מול השאר. השתמשו בו לעבודה שבאמת חשובה — הסקה עמוקה, קידוד מורכב, מחקר, ביקורת מומחים — בכל מקום שבו טעות עולה יותר מכמה השלמות נוספות.

איך זה עובד

1

ניתוב לפי משימה

צ'אט יומיומי עובר ישירות לברירת מחדל זולה יותר. בקשות של קידוד, סוכנים ושימוש בכלים מתפצלות לפאנל — שם חוות דעת שנייה באמת משתלמת.

2

פיצול לפאנל

הפרומפט שלכם מגיע למספר מודלים מובילים בו-זמנית — ניסיונות עצמאיים שכל אחד מהם תופס את מה שהאחרים מפספסים.

3

בחירת התשובה הטובה ביותר

שופט קורא כל מועמד ומחזיר את החזק ביותר — מאומת מול האחרים, לא רק ניסיון ראשון של מודל בודד.

רק היכן שזה עוזר. Fusion מתפצל אל הפאנל עבור prompts של קוד, agentic, שימוש בכלים ו-prompts קשים — צ'אט מזדמן עובר ישירות לברירת מחדל זולה יותר, כך שאתם משלמים על הפאנל רק בבקשות שבהן חוות דעת שנייה משתלמת.

למה פאנל עדיף על מודל בודד

מודל בודד נותן לכם ניסיון אחד עבור ה-prompt שלכם — וללא דרך לתפוס כשהוא טועה. Fusion מריץ כמה מודלים מובילים על אותו prompt בו-זמנית, ולאחר מכן שופט עצמאי קורא כל תשובה ומחזיר את החזקה ביותר, לאחר הצלבה מול השאר. חוסר הסכמה בין מודלים חזקים הוא סימן: הוא חושף את המקרים הקשים שבהם מודל בודד היה טועה בשקט.

מודל בודד

מודל אחד, תשובה אחת. ללא חוות דעת שנייה — אם הוא טועה, אתם משחררים את הטעות.

ניתוב אוטומטי

בוחר מודל אחד לכל prompt כדי לחסוך בעלות. בחירה חכמה יותר — אך עדיין תשובה בודדת.

Fusion

פאנל עונה במקביל; שופט מחזיר את התשובה החזקה ביותר, לאחר הצלבה מול השאר.

פאנל + שופט (Mixture-of-Agents)65.1%
מודל מוביל בודד (GPT-4o)57.5%
אחוז ניצחון מבוקר-אורך של AlpacaEval 2.0 — פאנל מודלים עם אגרגטור מנצח מודל מוביל בודד. Mixture-of-Agents, Wang et al. 2024

מודלים בנתב זה

מודלתפקידהקשר
Claude Opus 4.8פאנל · שופט1M
GPT-5.5פאנל1M
Gemini 3.1 Proפאנל1M

רוצים שילוב אחר? בנו פאנל משלכם מתוך התבניות "Claude Fable 5 Level" בעורך ה-DSL לניתוב.

מבוסס על ה-routing DSL

Fusion אינו מקרה מיוחד — הוא תצורה מובנית ב-routing DSL שלנו, שפה קטנה ומבודדת להגדרה מדויקת של אופן ניתוב כל בקשה. שכפלו את התבנית "Fable 5 Level" ושנו את הפאנל, השופט, כלל השערים, או את אופן בחירת המנצח.

המיטב מתוך Nברירת מחדל של Fusion

מודל שופט מדרג כל מועמד ומגיש את החזק ביותר כלשונו — לעולם לא מיזוג מדולל.

הצבעת רוב

הפאנל מצביע על תשובה מובנית — ללא קריאת שופט נוספת.

סינתזה

מודל אגרגטור ממזג את המועמדים לתשובה אחת משופרת (Mixture-of-Agents).

מעבר בדיקות

עבור קוד: המועמד שה-patch שלו אכן עובר את מערך הבדיקות שלכם מנצח.

ראשון

מרוץ — הענף עם זמן ההשהיה הנמוך ביותר מנצח, לשימוש כשמהירות היא הכי חשובה.

ללא קופסה שחורה. בנו נתב משלכם על גבי ה-DSL וכל פיצול נרשם — אילו מודלים התחרו, זמן ההשהיה והסטטוס של כל ענף, ואיזו תשובה השופט בחר — כך שתוכלו לראות בקונסולה בדיוק מדוע תשובה מסוימת ניצחה.

פתיחת עורך ה-routing DSL

דוגמאות קוד

import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="orcarouter/fusion",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

חיוב

מכיוון ש-fusion מריץ כל חבר בפאנל בתוספת שופט, בקשה שמתפצלת מחויבת כסכום של ההשלמות הבסיסיות הללו ולא כמודל בודד — ורק על הבקשות שאכן מתפצלות. ללא תוספת מחיר.

שאלות נפוצות

היכן ניתן לגשת ל-Claude Fable 5 API?
Claude Fable 5 API הוסר מהרשימה והוגבל, ולכן אי אפשר לקרוא לו יותר בצורה רחבה. OrcaRouter: Fusion הוא חלופה תואמת-OpenAI שניתן להחליף בקלות: הוא מריץ פאנל של מודלים מובילים במקביל, ושופט מחזיר את התשובה החזקה ביותר — אפשרות ברמת Fable-5 שאפשר לקרוא לה כבר היום בתור orcarouter/fusion.
מהו OrcaRouter: Fusion?
נתב רב-מודלים אוצרתי. בעבודה אמיתית הוא מריץ פאנל מודלים במקביל ושופט בוחר את התשובה הטובה ביותר, בהצלבה מול השאר; בקשות פשוטות מועברות לברירת מחדל זולה יותר.
איך מתבצע החיוב?
כסכום של חברי הפאנל בתוספת השופט שהופעל בפועל, רק על הבקשות שמתפצלות. ללא תוספת מחיר.
האם Fusion ממזג את התשובות יחד?
לא. השופט בוחר את המועמד החזק היחיד ומחזיר אותו כלשונו — אתם תמיד מקבלים תשובה אמיתית של מודל, לעולם לא ממוצעת או מעורבבת.
מה קורה אם אחד המודלים נכשל?
הענפים האחרים ממשיכים לרוץ והשופט בוחר מתוך מה שהצליח; הניתוב גם עובר לפריסה הטובה הבאה, כך שתקלה אצל ספק אחד לא מפילה את הבקשה.
האם כל בקשה מפעילה את כל הפאנל?
לא — רק prompts של קוד, agentic, שימוש בכלים ו-prompts קשים מתפצלים. צ'אט מזדמן עובר לברירת מחדל זולה יותר, כך שאתם מחויבים על הפאנל רק היכן שחוות דעת שנייה עוזרת.