איכות מרובת-מודלים בתקציב מצומצם.
תפסיקו לחכות למודל הבא — הקפיצה הבאה ביכולות היא פאנל, לא נקודת ציון (checkpoint). Fusion שולח את הפרומפטים הקשים ביותר שלכם למספר מודלים מובילים בו-זמנית, ואז שופט שוקל היכן הם מסכימים, מאתר היכן הם סותרים, ומחזיר את התשובה החזקה ביותר — כשהיא מאומתת מול השאר. השתמשו בו לעבודה שבאמת חשובה — הסקה עמוקה, קידוד מורכב, מחקר, ביקורת מומחים — בכל מקום שבו טעות עולה יותר מכמה השלמות נוספות.
צ'אט יומיומי עובר ישירות לברירת מחדל זולה יותר. בקשות של קידוד, סוכנים ושימוש בכלים מתפצלות לפאנל — שם חוות דעת שנייה באמת משתלמת.
הפרומפט שלכם מגיע למספר מודלים מובילים בו-זמנית — ניסיונות עצמאיים שכל אחד מהם תופס את מה שהאחרים מפספסים.
שופט קורא כל מועמד ומחזיר את החזק ביותר — מאומת מול האחרים, לא רק ניסיון ראשון של מודל בודד.
רק היכן שזה עוזר. Fusion מתפצל אל הפאנל עבור prompts של קוד, agentic, שימוש בכלים ו-prompts קשים — צ'אט מזדמן עובר ישירות לברירת מחדל זולה יותר, כך שאתם משלמים על הפאנל רק בבקשות שבהן חוות דעת שנייה משתלמת.
מודל בודד נותן לכם ניסיון אחד עבור ה-prompt שלכם — וללא דרך לתפוס כשהוא טועה. Fusion מריץ כמה מודלים מובילים על אותו prompt בו-זמנית, ולאחר מכן שופט עצמאי קורא כל תשובה ומחזיר את החזקה ביותר, לאחר הצלבה מול השאר. חוסר הסכמה בין מודלים חזקים הוא סימן: הוא חושף את המקרים הקשים שבהם מודל בודד היה טועה בשקט.
מודל אחד, תשובה אחת. ללא חוות דעת שנייה — אם הוא טועה, אתם משחררים את הטעות.
בוחר מודל אחד לכל prompt כדי לחסוך בעלות. בחירה חכמה יותר — אך עדיין תשובה בודדת.
פאנל עונה במקביל; שופט מחזיר את התשובה החזקה ביותר, לאחר הצלבה מול השאר.
| מודל | תפקיד | הקשר |
|---|---|---|
| Gemini 3.5 Flash | פאנל | 1M |
| MiniMax M2.7 | פאנל | 204K |
| GLM 5.1 | פאנל | 200K |
| Claude Opus 4.8 | שופט | 1M |
רוצים שילוב אחר? בנו פאנל משלכם בעורך ה-DSL לניתוב.
Fusion אינו מקרה מיוחד — הוא תצורה מובנית ב-routing DSL שלנו, שפה קטנה ומבודדת להגדרה מדויקת של אופן ניתוב כל בקשה. שכפלו את התבנית "Fable 5 Level" ושנו את הפאנל, השופט, כלל השערים, או את אופן בחירת המנצח.
מודל שופט מדרג כל מועמד ומגיש את החזק ביותר כלשונו — לעולם לא מיזוג מדולל.
הפאנל מצביע על תשובה מובנית — ללא קריאת שופט נוספת.
מודל אגרגטור ממזג את המועמדים לתשובה אחת משופרת (Mixture-of-Agents).
עבור קוד: המועמד שה-patch שלו אכן עובר את מערך הבדיקות שלכם מנצח.
מרוץ — הענף עם זמן ההשהיה הנמוך ביותר מנצח, לשימוש כשמהירות היא הכי חשובה.
ללא קופסה שחורה. בנו נתב משלכם על גבי ה-DSL וכל פיצול נרשם — אילו מודלים התחרו, זמן ההשהיה והסטטוס של כל ענף, ואיזו תשובה השופט בחר — כך שתוכלו לראות בקונסולה בדיוק מדוע תשובה מסוימת ניצחה.
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="orcarouter/fusion-flash",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)מכיוון ש-fusion מריץ כל חבר בפאנל בתוספת שופט, בקשה שמתפצלת מחויבת כסכום של ההשלמות הבסיסיות הללו ולא כמודל בודד — ורק על הבקשות שאכן מתפצלות. ללא תוספת מחיר.