Fable 5 đã bị gỡ. Fusion tái dựng cấp độ đó — từ những mô hình bạn vẫn có thể gọi, với chi phí chỉ bằng một phần nhỏ.
Đừng chờ mô hình tiếp theo — bước nhảy năng lực kế tiếp đến từ một nhóm mô hình, không phải một bản cập nhật. Fusion gửi các prompt khó nhất của bạn đến nhiều mô hình tiên tiến cùng lúc, rồi một trọng tài cân nhắc nơi chúng đồng thuận, phát hiện nơi chúng mâu thuẫn và trả về câu trả lời mạnh nhất — được đối chiếu chéo với những câu còn lại. Hãy dùng nó cho công việc thực sự quan trọng — suy luận sâu, lập trình khó, nghiên cứu, đánh giá chuyên gia — bất cứ nơi nào mà sai sót tốn kém hơn vài lần tạo thêm.
Trò chuyện thông thường được chuyển thẳng đến một mô hình mặc định rẻ hơn. Các yêu cầu lập trình, tác nhân và dùng công cụ mới được phân nhánh đến hội đồng — nơi ý kiến thứ hai thực sự xứng đáng.
Prompt của bạn đến với nhiều mô hình tiên tiến cùng lúc — những nỗ lực độc lập, mỗi cái bắt được điều mà những cái khác bỏ sót.
Một trọng tài đọc mọi câu trả lời ứng viên và trả về câu mạnh nhất — được đối chiếu chéo với những câu còn lại, không phải bản đầu tiên của một mô hình đơn lẻ.
Chỉ khi thực sự cần thiết. Fusion gửi câu lệnh đến toàn bộ nhóm mô hình cho các tác vụ lập trình, tác nhân tự động, sử dụng công cụ và các câu lệnh phức tạp — trò chuyện thông thường đi thẳng đến mô hình mặc định rẻ hơn, vì vậy bạn chỉ trả tiền cho nhóm mô hình khi ý kiến thứ hai thực sự mang lại giá trị.
Một mô hình đơn lẻ chỉ cho bạn một lần thử với câu lệnh — và không có cách nào phát hiện khi nó sai. Fusion chạy nhiều mô hình tiên tiến trên cùng một câu lệnh cùng lúc, sau đó một mô hình phán xét độc lập đọc toàn bộ câu trả lời và trả về câu trả lời mạnh nhất, được đối chiếu với các câu trả lời còn lại. Sự bất đồng giữa các mô hình mạnh là tín hiệu có giá trị: nó làm lộ ra những trường hợp khó mà chỉ một mô hình đơn lẻ sẽ âm thầm trả lời sai.
Một mô hình, một câu trả lời. Không có ý kiến thứ hai — nếu sai, bạn sẽ dùng kết quả sai đó.
Chọn một mô hình cho mỗi câu lệnh để tiết kiệm chi phí. Lựa chọn thông minh hơn — nhưng vẫn chỉ là một câu trả lời duy nhất.
Một nhóm mô hình trả lời song song; mô hình phán xét trả về câu trả lời mạnh nhất, được đối chiếu với các câu trả lời còn lại.
| Mô hình | Vai trò | Ngữ cảnh |
|---|---|---|
| Claude Opus 4.8 | Bảng phân tích · Trọng tài | 1M |
| GPT-5.5 | Bảng phân tích | 1M |
| Gemini 3.1 Pro | Bảng phân tích | 1M |
Muốn một tổ hợp khác? Hãy tự xây hội đồng của riêng bạn từ các mẫu "Claude Fable 5 Level" trong trình chỉnh sửa DSL định tuyến.
Fusion không phải là trường hợp đặc biệt — đây là cấu hình tích hợp sẵn của DSL định tuyến, một ngôn ngữ nhỏ được sandbox hóa để định nghĩa chính xác cách mỗi yêu cầu được định tuyến. Sao chép mẫu "Fable 5 Level" và thay đổi nhóm mô hình, mô hình phán xét, quy tắc kiểm soát, hoặc cách chọn ra câu trả lời thắng.
Mô hình phán xét xếp hạng mọi ứng viên và trả về câu trả lời mạnh nhất nguyên vẹn — không bao giờ là kết quả pha trộn bị loãng.
Nhóm mô hình bỏ phiếu cho một câu trả lời có cấu trúc — không cần thêm lượt gọi mô hình phán xét.
Một mô hình tổng hợp kết hợp các ứng viên thành một câu trả lời cải tiến duy nhất (Mixture-of-Agents).
Dành cho mã nguồn: ứng viên nào có bản vá thực sự vượt qua bộ kiểm thử của bạn sẽ thắng.
Một cuộc đua — nhánh có độ trễ thấp nhất thắng, dành cho khi tốc độ là ưu tiên hàng đầu.
Không có hộp đen. Xây dựng bộ định tuyến của riêng bạn trên DSL và mọi luồng song song đều được ghi lại — những mô hình nào đã cạnh tranh, độ trễ và trạng thái của từng chặng, cùng câu trả lời nào được bộ phán xét chọn — để bạn có thể thấy ngay trong bảng điều khiển tại sao một câu trả lời được chọn thắng.
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="orcarouter/fusion",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)Vì fusion chạy mọi thành viên hội đồng cộng với một giám khảo, một yêu cầu phân nhánh được tính phí bằng tổng của các phần hoàn thành nền tảng đó thay vì một mô hình duy nhất — và chỉ trên các yêu cầu thực sự được phân nhánh. Không tính thêm phí.