O Fable 5 foi descontinuado. O Fusion reconstrói esse nível — a partir dos modelos que você ainda pode chamar, por uma fração do custo.
Pare de esperar pelo próximo modelo — o próximo salto de capacidade vem de um painel, não de um checkpoint. O Fusion envia seus prompts mais difíceis a vários modelos de ponta de uma vez e, em seguida, um juiz pondera onde concordam, detecta onde se contradizem e devolve a resposta mais forte — verificada de forma cruzada com as demais. Use-o no trabalho que realmente importa — raciocínio profundo, código difícil, pesquisa, crítica especializada — onde errar custa mais do que algumas gerações extras.
Conversas casuais vão direto para um modelo padrão mais barato. Solicitações de código, agente e uso de ferramentas se distribuem para o painel — é aí que uma segunda opinião realmente compensa.
Seu prompt atinge vários modelos de ponta ao mesmo tempo — tentativas independentes que captam, cada uma, o que as outras deixam passar.
Um juiz lê cada candidato e devolve o mais forte — verificado de forma cruzada com os outros, não a primeira tentativa de um único modelo.
Somente onde faz diferença. O Fusion distribui para o painel em prompts de programação, agênticos, uso de ferramentas e consultas complexas — conversas casuais vão direto para um modelo padrão mais econômico, então você paga pelo painel apenas nas requisições em que uma segunda opinião compensa.
Um único modelo oferece apenas uma tentativa para o seu prompt — e nenhuma forma de detectar quando erra. O Fusion executa vários modelos de ponta no mesmo prompt simultaneamente, e então um árbitro independente lê cada resposta e retorna a mais forte, verificada em relação às demais. A discordância entre modelos potentes é um sinal valioso: ela revela os casos difíceis em que um modelo sozinho erraria silenciosamente.
Um modelo, uma resposta. Sem segunda opinião — se errar, você entrega o erro.
Escolhe um modelo por prompt para reduzir custos. Seleção mais inteligente — mas ainda uma única resposta.
Um painel responde em paralelo; um árbitro retorna a resposta mais forte, verificada em relação às demais.
| Modelo | Função | Contexto |
|---|---|---|
| Claude Opus 4.8 | Painel · Juiz | 1M |
| GPT-5.5 | Painel | 1M |
| Gemini 3.1 Pro | Painel | 1M |
Quer uma combinação diferente? Crie seu próprio painel a partir dos modelos "Claude Fable 5 Level" no editor do DSL de roteamento.
O Fusion não é um caso especial — é uma configuração nativa da nossa DSL de roteamento, uma linguagem pequena e isolada para definir exatamente como cada requisição é roteada. Clone o template «Fable 5 Level» e altere o painel, o árbitro, a regra de ativação ou a forma de escolha do vencedor.
Um modelo árbitro classifica todos os candidatos e entrega o mais forte na íntegra — nunca uma fusão diluída.
O painel vota em uma resposta estruturada — sem chamada adicional ao árbitro.
Um modelo agregador combina os candidatos em uma resposta aprimorada (Mixture-of-Agents).
Para código: o candidato cujo patch efetivamente passa no seu conjunto de testes vence.
Uma corrida — o trecho com menor latência vence, para quando a velocidade é o que mais importa.
Sem caixa-preta. Crie seu próprio roteador na DSL e cada bifurcação é registrada — quais modelos concorreram, a latência e o estado de cada trecho, e qual resposta o árbitro escolheu — para que você possa ver no console exatamente por que uma resposta venceu.
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="orcarouter/fusion",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)Como o fusion executa cada membro do painel mais um juiz, uma solicitação distribuída é cobrada como a soma dessas conclusões subjacentes em vez de um único modelo — e apenas nas solicitações que realmente se distribuem. Sem margem.