Publique em qualquer modelo. Não se comprometa com nenhum.
Troque o modelo por baixo de uma funcionalidade sem alterar o código do cliente, renegociar um contrato ou publicar uma versão.
- O roteamento adaptativo escolhe o modelo por prompt, então um modelo melhor lançado no próximo mês não exige migração.
- Versões de prompt ficam por trás de rótulos — experimente e reverta sem depender de uma fila de deploys.
- O Playground executa o gateway real, então o que você valida é o que você publica.
Escolha o modelo depois.
A parte mais difícil de lançar uma funcionalidade de IA é comprometer-se com um modelo antes de saber como será o tráfego. Roteando por um único endpoint, essa decisão permanece reversível — toda semana, sem necessidade de release.
Itere no prompt, não no pipeline.
Versione prompts com rótulos, faça testes A/B, reverta com uma única ação. Experimente tudo no Playground primeiro — ele executa o gateway real, então o que você valida é o que você entrega.