Un provider va offline. Nessuno se ne accorge.
Quando un provider upstream applica un rate limit o restituisce un errore 5xx, una catena di fallback configurata viene ritentata su un modello sano prima che la risposta abbia iniziato lo streaming.
- Indica fino a cinque modelli di riserva, scelti da un catalogo di oltre 200 opzioni distribuite su 40+ provider.
- Il failover avviene prima dello streaming — il client riceve un'unica risposta completa, non una troncata seguita da un errore.
- Ogni tentativo è registrato nella ricevuta: cosa ha fallito, cosa lo ha sostituito e quanto tempo ha impiegato ogni tentativo.
Il disservizio di cui nessuno apre un ticket.
Un provider inizia a restituire errori 503. Con una catena di fallback configurata, la richiesta è già in movimento — atterra su un modello sano prima che un singolo token abbia raggiunto il tuo utente. L'utente vede una risposta pulita. Tu vedi entrambi i tentativi nella ricevuta.
C'è sempre un'alternativa.
Puoi indicare fino a cinque modelli per la catena, scelti tra oltre 200 distribuiti su 40+ provider — abbastanza da garantire che il cattivo pomeriggio di un singolo upstream non diventi il tuo report di incidente. Salute, peso e priorità sono monitorati per ogni canale; quelli in difficoltà escono silenziosamente dalla rotazione.