Atus
Início
Metodologia

Metodologia

Como entregamos alta disponibilidade com roteamento inteligente entre múltiplos providers de IA.

Roteamento dinâmico

Auto-failover Load balancing Priority queue

Cada requisição é automaticamente roteada para o provider mais adequado com base no modelo solicitado, prioridade e disponibilidade. Fallback automático garante que seu serviço nunca para.

Métricas em tempo real

Logs completos Token tracking Latência p95

Registramos cada requisição: tokens consumidos, latência por provider, erros e taxa de sucesso. Dashboards atualizados em tempo real para você tomar decisões baseadas em dados.

Retry inteligente

Exponential backoff 3 tentativas Fallback automático

Em caso de falha, o sistema tenta automaticamente até 3 vezes com backoff exponencial (1s, 2s, 4s). Se o provider continuar indisponível, a requisição é roteada para o próximo provider da fila.

Conversão transparente

OpenAI ↔ Anthropic Gemini Tool calls

Seu cliente envia no formato OpenAI? O provider espera Anthropic? O Atus traduz automaticamente — incluindo system prompts, mensagens, tool calls e respostas. Você usa o SDK que quiser, a gente resolve o resto.

Cache inteligente

Cache LRU TTL dinâmico Hit rate > 40%

Requisições idênticas em um curto intervalo são servidas do cache, reduzindo latência e custos. O cache é invalidado automaticamente quando o modelo ou provider é atualizado.