Sobre o projeto
LLM Router é uma aplicação FastAPI projetada para atuar como um proxy unificado para múltiplos backends de IA, mantendo total compatibilidade com a OpenAI Chat Completions API. Ele permite que desenvolvedores roteiem solicitações entre vários provedores — incluindo OpenAI, Cerebras, DeepInfra e instâncias locais do Ollama — usando um sistema baseado em prioridade com failover automático.
As principais capacidades incluem:
- Roteamento Multi-Backend: Alterna perfeitamente entre diferentes serviços de IA com base na disponibilidade e prioridade.
- Compatibilidade com OpenAI: Funciona como um substituto direto para aplicações existentes baseadas em OpenAI, bastando alterar a URL base.
- Recursos de Resiliência: Implementa failover automático para backends secundários caso o serviço primário falhe ou atinja limites de taxa.
- Gestão de Tráfego: Possui um sistema de limitação de taxa integrado usando um algoritmo de janela deslizante e suporta múltiplas chaves de API para autenticação.
- Monitoramento e Estatísticas: Fornece endpoints dedicados para verificações de integridade, status do backend e métricas de uso.
- Configuração Flexível: Suporta configuração baseada em ambiente ou regras de roteamento avançadas baseadas em JSON.
A ferramenta é particularmente útil para desenvolvedores que buscam aumentar a confiabilidade de suas aplicações alimentadas por IA, diversificando seus provedores de modelos sem alterar a base de código.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.