Sobre o projeto
O MultiRouter AI atua como um único endpoint de API que roteia inteligentemente solicitações de conclusão de chat entre várias contas de provedores de IA. Ele permite que os usuários empilhem chaves de API de camadas gratuitas de serviços como Groq, Cerebras e Gemini, realizando o failover automaticamente quando uma conta atinge os limites de taxa. O sistema é totalmente compatível com a especificação da API da OpenAI, tornando-o plug-and-play para IDEs como Cursor, Windsurf, Claude Code, Aider e outras que suportam URLs base personalizadas da OpenAI.
A configuração é gerenciada por meio de um arquivo YAML (`providers.yaml`), onde os usuários definem instâncias de provedores, chaves de API, modelos suportados e prioridade de roteamento. Os provedores são testados em ordem — normalmente as camadas gratuitas primeiro, as pagas por último — com resfriamento automático e reativação após a expiração dos limites de taxa. Duas estratégias de roteamento estão disponíveis: 'exhaust' (padrão), que utiliza cada provedor até a exaustão, e 'round-robin', que distribui as solicitações uniformemente entre as instâncias ativas usando o nome de modelo especial `multirouter-auto`.
O servidor suporta respostas de streaming via Server-Sent Events (SSE) no formato OpenAI e expõe endpoints padrão como `/v1/chat/completions`, `/v1/models` e `/health`. Ele roda em Node.js 20+ com Express 5 e TypeScript 5.9, inclui limitação de taxa integrada e autenticação via token bearer, e pode integrar modelos locais ou auto-hospedados via o tipo de provedor `openai-compatible` com um `base_url` personalizado.
As melhores práticas de segurança incluem ignorar o `providers.yaml` no git e suportar a interpolação de variáveis de ambiente para segredos. O projeto possui licença MIT e foi projetado para desenvolvedores que buscam acesso ininterrupto à IA, agrupando cotas de múltiplos provedores sem modificar as aplicações cliente.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.