Sobre o projeto
FreeLLMAPI fornece um endpoint /v1 unificado para acessar camadas gratuitas de 34 provedores de LLM e mais de 600 endpoints de modelos. Ele permite que os usuários empilhem múltiplas cotas gratuitas para aumentar a capacidade total de inferência disponível, gerenciando automaticamente os limites de taxa e falhas de provedores.
As principais capacidades incluem:
- API Unificada: Suporta interfaces compatíveis com OpenAI para chat, completions, embeddings, imagens, vídeo e fala, bem como interfaces nativas de Anthropic Messages e Gemini.
- Roteamento Inteligente: Apresenta seis estratégias de roteamento com failover automático e rotação de chaves quando os provedores atingem o limite de taxa ou retornam erros.
- Gerenciamento de Modelos: Inclui um catálogo de modelos que se atualiza automaticamente e um painel de administração baseado em React para gerenciar chaves de API criptografadas e rastrear análises de uso.
- Recursos Avançados: Oferece 'Fusion' (síntese de múltiplos modelos), compressão de prompt, sessões fixas (sticky sessions) para transferência de contexto e um servidor MCP para introspecção de agentes.
- Implantação: Disponível como um container Docker, um aplicativo desktop nativo para macOS e Windows, e executa em ambientes Node 20+, incluindo SBCs ARM.
- Integração: Fornece ferramentas de configuração automatizadas para vários agentes de codificação e CLIs, como Claude Code, Aider, Cline e Cursor.