Sobre o projeto

GPT-Load é um gateway de IA auto-hospedado projetado para gerenciar vários provedores de IA e credenciais por meio de um único ponto de entrada. Ele suporta tanto chaves de API quanto contas de assinatura (como Codex, Claude, Antigravity e Grok), oferecendo gerenciamento unificado de credenciais, agendamento de tráfego, novas tentativas, resfriamento, lista de bloqueio e afinidade de sessão para reduzir o impacto de credenciais sobrecarregadas ou com falha. O gateway expõe os protocolos nativos OpenAI, Anthropic e Gemini, permitindo que os clientes mantenham suas interfaces existentes enquanto roteiam solicitações para vários serviços upstream. Os canais integrados incluem provedores oficiais e de nuvem (OpenAI, Anthropic, Gemini, xAI, Azure OpenAI, AWS Bedrock, Google Vertex AI), serviços de modelo (DeepSeek, Moonshot AI, SiliconFlow, Zhipu AI, Alibaba, Volcengine, OpenRouter, Groq), canais de assinatura e relays personalizados compatíveis com OpenAI. Os principais recursos incluem: - Agendamento com múltiplas credenciais com pesos configuráveis, novas tentativas, resfriamento, lista de bloqueio e afinidade de sessão - Registro de solicitações, estatísticas de uso e estimativas de custo em uma interface de gerenciamento incorporada - Suporte a bancos de dados SQLite, MySQL ou PostgreSQL com criptografia local de credenciais - Implantação com Docker Compose com início rápido simples - Builds de binários nativos para Linux, macOS e Windows, incluindo um instalador Windows Setup - Configuração por variáveis de ambiente para rede, banco de dados, registro e configurações de segurança O GPT-Load 2.0 é uma reescrita completa e não pode migrar dados da versão 1.x no local. Ele foi projetado para uma única instância de aplicação e não suporta escalonamento horizontal. Os números de uso e custo são estimativas e não devem ser tratados como registros financeiros. O projeto é licenciado sob MIT e depende de componentes de código aberto como Bifrost Core, CLIProxyAPI e Lobe Icons.