Sobre el proyecto

GPT-Load es una puerta de enlace de IA autoalojada diseñada para gestionar múltiples proveedores de IA y credenciales a través de un único punto de entrada. Admite tanto claves de API como cuentas de suscripción (como Codex, Claude, Antigravity y Grok), ofreciendo gestión unificada de credenciales, programación de tráfico, reintentos, enfriamientos, listas de bloqueo y afinidad de sesión para reducir el impacto de credenciales sobrecargadas o fallidas. La puerta de enlace expone los protocolos nativos de OpenAI, Anthropic y Gemini, lo que permite a los clientes mantener sus interfaces existentes mientras enrutan solicitudes a diversos servicios ascendentes. Los canales integrados incluyen proveedores oficiales y en la nube (OpenAI, Anthropic, Gemini, xAI, Azure OpenAI, AWS Bedrock, Google Vertex AI), servicios de modelos (DeepSeek, Moonshot AI, SiliconFlow, Zhipu AI, Alibaba, Volcengine, OpenRouter, Groq), canales de suscripción y relés personalizados compatibles con OpenAI. Las características clave incluyen: - Programación multicredencial con pesos configurables, reintentos, enfriamiento, listas de bloqueo y afinidad de sesión - Registro de solicitudes, estadísticas de uso y estimaciones de costos en una interfaz de gestión integrada - Compatibilidad con bases de datos SQLite, MySQL o PostgreSQL con cifrado local de credenciales - Despliegue con Docker Compose con un inicio rápido sencillo - Compilaciones binarias nativas para Linux, macOS y Windows, incluido un instalador Windows Setup - Configuración mediante variables de entorno para ajustes de red, base de datos, registro y seguridad GPT-Load 2.0 es una reescritura completa y no puede migrar datos de la versión 1.x en el mismo lugar. Está diseñado para una única instancia de aplicación y no admite escalado horizontal. Las cifras de uso y costos son estimaciones y no deben tratarse como registros financieros. El proyecto tiene licencia MIT y depende de componentes de código abierto como Bifrost Core, CLIProxyAPI y Lobe Icons.