Sobre el proyecto
Switchboard es un gateway de IA local-first que se ejecuta completamente en tu máquina, ofreciendo un único endpoint compatible con OpenAI para enrutar solicitudes entre 16 proveedores de IA distintos, incluyendo Groq, Cerebras, Google, OpenRouter, DeepSeek, Mistral, OpenAI y Anthropic. Selecciona inteligentemente el proveedor óptimo por solicitud basándose en factores en tiempo real como salud, latencia, costo y tier — priorizando las capas gratuitas y fallback automáticamente si un proveedor falla. Cada decisión de enrutamiento se almacena y explica en detalle, mostrando por qué cada candidato fue elegido o excluido, incluidos desgloses de costos y motivos de falla.
El sistema no requiere cuenta en la nube ni telemetría; las credenciales se cifran localmente con AES-256-GCM y nunca salen de tu dispositivo excepto para llamadas a APIs upstream. Soporta chat completions en streaming y no streaming, embeddings, generación de imágenes, audio speech y transcripción, reranking y endpoints de moderación. Todas las respuestas incluyen headers de metadata de enrutamiento como proveedor usado, modelo, tier, costo, latencia y motivo de fallback cuando aplica.
Switchboard incluye un dashboard accesible en http://localhost:7272 y una herramienta CLI (sb) para administrar proveedores, claves, modelos y políticas. Puedes simular decisiones de enrutamiento sin enviar tráfico, ajustar estrategias como 'auto' (free-first), 'fast', 'quality' o 'failover', y ver registros detallados e informes de uso. Está construido con Node.js 22.13+, usa SQLite para persistencia sin módulos nativos, y funciona idénticamente en Windows, macOS y Linux.
Las funciones de resiliencia incluyen circuit breakers por conexión, bloqueos de modelo tras límites de tasa y fallback walks hasta maxAttempts. Las respuestas en streaming nunca se reintentan una vez iniciadas. La configuración es opcional con valores predeterminados razonables, y CORS está deshabilitado por defecto por seguridad. La aplicación de escritorio se compila vía Electron y se ejecuta en la bandeja del sistema con soporte de inicio al arrancar.
Aún pre-1.0, ha abordado hallazgos importantes de auditoría, incluida cobertura de pruebas (~1035 tests), logging estructurado con redacción, rate limiting persistente y manejo seguro de credenciales. Limitaciones conocidas incluyen: sin release de npm aún (instala vía git clone), sin pruebas end-to-end, sin audit log para acciones de administración y sin shutdown graceful. No está diseñado para exposición en internet público sin reverse proxy y autenticación.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.