Sobre el proyecto

SnapOtter es una aplicación de procesamiento de archivos autoalojada que ofrece conversión, compresión, edición, OCR, transcripción, eliminación de metadatos y operaciones de IA locales mediante una interfaz web, una API REST y flujos de trabajo de pipeline. El README enumera más de 200 herramientas en cinco áreas: - Imágenes: redimensionado, recorte, compresión, conversión, marca de agua, ajuste de color, limpieza de capturas de pantalla, memes, vectorización, herramientas GIF, detección de duplicados, fotos de pasaporte y convertidores de formato. Indica soporte para más de 55 formatos de entrada, incluidos formatos RAW de cámara, y 17 formatos de salida. - Vídeo: conversión, compresión, recorte temporal, redimensionado, recorte, fusión, vídeo a GIF, extracción de audio, estabilización, cambios de FPS y grabación o extracción de subtítulos. - Audio: conversión, recorte, normalización, controles de volumen y fundidos, cambio de tono, eliminación de silencios, reducción de ruido, fusión, división y generación de formas de onda. - PDF: fusión, división, compresión, conversión, protección, desbloqueo, censura, firma, marca de agua, numeración de páginas, OCR y exportación a imágenes. - Archivos generales: conversión entre CSV/JSON/XML/YAML, fusión y división de CSV, Excel a CSV, creación de gráficos y creación/extracción de ZIP. Se incluye un editor de imágenes en el navegador con capacidad de capas, pinceles, formas, ajustes, filtros, curvas y atajos de teclado. El conjunto de funciones de IA local incluye eliminación de fondos, escalado de imágenes, restauración y colorización de fotos, eliminación de objetos, difuminado y mejora de rostros, OCR, transcripción de audio, subtítulos automáticos, expansión de lienzo y reparación de transparencias. Las herramientas pueden encadenarse en pipelines reutilizables, con un límite predeterminado de 20 pasos e importación/exportación JSON. Cada herramienta se expone mediante una API REST con autenticación por clave de API, con documentación interactiva en /api/docs. La implementación se basa en Docker. Un inicio rápido de un solo contenedor incorpora Postgres 17 y Redis 17 y Redis 8, mientras que una configuración Compose de producción ejecuta la aplicación junto con contenedores separados de Postgres y Redis. Hay imágenes disponibles para AMD64 y ARM64. Se admite aceleración NVIDIA CUDA para cargas de trabajo de IA seleccionadas, incluidas eliminación de fondos, escalado y transcripción; el OCR utiliza el tiempo de ejecución portátil de CPU, y la inferencia de IA en GPU integrada Intel/AMD no figura como compatible. La plataforma admite proveedores OIDC/SSO como Google, GitHub y Okta, y está localizada en 21 idiomas con soporte de derecha a izquierda para árabe. Las credenciales predeterminadas del inicio rápido son admin/admin, y se requiere un cambio de contraseña en el primer inicio de sesión. El proyecto afirma que los archivos permanecen en la red del usuario y no tiene dependencias externas de SaaS; la analítica básica puede desactivarse en el momento de la compilación o mediante los ajustes de administración. SnapOtter se distribuye bajo doble licencia AGPLv3 y una licencia comercial de pago.