Sobre el proyecto

Timeline Studio es un editor de video de código abierto y local que se ejecuta en el navegador. Proporciona una línea de tiempo multipista al estilo CapCut para imágenes, superposiciones de imagen en imagen, subtítulos, pegatinas, voz en off, audio de origen separado y música. Los usuarios humanos y los agentes de IA pueden trabajar en el mismo proyecto editable, manteniendo el archivo .timeline portátil como fuente de verdad, en lugar de producir solo un video renderizado opaco. Las funciones de edición incluyen selección y transformación en el lienzo, cambio de tamaño proporcional, rotación, máscaras, filtros, efectos, animación, cambios de velocidad, fotogramas clave explícitos, ajuste, guías de alineación, operaciones de dividir/duplicar/eliminar, zoom de línea de tiempo y deshacer/rehacer. La gradación de color de escritorio admite controles de temperatura, tinte, saturación, tono, saturación de rueda y luminancia con fotogramas clave. La vista previa utiliza reproducción de medios nativa, mientras que la exportación utiliza una ruta de renderizado fuera de línea determinista separada con composición WebCodecs MP4/WebM, geometría compartida, mezcla de audio, subtítulos, superposiciones, efectos y un respaldo de MediaRecorder. Los clips de audio o las mezclas completas de la línea de tiempo se pueden exportar como WAV o MP3 con recorte, velocidad, volumen, fundidos y efectos espaciales aplicados. La aplicación se puede instalar como una PWA con un shell en caché e interfaz multilingüe. El conjunto de herramientas de IA del navegador incluye voz en off multilingüe con opciones de voz en chino, chino/inglés mixto, inglés, alemán, español, francés, italiano y portugués brasileño; generación de música local basada en Stable Audio con traducción de indicaciones y duraciones seleccionables; subtítulos automáticos basados en Whisper; encuadre inteligente basado en YOLOS y MODNet, evitación de subtítulos, recorte de retratos y eliminación de fondo; eliminación de marcas de agua/objetos MI-GAN con regiones temporizadas; restauración NanoVSR; separación vocal; y generación de humano digital JoyVASA más LivePortrait. Los modelos grandes se cargan de forma diferida, se fijan por revisión y se almacenan en caché mediante el service worker. Los flujos de trabajo admitidos pueden ejecutarse sin cargar los medios del proyecto en un backend de edición. Los modelos se reflejan en Hugging Face y ModelScope con respaldo automático de fuente e identidades de caché compartidas. Para los agentes de IA, el repositorio incluye una habilidad de edición para Codex, Claude Code, Copilot y Gemini CLI. Un ejecutor de comandos headless versionado puede inspeccionar proyectos y pistas, validar planes de edición JSON, mostrar diferencias predichas, aplicar operaciones admitidas de forma transaccional, realizar ejecuciones de prueba, usar IDs de operación idempotentes, importar medios con hash y renderizar un subconjunto portátil documentado de Visuales + Voz en off + Música a H.264/AAC MP4. La integración WebMCP del navegador expone herramientas para inspección estructurada, ediciones revisadas de la línea de tiempo, inserción de activos e imagen en imagen, muestreo de fotogramas renderizados y audio, trabajos locales de voz en off y transcripción, deshacer protegido, guardado de proyectos y exportación con progreso, metadatos de salida y cancelación. La configuración de desarrollo requiere Node.js 20+ y un navegador Chromium moderno, recomendándose WebGPU para flujos de trabajo de IA más pesados; la documentación de la CLI del agente especifica Node.js 22.20.0 o posterior. El código fuente original tiene licencia MIT, mientras que los modelos, pesos, conjuntos de datos, fuentes, medios de archivo y otros activos descargados de terceros permanecen bajo sus licencias ascendentes separadas. El README también incluye requisitos de uso responsable para funciones de síntesis profunda, incluyendo imágenes autorizadas y sin contenido ilegal, engañoso o de suplantación.