Sobre o projeto
Timeline Studio é um editor de vídeo open-source e local-first que roda no navegador. Ele oferece uma linha do tempo multi-track no estilo CapCut para visuais, sobreposições picture-in-picture, legendas, adesivos, narração, áudio fonte separado e música. Usuários humanos e agentes de IA podem trabalhar no mesmo projeto editável, com o arquivo .timeline portátil mantido como fonte da verdade, em vez de produzir apenas um vídeo renderizado opaco.
Os recursos de edição incluem seleção e transformação na tela, redimensionamento proporcional, rotação, máscaras, filtros, efeitos, animação, alterações de velocidade, keyframes explícitos, snapping, guias de alinhamento, operações de dividir/duplicar/excluir, zoom na linha do tempo e desfazer/refazer. A correção de cores para desktop suporta controles de temperatura, matiz, saturação, tonalidade, saturação de roda e luminância com keyframes. A pré-visualização usa reprodução de mídia nativa, enquanto a exportação usa um caminho de renderização offline determinístico separado com composição WebCodecs MP4/WebM, geometria compartilhada, mixagem de áudio, legendas, sobreposições, efeitos e um fallback MediaRecorder. Clipes de áudio ou mixes completos da linha do tempo podem ser exportados como WAV ou MP3 com corte, velocidade, volume, fades e efeitos espaciais aplicados. O aplicativo é instalável como PWA com shell em cache e interface multilíngue.
O conjunto de ferramentas de IA do navegador inclui narração multilíngue com opções de voz em chinês, chinês/inglês misturado, inglês, alemão, espanhol, francês, italiano e português brasileiro; geração de música local baseada em Stable Audio com tradução de prompt e durações selecionáveis; legendas automáticas baseadas em Whisper; enquadramento inteligente baseado em YOLOS e MODNet, prevenção de legendas, matting de retrato e remoção de fundo; remoção de marca d'água/objeto MI-GAN com regiões temporizadas; restauração NanoVSR; separação vocal; e geração de humano digital JoyVASA e LivePortrait. Modelos grandes são carregados de forma lazy, fixados por revisão e armazenados em cache pelo service worker. Os fluxos de trabalho suportados podem ser executados sem fazer upload da mídia do projeto para um backend de edição. Os modelos são espelhados no Hugging Face e ModelScope com fallback automático de fonte e identidades de cache compartilhadas.
Para agentes de IA, o repositório inclui uma skill de edição para Codex, Claude Code, Copilot e Gemini CLI. Um executor de comandos headless versionado pode inspecionar projetos e faixas, validar planos de edição JSON, mostrar diffs previstos, aplicar operações suportadas de forma transacional, realizar execuções de teste, usar IDs de operação idempotentes, importar mídia com hash e renderizar um subconjunto portátil documentado de Visuais + Narração + Música para H.264/AAC MP4. A integração WebMCP do navegador expõe ferramentas para inspeção estruturada, edições revisadas da linha do tempo, inserção de ativos e picture-in-picture, amostragem de quadros e áudio renderizados, trabalhos de narração e transcrição locais, desfazer protegido, salvamento de projeto e exportação com progresso, metadados de saída e cancelamento.
A configuração de desenvolvimento requer Node.js 20+ e um navegador Chromium moderno, com WebGPU recomendado para fluxos de trabalho de IA mais pesados; a documentação da CLI do agente especifica Node.js 22.20.0 ou posterior. O código-fonte original é licenciado sob MIT, enquanto modelos de terceiros, pesos, datasets, fontes, mídia de estoque e outros ativos baixados permanecem sob suas respectivas licenças upstream. O README também inclui requisitos de uso responsável para recursos de síntese profunda, incluindo imagens autorizadas e proibição de conteúdo ilegal, enganoso ou de personificação.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.