Sobre o projeto

Edit Mind é um aplicativo local-first para criar uma base de conhecimento pesquisável a partir de arquivos de vídeo armazenados em um computador ou servidor. O README informa que o projeto está em desenvolvimento ativo e ainda não está pronto para produção. A versão auto-hospedada é implantada com Docker Compose, com um arquivo Compose CUDA opcional para configurações com GPU NVIDIA. A configuração usa arquivos .env e .env.system para a pasta de mídia, provedor de NLP, chaves de API, chave de criptografia e segredo de sessão. Também é fornecido um script de instalação baseado em curl. Depois de iniciar sessão no aplicativo web, adicionar uma pasta de mídia e executar uma nova varredura, um serviço em segundo plano monitora novos arquivos de vídeo e os coloca na fila para análise. Os recursos de análise documentados incluem transcrição de áudio com OpenAI Whisper, reconhecimento facial, detecção de objetos e texto, análise de cenas e embedding multimodal. O ChromaDB alimenta a busca semântica baseada em vetores, permitindo consultas em linguagem natural em vídeos e cenas específicas. O PostgreSQL é usado por meio do Prisma para dados relacionais do aplicativo. O NLP pode ser configurado com modelos locais do Ollama ou com Google Gemini. A base de código é um monorepositório pnpm que usa React Router, TypeScript e Vite para a interface web; Node.js, Express e BullMQ para trabalhos em segundo plano; e Python, PyAV e PyTorch para serviços de aprendizado de máquina. O aplicativo web é exposto na porta 3745. Uma edição comercial separada para desktop para macOS e Windows é anunciada com instalação em um clique e integração com DaVinci Resolve e Final Cut Pro, enquanto a versão auto-hospedada baseada em Docker é apresentada como gratuita. O README refere-se a uma Edit Mind License personalizada, em vez de identificar uma licença de código aberto padrão.