MoneyPrinterTurbo é uma ferramenta tudo-em-um de geração de vídeos curtos com IA: basta inserir um tema ou palavra-chave para gerar automaticamente roteiro, narração, materiais, legendas, trilha sonora e edição, produzindo vídeos em alta definição 9:16, 16:9 e 1:1, com suporte a WebUI, API, CLI e AI Agent.
Código aberto. Novas possibilidades.
Descubra projetos open source de qualidade, envie projetos anonimamente e reivindique e edite seu próprio projeto.
Um pouco de curiosidade. Um mundo de código aberto.
THE FIRST COLLECTIONMimora é um treinador de pronúncia gratuito e totalmente local para inglês e espanhol. Ele usa TTS on-device, reconhecimento de fala e um LLM local para gerar frases e pontuar tentativas do usuário com feedback de nível de palavra, sem exigir nuvem ou chaves de API.
Unsloth é um aplicativo de desktop e framework para executar e treinar grandes modelos de linguagem (LLMs) e modelos de difusão localmente no Windows, macOS e Linux.
Zara é um assistente de IA experimental local-first e copilot para desktop Linux que combina lógica simbólica (Prolog) com LLMs para processamento de intenções e raciocínio.
VoxCPM2 é um sistema de texto para fala sem tokenização com um modelo autoregressivo de difusão de 2B que suporta 30 idiomas, design de voz a partir de descrições de texto, clonagem de voz controlável e saída de áudio de 48 kHz.
Um servidor MCP projetado para ensinar musicalidade à IA através de piano e guitarra. Possui 120 músicas anotadas, seis motores de som, um cockpit de composição baseado em navegador e um conjunto de dados público de rastros de uso de ferramentas.
Velo AI Studio é uma ferramenta de criação de vídeo baseada em navegador e de código aberto, projetada para montar vídeos narrados a partir de roteiros, áudio e ativos visuais gerados por IA.
TaleWeaver é um motor de aventura de texto baseado em navegador, auto-hospedado, com mestre de jogo de IA, editor de aventuras, mecânicas de RPG, narração por voz/entrada de fala e implantação com Docker/SQLite.
OpenMontage é um sistema de produção de vídeo agentic de código aberto que transforma assistentes de codificação de IA em estúdios de vídeo completos, suportando pipelines de ponta a ponta, da pesquisa à renderização final.
ChatTTS é um modelo de síntese de voz de código aberto voltado para cenários de diálogo, suportando inglês e chinês com saída de múltiplos falantes e controle fino de risos, pausas e prosódia.
GPT-SoVITS é um sistema open-source de conversão de voz e TTS few-shot que suporta clonagem de voz zero-shot (5s) e few-shot (1min) em chinês, japonês, coreano, cantonês e inglês, com ferramentas WebUI integradas.
Ferramenta open-source para tradução de vídeos com reconhecimento de fala, tradução de legendas, dublagem por IA e clonagem de voz, com suporte a implantação local e APIs online.
O ESPnet é um kit de ferramentas de processamento de fala de ponta a ponta baseado em PyTorch, cobrindo ASR, TTS, tradução de fala, aprimoramento, diarização e mais, com receitas reproduzíveis e modelos pré-treinados.
Um plugin de LLM multimodal local para Unreal Engine 5 que oferece inferência offline para texto, fala para texto e texto para fala.
FunTTS é uma biblioteca de texto para fala com interface unificada, que suporta a alternância perfeita entre vários motores de TTS de código aberto, oferecendo geração de legendas, diálogos multi-personagens e processamento assíncrono.