MoneyPrinterTurbo 是一站式 AI 短视频生成工具,只需输入主题或关键词,即可自动完成脚本、配音、素材、字幕、配乐和剪辑,输出 9:16、16:9、1:1 高清视频,支持 WebUI、API、CLI 与 AI Agent 四种使用方式。
好开源,值得被发现。
发现优质开源项目,匿名提交开源项目,认领编辑你的开源项目。
带着好奇心,发现开源世界。
THE FIRST COLLECTIONMimora 是一个免费、完全本地的英语和西班牙语发音训练器。它使用设备上的 TTS、语音识别和本地 LLM 来生成短语,并为用户尝试提供带有单词级反馈的评分,无需云服务或 API 密钥。
Unsloth 是一款适用于 Windows、macOS 和 Linux 的桌面应用程序和框架,旨在让用户能够在本地运行和训练大语言模型 (LLM) 及扩散模型。
Zara 是一款实验性的本地优先 AI 助手和 Linux 桌面 Copilot,它将符号逻辑 (Prolog) 与大语言模型 (LLM) 相结合,用于意图处理和推理。
VoxCPM2 是 OpenBMB 推出的开源无分词文本转语音系统,基于 2B 扩散自回归架构,支持 30 种语言及中文方言,具备文本描述配音、可控语音克隆和 48kHz 高保真输出等能力。
一个旨在通过钢琴和吉他教授 AI 音乐性的 MCP 服务器。它具备 120 首带注释的歌曲、六种声音引擎、基于浏览器的作曲驾驶舱以及一个公开的工具使用轨迹数据集。
Velo AI Studio 是一款开源的基于浏览器的视频创作工具,旨在通过脚本、音频和 AI 生成的视觉资产来组装旁白视频。
TaleWeaver 是一个自托管的基于浏览器的 AI 文字冒险引擎,具有 AI 游戏主持人、冒险编辑器、RPG 机制、语音旁白/语音输入,以及 Docker/SQLite 部署。
OpenMontage 是一个开源的智能体视频制作系统,旨在将 AI 编程助手转化为完整的视频工作室,支持从研究到最终渲染的端到端制作流程。
ChatTTS是一款开源的对话场景文本转语音模型,支持中英文,具备多说话人输出及对笑声、停顿和韵律的精细控制。
GPT-SoVITS 是由 RVC-Boss 开发的多功能语音克隆与文字转语音(TTS)WebUI 工具,支持零样本(5秒音频)和少样本(约1分钟数据)语音克隆,兼容中文、日语、韩语、粤语和英语等多种语言。内置音频分离、自动分轨、多语言 ASR 等功能,提供 WebUI 界面和命令行工具,支持 Windows、Linux、macOS 及 Docker 平台部署。
pyVideoTrans是一款支持本地离线部署与各类在线API的开源工具,可用于视频翻译、音频转录、AI配音及字幕翻译。
这是一个为 Unreal Engine 5 提供的本地多模态 LLM 插件,支持文本、语音转文本(STT)和文本转语音(TTS)的离线推理。
FunTTS 是一个统一接口的文本转语音库,支持多种开源TTS引擎无缝切换,提供字幕生成、多角色对话、异步处理等功能。