这个项目能做什么
Mimora 是一个离线、注重隐私的发音训练器,专为语言学习者和口音校正设计。它完全在用户机器上运行,利用本地模型进行文本转语音 (TTS)、语音识别和短语生成。核心工作流程是本地 LLM 从用户提供的文本生成短语,然后由一致的 TTS 语音朗读。用户重复该短语,Mimora 会将录音与参考音频进行分析,提供 0 到 100 的评分,并突出显示需要改进的特定单词。该应用支持英语(美国和英国)和西班牙语(卡斯蒂利亚),其中英语已完全校准,西班牙语目前处于实验阶段。主要功能包括一键录音、自动静音检测,以及重放参考和用户录音进行比较的能力。Mimora 提供两种评分引擎:默认的“音素”引擎,比较 IPA 音素;以及“声学”引擎,比较音频嵌入。它运行在标准硬件上(16 GB RAM,无需 GPU),并支持 Windows、macOS 和 Linux。建议通过 `uv` 或 `pipx` 安装,模型在首次运行时下载。该应用包含一个设置窗口,用于调整语言、口音、声音、速度和翻译选项,并支持“无 LLM 模式”,供机器较慢的用户使用,在这种模式下,短语直接取自用户文本。
评论
0 评分人数达到10人后显示
登录后参与讨论。