프로젝트 소개

Mimora는 언어 학습자와 악센트 감소를 위해 설계된 오프라인, 개인정보 보호 중심의 발음 트레이너입니다. 이 앱은 텍스트-음성 변환(TTS), 음성 인식, 그리고 문장 생성을 위해 로컬 모델을 활용하여 사용자 기기에서만 작동합니다. 핵심 워크플로우는 로컬 LLM이 사용자 제공 텍스트에서 문장을 생성하고, 이를 일관된 TTS 음성이 발음하는 것입니다. 사용자는 문장을 반복하고, Mimora는 녹음을 참조 오디오와 비교하여 100점 만점의 점수를 제공하고 개선이 필요한 특정 단어를 강조 표시합니다. 이 앱은 영어(미국 및 영국)와 스페인어(카스티야)를 지원하며, 영어는 완전히 보정되었고 스페인어는 현재 실험 단계입니다. 주요 기능으로는 원터치 녹음, 자동 침묵 감지, 그리고 비교를 위한 참조 및 사용자 녹음 재생이 있습니다. Mimora는 IPA 음소를 비교하는 기본 '음소' 엔진과 오디오 임베딩을 비교하는 '음향' 엔진의 두 가지 점수화 엔진을 제공합니다. 이 앱은 표준 하드웨어(16 GB RAM, GPU 불필요)에서 실행되며 Windows, macOS, 그리고 Linux를 지원합니다. 설치는 `uv` 또는 `pipx`를 통해 권장되며, 모델은 첫 실행 시 다운로드됩니다. 설정 창에서는 언어, 악센트, 음성, 속도, 그리고 번역 옵션을 조정할 수 있으며, 느린 기계를 위한 'No-LLM 모드'도 지원합니다.