इस प्रोजेक्ट के बारे में

Mimora एक ऑफलाइन, गोपनीयता-केंद्रित उच्चारण ट्रेनर है जो भाषा सीखने वालों और लहजे में सुधार करने वालों के लिए डिज़ाइन किया गया है। यह पूरी तरह से उपयोगकर्ता की मशीन पर चलता है, टेक्स्ट-टू-स्पीच (TTS), भाषण पहचान, और वाक्यांश निर्माण के लिए स्थानीय मॉडल का उपयोग करता है। मुख्य कार्य流程 में एक स्थानीय LLM द्वारा उपयोगकर्ता द्वारा प्रदान किए गए पाठ से वाक्यांशों का निर्माण शामिल है, जिन्हें फिर एक स्थिर TTS आवाज द्वारा बोला जाता है। उपयोगकर्ता वाक्यांश को दोहराता है, और Mimora संदर्भ ऑडियो के खिलाफ रिकॉर्डिंग का विश्लेषण करता है, 100 में से एक स्कोर प्रदान करता है और उन विशिष्ट शब्दों को हाइलाइट करता है जिन्हें सुधार की आवश्यकता है। ऐप अंग्रेजी (अमेरिकन और ब्रिटिश) और स्पैनिश (कास्टिलियन) को सपोर्ट करता है, जिसमें अंग्रेजी पूरी तरह से कैलिब्रेटेड है और स्पैनिश वर्तमान में प्रयोग के लिए है। प्रमुख विशेषताओं में एक-प्रेस रिकॉर्डिंग, स्वचालित मौन पहचान, और तुलना के लिए संदर्भ और उपयोगकर्ता रिकॉर्डिंग को फिर से चलाने की क्षमता शामिल है। Mimora दो स्कोरिंग इंजन प्रदान करता है: एक डिफ़ॉल्ट 'फोनम' इंजन जो IPA फोनम की तुलना करता है, और एक 'अコースटिक' इंजन जो ऑडियो एम्बेडिंग की तुलना करता है। यह मानक हार्डवेयर (16 GB RAM, कोई GPU की आवश्यकता नहीं) पर चलता है और Windows, macOS, और Linux को सपोर्ट करता है। इंस्टॉलेशन `uv` या `pipx` के माध्यम से करने की सिफारिश की जाती है, जिसमें मॉडल पहले रन पर डाउनलोड किए जाते हैं। ऐप में भाषा, लहजा, आवाज, गति, और अनुवाद विकल्पों को समायोजित करने के लिए एक सेटिंग्स विंडो शामिल है, और यह धीमी मशीनों के लिए 'No-LLM मोड' को सपोर्ट करता है जहां वाक्यांश उपयोगकर्ता के पाठ से verbatim लिए जाते हैं।