इस प्रोजेक्ट के बारे में
Auralis को एक ओपन-सोर्स "एम्बिएंट इंटेलिजेंस इंजन" के रूप में प्रस्तुत किया गया है जो लिखित सामग्री को साधारण भाषण के बजाय परतदार श्रवण अनुभवों में बदलता है। README के अनुसार, यह टेक्स्ट संरचना (शीर्षक, सूचियाँ, उद्धरण, कोड ब्लॉक) का विश्लेषण करता है, भावनात्मक स्वर को स्कोर करता है, और उन संकेतों को वॉइस चयन, एम्बिएंट टेक्सचर, रीवर्ब और स्थानिक स्थिति जैसे ऑडियो पैरामीटर से मैप करता है।
बताई गई क्षमताओं में सिमेंटिक ऑडियो मैपिंग, एक इमोशनल रेज़ोनेंस इंजन जो पिच, टेम्पो और ब्रीदीनेस को समायोजित करता है, बाइनॉरल पैनिंग और रूम सिमुलेशन, और 47 भाषा प्रोफाइलों को कवर करने वाली फोनीम लाइब्रेरी शामिल है, जिसमें टोनल भाषाएँ भी हैं। वॉइस पैक, एम्बिएंट जेनरेटर और कस्टम प्रोसोडी मॉडल के लिए एक प्लगइन आर्किटेक्चर का वर्णन किया गया है।
परियोजना प्राइवेसी-प्रथम प्रोसेसिंग का दावा करती है, जिसमें ऑडियो जनरेशन स्थानीय रूप से या उपयोगकर्ता के अपने इंफ्रास्ट्रक्चर पर होता है, जब तक क्लाउड एन्हांसमेंट स्पष्ट रूप से सक्षम न किया जाए। उल्लिखित अडैप्टिव स्ट्रीमिंग सुविधाओं में बिटरेट स्केलिंग, पॉज़/रिज़्यूम बुकमार्किंग, स्लीप टाइमर और ऑफलाइन कैशिंग शामिल हैं।
सूचीबद्ध इच्छित उपयोग हैं ऑडियोबुक उत्पादन, शैक्षिक और एक्सेसिबिलिटी सामग्री, कोड डॉक्युमेंटेशन प्लेबैक, भाषा सीखना, ध्यान और कहानी सुनाना, और WCAG ऑडियो विकल्प। README में सामुदायिक योगदान पथ, डॉक्युमेंटेशन, एक फोरम, मासिक रिलीज़ और MIT लाइसेंस का भी वर्णन है।
नोट: रिपॉज़िटरी विवरण में एक वीडियो डाउनलोडर का उल्लेख है, जो README सामग्री से मेल नहीं खाता; README स्वयं एक ऑडियो/टेक्स्ट-टू-एक्सपीरियंस इंजन का वर्णन करता है। कोई इंस्टॉलेशन कमांड नहीं दिए गए हैं, और डाउनलोड लिंक रिलीज़ एसेट्स के बजाय एक प्रोजेक्ट पेज की ओर इशारा करते हैं। प्रदर्शन, सपोर्ट प्रतिक्रिया समय और भाषा कवरेज के दावे परियोजना के अपने हैं और यहाँ स्वतंत्र रूप से सत्यापित नहीं हैं।
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.