OPEN SOURCE, OPEN TO EVERYONE

ओपन सोर्स। नई संभावनाएँ।

उत्कृष्ट ओपन-सोर्स प्रोजेक्ट खोजें, गुमनाम रूप से प्रोजेक्ट सबमिट करें और अपने प्रोजेक्ट का दावा कर उसे संपादित करें।

संपादकीय चयन · अच्छा ओपन सोर्स खोजें4092खोजे गए

जिज्ञासा के साथ ओपन सोर्स खोजें।

THE FIRST COLLECTION
Topic: speech-synthesis清除
speechNVIDIA-NeMo
नया

NVIDIA NeMo Speech एक Apache-2.0 PyTorch फ्रेमवर्क है जो स्पीच AI मॉडल बनाने, अनुकूलित करने और तैनात करने हेतु है, जिसमें ASR, TTS और स्पीच LLMs शामिल हैं, साथ ही पूर्व-प्रशिक्षित चेकपॉइंट्स और Docker/uv इंस्टॉल पथ उपलब्ध हैं।

कृत्रिम बुद्धिमत्तासंगीतModel runtime
funttsfarfarfun
नया

FunTTS एक एकीकृत इंटरफ़ेस वाली टेक्स्ट-टू-स्पीच लाइब्रेरी है, जो कई ओपन-सोर्स TTS इंजन के बीच निर्बाध स्विचिंग का समर्थन करती है और सबटाइटल जनरेशन, मल्टी-कैरेक्टर डायलॉग और एसिंक्रोनस प्रोसेसिंग जैसी सुविधाएँ प्रदान करती है।

डेवलपर टूलसंगीतTemplates & starters
speech-to-speechhuggingface
नया

Speech To Speech एक मॉड्यूलर वॉइस-एजेंट पाइपलाइन है जो VAD → STT → LLM → TTS की चार चरणों में काम करती है और WebSocket/WebRTC पर ओपनएआई Realtime ईवेंट सेट लागू करती है।

कृत्रिम बुद्धिमत्ताडेवलपर टूलAI assistants
voxcpmOpenBMB
नया

VoxCPM2 एक टोकन-रहित टेक्स्ट-टू-स्पीच सिस्टम है जिसमें 30 भाषाओं का समर्थन, टेक्स्ट से वॉइस डिज़ाइन, नियंत्रित वॉइस क्लोनिंग और 48kHz ऑडियो आउटपुट वाली 2B डिफ्यूज़न ऑटोरेग्रेसिव मॉडल शामिल है।

कृत्रिम बुद्धिमत्तासंगीतMultimodal AI