OPEN SOURCE, OPEN TO EVERYONE

مصدر مفتوح. آفاق جديدة.

اكتشف مشاريع مفتوحة المصدر عالية الجودة، وأرسل المشاريع بشكل مجهول، وطالب بمشروعك المفتوح المصدر وحرّره.

اختيار بشري · اكتشف مصادر مفتوحة جيدة4494تم اكتشافها

فضول صغير. عالم من المصادر المفتوحة.

THE FIRST COLLECTION
Topic: audio清除
جديد

Basic Pitch هي مكتبة بايثون خفيفة من Spotify لتحويل الموسيقى تلقائياً، مستقلة عن الآلة. تحوّل الملفات الصوتية إلى MIDI مع كشف انحناء النغمة، وتدعم الآلات متعددة الأصوات، وتوفر واجهات سطر أوامر وبرمجية.

الموسيقىالذكاء الاصطناعيMusic generation
جديد

SpeechRecognition مكتبة بايثون للتعرف على الكلام تدعم محركات وواجهات متعددة عبر الإنترنت ودون اتصال، بما في ذلك CMU Sphinx وGoogle وAzure وIBM وVosk وWhisper وOpenAI.

الذكاء الاصطناعيأدوات التطويرMultimodal AI
scriberrrishikanthc
جديد

تطبيق مفتوح المصدر لنسخ الصوت والفيديو محليًا دون اتصال، يستخدم نماذج Whisper وNVIDIA Parakeet وCanary بدقة عالية، مع ميزات تمييز المتحدثين وتكامل مع LLM.

استضافة ذاتيةالذكاء الاصطناعيHome & personal services
promptslicevasylNaumenko
جديد

إضافة VST3/AU تدمج توليد الأصوات من ElevenLabs مباشرة في محطة العمل الصوتية الرقمية (DAW) لإنشاء وتقطيع المؤثرات الصوتية.

الموسيقىالذكاء الاصطناعيDAW & production
audiopytorch
جديد

torchaudio هي مكتبة معالجة صوتية لـ PyTorch، توفر تحميل بيانات مسرع بواسطة GPU، وتحويلات صوتية (مثل المخططات الطيفية وMFCC)، وأدوات محاذاة الكلام لتطبيقات التعلم الآلي.

أدوات التطويرالذكاء الاصطناعيComponent libraries
audio.cpp0xShug0
جديد

audio.cpp هو محرك استدلال صوتي عالي الأداء مكتوب بلغة C++ النقية ويعتمد على ggml. يدعم تحويل النص إلى كلام، التعرف على الكلام، استنساخ الصوت، كشف النشاط الصوتي، توليد الموسيقى وغيرها، مع نشر محلي سريع وقابل للنقل دون اعتماد على بايثون.

الذكاء الاصطناعيأدوات التطويرMultimodal AI
voxcpmOpenBMB
جديد

VoxCPM2 هو نظام تحويل النص إلى كلام مفتوح المصدر من OpenBMB، يستخدم نموذج انتشار ذاتي راجعي بحجم 2 مليار معامل، ويدعم 30 لغة بما في ذلك اللهجات الصينية، مع تصميم الصوت عبر أوصاف نصية واستنساخ صوتي قابل للتحكم وإخراج صوتي بدقة 48 كيلو هرتز.

الذكاء الاصطناعيالموسيقىMultimodal AI