عن المشروع
audio.cpp هو محرك استدلال شامل مكتوب بلغة C++ النقية لنماذج الصوت، مدعوم بـ ggml. يلغي الحاجة إلى بيئات بايثون المعقدة، ويوفر وقت تشغيل أصلي مشترك لمهام صوتية متنوعة. تشمل الميزات الرئيسية:
- **دعم واسع للنماذج**: يدعم أكثر من 80 عائلة نماذج وأكثر من 120 متغيرًا لتحويل النص إلى كلام (TTS)، التعرف التلقائي على الكلام (ASR)، كشف النشاط الصوتي (VAD)، استنساخ الصوت، تحويل الصوت، توليد الموسيقى، فصل المصادر، وتحديد المتحدثين.
- **أداء عالٍ**: محسّن لـ CUDA وMetal وROCm وVulkan وCPU. يحقق تسريعات كبيرة (تصل إلى 8 مرات أسرع من مسارات بايثون) وتقليل زمن الاستجابة.
- **تنسيق GGUF**: يدعم بالكامل تنسيق نموذج GGUF، مع حزم Q8 المحسّنة وحزم كمية أخرى لاستخدام ذاكرة وسرعة فعالين.
- **قابلية النقل**: يعمل على ويندوز ولينكس وmacOS، ويدعم وحدات معالجة الرسوميات من NVIDIA وAMD وApple Silicon.
- **جاهزية الإنتاج**: يوفر جلسات قابلة لإعادة الاستخدام، استدلالًا غير متصل بالدفعات، دعم البث، أدوات صوتية مدمجة (إزالة الضوضاء، إعادة العينات، STFT)، ودعم خطوط أنابيب JSON لسير عمل متعدد الخطوات.
- **واجهات المستخدم**: يتضمن واجهة سطر أوامر (CLI)، خادم API، وواجهة ويب أصلية مع علامة تبويب Arena لمقارنة النماذج جنبًا إلى جنب.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.