منصوبے کے بارے میں
whisper.cpp OpenAI کے Whisper ماڈل کا ایک سادہ C/C++ پورٹ ہے جو بھاری dependencies کے بغیر اعلیٰ کارکردگی والے speech-to-text inference کو ممکن بناتا ہے۔ اسے کارکردگی کے لیے ڈیزائن کیا گیا ہے، جس میں رن ٹائم پر زیرو میموری ایلوکیشنز اور mixed F16/F32 precision اور integer quantization کی سپورٹ شامل ہے۔
اہم صلاحیتوں میں شامل ہیں:
- وسیع ہارڈویئر ایکسلریشن: Apple Silicon (ARM NEON, Metal, Core ML)، x86 (AVX)، NVIDIA GPUs (CUDA)، AMD GPUs (ROCm)، Vulkan، OpenVINO، اور مختلف NPUs (AMD Ryzen AI, Ascend) کے لیے موزوں۔
- وسیع پلیٹ فارم سپورٹ: macOS، iOS، Android، Linux، FreeBSD، Windows، WebAssembly، اور Raspberry Pi کے ساتھ ہم آہنگ۔
- جدید خصوصیات: اس میں Voice Activity Detection (VAD)، ریئل ٹائم آڈیو ان پٹ اسٹریمنگ، لفظ کی سطح کے ٹائم اسٹیمپس، اور ٹرانسکرپشنز کے لیے confidence color-coding شامل ہے۔
- انٹیگریشن: مختلف ماحول میں آسان تعیناتی کے لیے C-style API اور Docker images فراہم کرتا ہے۔