Sobre o projeto

audio.cpp é um motor de inferência tudo-em-um, puramente em C++, para modelos de áudio, alimentado por ggml. Ele elimina a necessidade de ambientes Python complexos, fornecendo um runtime nativo compartilhado para várias tarefas de áudio. Os principais recursos incluem: - **Suporte Amplo a Modelos**: Suporta mais de 80 famílias de modelos e 120+ variantes para Texto-para-Fala (TTS), Reconhecimento Automático de Fala (ASR), Detecção de Atividade de Voz (VAD), clonagem de voz, conversão de voz, geração de música, separação de fontes e diarização de falantes. - **Alto Desempenho**: Otimizado para CUDA, Metal, ROCm, Vulkan e CPU. Alcança acelerações significativas (até 8x mais rápido que caminhos Python) e latência reduzida. - **Formato GGUF**: Suporta totalmente o formato de modelo GGUF, com pacotes quantizados otimizados Q8 e outros para uso eficiente de memória e velocidade. - **Portabilidade**: Executa em Windows, Linux e macOS, suportando GPUs NVIDIA, AMD e Apple Silicon. - **Prontidão para Produção**: Apresenta sessões reutilizáveis, inferência offline em lote, suporte a streaming, utilitários de áudio integrados (remoção de ruído, reamostragem, STFT) e suporte a pipelines JSON para fluxos de trabalho de múltiplas etapas. - **Interfaces de Usuário**: Inclui uma interface de linha de comando (CLI), um servidor de API e uma WebUI nativa com uma aba Arena para comparação lado a lado de modelos.