Sobre o projeto
audio.cpp é um motor de inferência tudo-em-um, puramente em C++, para modelos de áudio, alimentado por ggml. Ele elimina a necessidade de ambientes Python complexos, fornecendo um runtime nativo compartilhado para várias tarefas de áudio. Os principais recursos incluem:
- **Suporte Amplo a Modelos**: Suporta mais de 80 famílias de modelos e 120+ variantes para Texto-para-Fala (TTS), Reconhecimento Automático de Fala (ASR), Detecção de Atividade de Voz (VAD), clonagem de voz, conversão de voz, geração de música, separação de fontes e diarização de falantes.
- **Alto Desempenho**: Otimizado para CUDA, Metal, ROCm, Vulkan e CPU. Alcança acelerações significativas (até 8x mais rápido que caminhos Python) e latência reduzida.
- **Formato GGUF**: Suporta totalmente o formato de modelo GGUF, com pacotes quantizados otimizados Q8 e outros para uso eficiente de memória e velocidade.
- **Portabilidade**: Executa em Windows, Linux e macOS, suportando GPUs NVIDIA, AMD e Apple Silicon.
- **Prontidão para Produção**: Apresenta sessões reutilizáveis, inferência offline em lote, suporte a streaming, utilitários de áudio integrados (remoção de ruído, reamostragem, STFT) e suporte a pipelines JSON para fluxos de trabalho de múltiplas etapas.
- **Interfaces de Usuário**: Inclui uma interface de linha de comando (CLI), um servidor de API e uma WebUI nativa com uma aba Arena para comparação lado a lado de modelos.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.