프로젝트 소개

audio.cpp는 ggml로 구동되는 오디오 모델용 올인원 순수 C++ 추론 엔진입니다. 복잡한 Python 환경을 제거하고 다양한 오디오 작업을 위한 공유 네이티브 런타임을 제공합니다. 주요 기능은 다음과 같습니다: - **광범위한 모델 지원**: 텍스트 음성 변환(TTS), 자동 음성 인식(ASR), 음성 활동 감지(VAD), 음성 복제, 음성 변환, 음악 생성, 소스 분리, 화자 분리 등 80개 이상의 모델 제품군과 120개 이상의 변형을 지원합니다. - **고성능**: CUDA, Metal, ROCm, Vulkan 및 CPU에 최적화되어 있습니다. Python 경로보다 최대 8배 빠른 상당한 속도 향상과 지연 시간 감소를 달성합니다. - **GGUF 형식**: GGUF 모델 형식을 완전히 지원하며, 최적화된 Q8 및 기타 양자화 패키지를 통해 메모리 사용과 속도를 효율적으로 개선합니다. - **휴대성**: Windows, Linux, macOS에서 실행되며 NVIDIA, AMD 및 Apple Silicon GPU를 지원합니다. - **프로덕션 준비**: 재사용 가능한 세션, 배치 오프라인 추론, 스트리밍 지원, 내장 오디오 유틸리티(노이즈 제거, 리샘플링, STFT), 다단계 워크플로우를 위한 JSON 파이프라인 지원을 제공합니다. - **사용자 인터페이스**: 명령줄 인터페이스(CLI), API 서버, 그리고 모델 간 비교를 위한 Arena 탭이 있는 네이티브 WebUI를 포함합니다.