このプロジェクトについて
audio.cppは、ggmlを搭載したオーディオモデル向けのオールインワン純C++推論エンジンです。複雑なPython環境を不要にし、さまざまなオーディオタスクに共通のネイティブランタイムを提供します。主な特徴は以下の通りです。
- **幅広いモデルサポート**: テキスト読み上げ(TTS)、自動音声認識(ASR)、音声活動検出(VAD)、音声クローン、音声変換、音楽生成、音源分離、話者ダイアライゼーション向けに、80以上のモデルファミリーと120以上のバリアントをサポート。
- **高性能**: CUDA、Metal、ROCm、Vulkan、CPU向けに最適化。Pythonパスと比較して最大8倍の高速化と低レイテンシを実現。
- **GGUF形式**: GGUFモデル形式を完全サポートし、最適化されたQ8やその他の量子化パッケージにより、メモリ効率と速度を向上。
- **ポータビリティ**: Windows、Linux、macOSで動作し、NVIDIA、AMD、Apple Silicon GPUをサポート。
- **本番環境対応**: 再利用可能なセッション、バッチオフライン推論、ストリーミングサポート、組み込みオーディオユーティリティ(ノイズ除去、リサンプリング、STFT)、マルチステップワークフロー向けJSONパイプラインサポートを搭載。
- **ユーザーインターフェース**: コマンドラインインターフェース(CLI)、APIサーバー、モデル比較用のArenaタブ付きネイティブWebUIを含む。
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.