このプロジェクトについて

Video-subtitle-remover (VSR) はAI技術を基盤とした動画ハード字幕除去ソフトウェアです。主な機能は以下の通りです:解像度を劣化させずに動画のハード字幕を除去してファイルを生成する;AIアルゴリズムモデルを用いて字幕を除去した領域を補修する(隣接ピクセル補填やモザイク除去ではない);元の動画の字幕を抽出する(video-subtitle-extractorと併用可能);字幕の位置をカスタマイズして指定領域の字幕のみを除去する;動画全体のテキストを自動で除去する;複数画像を選択してウォーターマークやテキストを一括除去する。 ソフトウェアはGUIグラフィカルインターフェースとコマンドラインの2つの利用方法を提供しています。コマンドラインでは、入力・出力ファイルパス、字幕領域の座標、複数の補修モード(sttn-auto、sttn-det、lama、propainter、opencv)の指定に対応しています。 複数のプリビルドパッケージを提供し、異なる環境に対応しています:Windows CPU汎用版、Windows DirectML版(Nvidia製GPU以外向け)、Windows Nvidia CUDA 11.8/12.6/12.8版で、異なる計算能力範囲のGPUをカバーしています。またDockerイメージも提供しており、Nvidia 10~50シリーズGPU、AMD/Intel製GPUおよびCPUでの実行に対応しています。 ソースコードからのインストールでは、CUDA(NVIDIAアクセラレーション)、CPU、DirectML(AMD/Intelアクセラレーション)、macOS(Apple Silicon)の4つの実行モードに対応しています。Python 3.12以上が必要で、PaddlePaddleやPyTorchなどのライブラリに依存しています。 よくある質問では、3つの補修アルゴリズムの特徴を紹介しています:STTNアルゴリズムは実写動画での効果が高く処理速度が速く、字幕検出をスキップできる;LAMAアルゴリズムは画像やアニメーション類の動画での効果が高い;ProPainterアルゴリズムは動きの激しい動画での効果が高いが、多くのVRAMを必要とし処理速度が遅い。ユーザーはパラメータを調整して処理速度と効果を変更できるほか、プロジェクトが提供する学習コードを用いて独自にモデルを学習し、デフォルトモデルと置き換えることも可能です。