프로젝트 소개

Video-subtitle-remover(VSR)는 AI 기술을 기반으로 한 비디오 하드 자막 제거 소프트웨어입니다. 주요 기능은 다음과 같습니다: 무손실 해상도로 비디오 하드 자막을 제거하고 파일을 생성합니다. AI 알고리즘 모델을 통해 자막 제거 영역을 워 복원합니다(비인접 픽셀 채 및 모자이크 제거). 원본 비디오 자막을 추출합니다(video-subtitle-extractor와 함께 사용 가능). 사용자가 지정한 자막 위치에서 해당 영역의 자막만 제거할 수 있습니다. 전체 비디오의 모든 텍스트를 자동으로 제거할 수 있습니다. 다중 이미지를 선택하여 워터마크 텍스트를 일괄 제거할 수 있습니다. 소프트웨어는 GUI 그래픽 인터페이스와 명령줄 두 가지 사용 방식을 제공합니다. 명령에서는 입력 및 출력 파일 경로, 자막 영역 좌표, 다양한 복원 모드(sttn-auto, sttn-det, lama, propainter, opencv)를 지정할 수 있습니다. 다양한 사전 빌드 패키지를 제공하여 다양한 환경에 맞춥니다: Windows CPU 범용 버전, Windows DirectML 버전(비 Nvidia 그래픽 카드), Windows Nvidia CUDA 11.8/12.6/12.8 버전으로, 다양한 퓨팅 능력 범위의 GPU를 지원합니다. 또한 Docker 이미지를 제공하여 Nvidia 10-50 시리즈 그래픽 카드, AMD/Intel 그래픽 카드 및 CPU 실행을 지원합니다. 소스 코드 설치는 CUDA(NVIDIA 가속), CPU, DirectML(AMD/Intel 가속), macOS(Apple Silicon) 네 가지 실행 모드를 지원합니다. Python 3.12 이상이 필요하며, PaddlePaddle과 PyTorch 등의 라이브러리에 의존합니다. 자주 묻는 문에서는 세 가지 복원 알고리즘의 특을 소개합니다: STTN 알고리즘은 실사 비디오에서 효과가 좋고 속도가 빠르, 자막 감지를 건너뛸 수 있습니다. LAMA 알고리즘은 이미지와 애니메이션 비디오에서 효과가 좋습니다. ProPainter 알고리은 움직임이 심한 비디오에서 효과가 좋지만, 많은 VRAM이 필요하고 속도가 느립니다. 사용자는 설정 매개변수를 조정하여 처리 속도와 과를 조절할 수 있으며, 프로젝트에서 제공하는 훈련 코드를 활용해 직접 모델을 련하여 기본 모델을 교체할 수도 있습니다.