프로젝트 소개

trtvideo는 TensorRT 모델을 사용하여 헤드리스 파일-투-파일 비디오 처리를 위해 설계된 전문 런타임입니다. 이 런타임은 디코딩을 위한 NVDEC, 전처리 및 후처리를 위한 CV-CUDA, 추론을 위한 TensorRT, 인코딩을 위한 NVENC를 활용하여 전체 프로세스 동안 원본 비디오 프레임이 VRAM에 유지되도록 비디오 파이프라인을 최적화합니다. 이러한 아키텍처는 호스트-디바이스 간의 메모리 전송을 최소화하여, 기존 파이프라인에 비해 CPU 사용량을 낮추고 피크 VRAM 사용량을 줄여줍니다. 주요 특징은 다음과 같습니다: - GPU 상주 경로: 압축된 입력부터 뮤싱된 출력까지 통합된 파이프라인 제공. - Docker 기반 배포: 재현 가능한 실행을 위해 프로덕션 및 모델 툴 이미지로 제공. - 모델 호환성: RealESRGAN_x2plus 및 SPAN과 같은 초해상도 모델에 대해 검증된 지원. - 툴링: PyTorch 체크포인트를 ONNX로 내보내고, 정적 TensorRT 엔진을 준비하며, 호환성 검사를 수행하는 유틸리티 포함. - 성능: NVIDIA RTX 3090 및 4090 GPU에서 엔드-투-엔드 FPS 및 리소스 효율성 측면의 처리량 이점 측정.