프로젝트 소개

X-AnyLabeling은 AI 보조 데이터 주석 처리를 위한 가볍고 통합된 크로스플랫폼 데스크톱 애플리케이션입니다. 텍스트, 이미지, 비디오, 멀티모달 데이터의 라벨링과 처리를 지원하며, 이미지 분류, 객체 탐지, 인스턴스 분할, 자세 추정, 회전 객체 탐지, 다중 객체 추적, OCR, 차선 주석, 이미지 캡셔닝, 시각 질의응답, 문서 파싱 등 다양한 작업을 포괄합니다. 이 도구는 폴리곤, 사각형, 직육면체, 회전 박스, 사각형, 원, 선, 폴리라인, 점, 마스크 등 다양한 도형 유형을 제공하며, 텍스트 탐지, 텍스트 인식, 핵심 정보 추출을 위한 작업별 유틸리티도 갖추고 있습니다. 보조 및 자동 라벨링을 위해 광범위한 모델 주를 통합하고 있으며, 여기에는 YOLO 변형, SAM 모델, PP-OCR, 깊이 추정, 추적, 그라운딩, 비전-언어 모델이 포함됩니다. 로컬 및 원격 추론에는 ONNX Runtime, TensorRT, OpenCV DNN, vLLM, SGLang과 같은 엔진 및 서빙 프레임워크를 사용할 수 있으며, 사용자 정의 모델과 컴퓨팅 자원을 연결하기 위한 선택적 컴패니언 서버 프로젝트도 제공합니다. 또한 COCO, VOC, YOLO, DOTA, MOT, MASK, PPOCR, MMGD, VLM-R1, ShareGPT 등 다양한 형식의 가져오기와 내보내기를 지원합니다. 이 애플리케이션은 Windows, Linux, macOS에서 실행되며 영어, 중국어 간체, 일본어, 한국어 인터페이스를 제공합니다. 사용자 정의 모델 통합, 명령줄 사용, 2차 개발도 지원합니다.