Sobre el proyecto

X-AnyLabeling 是一款轻量级、统一的跨平台桌面应用程序,用于 AI 辅助数据标注。它支持对文本、图像、视频和多模态数据进行标注与处理,涵盖图像分类、目标检测、实例分割、姿态估计、旋转目标检测、多目标跟踪、OCR、车道线标注、图像描述生成、视觉问答和文档解析等任务。该工具提供多种形状类型,包括多边形、矩形、长方体、旋转框、四边形、圆形、直线、折线、点和掩码,并提供面向特定任务的实用功能,如文本检测、文本识别和关键信息提取。它集成了广泛的模型库以支持辅助和自动标注,包括 YOLO 系列变体、SAM 模型、PP-OCR、深度估计、跟踪、定位以及视觉-语言模型。本地和远程推理可使用 ONNX Runtime、TensorRT、OpenCV DNN、vLLM 和 SGLang 等引擎与服务框架,并提供可选的配套服务器项目,用于连接自定义模型和计算资源。它支持导入和导出多种格式,如 COCO、VOC、YOLO、DOTA、MOT、MASK、PPOCR、MMGD、VLM-R1 和 ShareGPT。该应用可运行于 Windows、Linux 和 macOS,并提供英文、简体中文、日文和韩文界面。它还支持自定义模型集成、命令行使用和二次开发。