このプロジェクトについて
X-AnyLabelingは、AI支援によるデータアノテーションのための軽量かつ統合的なクロスプラットフォームデスクトップアプリケーションです。テキスト、画像、動画、マルチモーダルデータのアノテーションと処理に対応し、画像分類、物体検出、インスタンスセグメンテーション、姿勢推定、回転物体検出、複数物体追跡、OCR、レーンアノテーション、画像キャプション生成、視覚的質問応答、文書解析など幅広いタスクをカバーします。
本ツールは、ポリゴン、矩形、直方体、回転ボックス、四角形、円、線、ポリライン、点、マスクといった形状タイプを提供し、さらにテキスト検出、テキスト認識、重要情報抽出などタスク固有のユーティリティも備えています。支援アノテーションおよび自動アノテーションのために幅広いモデル群を統合しており、YOLO系、SAM系モデル、PP-OCR、深度推定、トラッキング、グラウンディング、ビジョン言語モデルなどが利用できます。
ローカルおよびリモート推論には、ONNX Runtime、TensorRT、OpenCV DNN、vLLM、SGLangなどのエンジンやサービングフレームワークを使用できます。また、カスタムモデルや計算リソースを接続するためのオプションのコンパニオンサーバープロジェクトも用意されています。
COCO、VOC、YOLO、DOTA、MOT、MASK、PPOCR、MMGD、VLM-R1、ShareGPTなどの形式でのインポートとエクスポートに対応しています。Windows、Linux、macOSで動作し、英語、簡体字中国語、日本語、韓国語のインターフェースを提供します。カスタムモデル統合、コマンドラインでの使用、二次開発にも対応しています。
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.