OPEN SOURCE, OPEN TO EVERYONE

Открытый код. Новые возможности.

Находите качественные проекты с открытым исходным кодом, отправляйте проекты анонимно, заявляйте права на свои проекты и редактируйте их.

Выбор редакции · Находите хороший open source4109найдено

Немного любопытства. Мир открытого кода.

THE FIRST COLLECTION
Topic: ocr清除
bobripperhe
НОВОЕ

Bob — macOS-утилита для перевода и OCR в строке меню. Поддерживает выделение, скриншоты, ввод текста, распознавание QR-кодов и TTS. Интегрирует множество сервисов (Google, DeepL, Baidu и др.), включая офлайн-режим.

ПродуктивностьИИUtilities
НОВОЕ

AurexTranslator — кроссплатформенный переводчик в реальном времени для Windows и Linux (X11/XWayland). Он переводит текст, полученный с помощью OCR, из буфера обмена или напрямую из игрового процесса через подключаемые модули, специфичные для движка.

ПродуктивностьИгрыUtilities
НОВОЕ

VSE — это локальный инструмент для извлечения встроенных субтитров из видео с помощью глубокого обучения: он обнаруживает области субтитров и распознаёт текст через OCR, создавая внешние файлы SRT/TXT. Поддерживает 87 языков, пакетную обработку и GPU-ускорение, без вызова сторонних API.

Кино, видео и медиаИИSubtitles & animation
paddleocrPaddlePaddle
НОВОЕ

PaddleOCR — open-source OCR-инструментарий для конвертации PDF и изображений в структурированные данные (JSON/Markdown) для LLM. Включает PP-OCRv6 для распознавания 100+ языков, PaddleOCR-VL для анализа документов и PP-StructureV3 для структурированного преобразования с учётом макета.

ИИРазработкаMultimodal AI
tesseracttesseract-ocr
НОВОЕ

Tesseract — это OCR-движок с открытым исходным кодом, предоставляющий инструмент командной строки и библиотеку для распознавания текста на изображениях более чем на 100 языках.

ИИРазработкаMultimodal AI
paperless-ngxpaperless-ngx
НОВОЕ

Paperless-ngx — это система управления документами, которая превращает физические документы в доступный онлайн-архив с функцией поиска для сокращения использования бумаги.

ИгрыGame servers
НОВОЕ

Python-инструмент для локализации авторизованных видео с YouTube с помощью китайских субтитров и помощи в публикации на Bilibili. Поддерживает транскрибацию речи, OCR, перевод через LLM и рендеринг «вшитых» субтитров.

МузыкаAudio editing
skill_seekersyusufkaraaslan
НОВОЕ

Skill Seekers — CLI-инструмент для конвертации документации, репозиториев, PDF, видео в AI-скиллы для Claude, Gemini, OpenAI с обнаружением конфликтов и экспортом в 22 формата.

МузыкаDAW & production
pageledgerpeterbussch
НОВОЕ

PageLedger — это библиотека Python с CLI для аудируемого постраничного OCR и извлечения документов. Она фиксирует происхождение, сигналы качества и бюджеты для каждой извлечённой страницы, поддерживает возобновляемые запуски, очереди проверки и перезапуски с участием человека.

РазработкаИИCLI & terminal
mineruopendatalab
НОВОЕ

MinerU — это открытый движок разбора документов, преобразующий PDF, изображения, DOCX, PPTX и XLSX в структурированный Markdown/JSON для рабочих процессов LLM, RAG и агентов. Поддерживает двойные движки VLM+OCR, OCR на 109 языках и приватное/офлайн-развёртывание.

ИИРазработкаRAG & knowledge
НОВОЕ

Tesseract.js — JavaScript-библиотека для оптического распознавания символов (OCR), извлекающая текст из изображений более чем на 100 языках. Работает в браузере через WebAssembly и в Node.js, обёртывая движок Tesseract без изменения модели распознавания.

РазработкаИИComponent libraries
easyocrJaidedAI
НОВОЕ

EasyOCR — готовая к использованию библиотека оптического распознавания символов, поддерживающая более 80 языков и основные системы письма. Простой Python API и CLI, модели на PyTorch, возможность обучения собственных моделей.

ИИРазработкаMultimodal AI
dolphinbytedance
НОВОЕ

Dolphin — это открытая модель ByteDance для разбора изображений документов (ACL 2025), преобразующая PDF и фотографии страниц в структурированные Markdown/JSON, охватывая разметку, порядок чтения, текст, таблицы, формулы и код.

ИИПродуктивностьMultimodal AI
НОВОЕ

X-AnyLabeling — кроссплатформенное настольное приложение для AI-ассистированной разметки изображений, видео, текста и мультимодальных данных. Включает множество моделей, разнообразные инструменты аннотации и импорт/экспорт популярных форматов.

ИИРазработкаTraining & evaluation
aksharamdK2alyan
НОВОЕ

AksharaMD — локальный инструмент, не зависящий от парсера, оценивающий качество преобразования исходного файла в Markdown для ИИ. Возвращает оценку готовности документа, теги происхождения блоков, именованные предупреждения и вердикт ACCEPT/REJECT на основе исходника.

ИИРазработкаRAG & knowledge
umi-ocrhiroi-sora
НОВОЕ

Umi-OCR — бесплатная офлайн-программа OCR с открытым исходным кодом. Поддерживает распознавание по скриншоту, пакетную обработку изображений, PDF-документы, сканирование и генерацию QR-кодов, встроенные многоязычные модели, а также вызов через командную строку и HTTP API.

ПродуктивностьИИUtilities
ocrmypdfocrmypdf
НОВОЕ

OCRmyPDF — это инструмент командной строки, который добавляет поисковый OCR-слой в сканированные PDF-файлы, создавая валидный PDF/A. Использует Tesseract для распознавания более чем на 100 языках, поддерживает исправление наклона и поворота страниц, работает на Linux, macOS, Windows и FreeBSD.

ПродуктивностьАвтоматизацияUtilities