OPEN SOURCE, OPEN TO EVERYONE

ओपन सोर्स। नई संभावनाएँ।

उत्कृष्ट ओपन-सोर्स प्रोजेक्ट खोजें, गुमनाम रूप से प्रोजेक्ट सबमिट करें और अपने प्रोजेक्ट का दावा कर उसे संपादित करें।

संपादकीय चयन · अच्छा ओपन सोर्स खोजें4093खोजे गए

जिज्ञासा के साथ ओपन सोर्स खोजें।

THE FIRST COLLECTION
Topic: ocr清除
नया

VSE एक स्थानीय रूप से चलने वाला वीडियो हार्ड सबटाइटल निष्कर्षण उपकरण है, जो गहन शिक्षण के माध्यम से सबटाइटल क्षेत्रों का पता लगाता है और OCR द्वारा टेक्स्ट पहचानता है, SRT/TXT सबटाइटल फ़ाइलें उत्पन्न करता है। यह 87 भाषाओं, बैच प्रोसेसिंग और GPU त्वरण का समर्थन करता है, बिना किसी तृतीय-पक्ष API की आवश्यकता के।

फ़िल्म, वीडियो और मीडियाकृत्रिम बुद्धिमत्ताSubtitles & animation
paddleocrPaddlePaddle
नया

PaddleOCR एक ओपन-सोर्स OCR टूलकिट है जो PDFs और images को LLMs के लिए JSON/Markdown में संरचित डेटा में बदलता है। इसमें PP-OCRv6 (100+ भाषाओं के लिए), PaddleOCR-VL, और PP-StructureV3 शामिल हैं।

कृत्रिम बुद्धिमत्ताडेवलपर टूलMultimodal AI
tesseracttesseract-ocr
नया

Tesseract एक ओपन-सोर्स OCR इंजन है जो 100 से अधिक भाषाओं में छवियों में टेक्स्ट पहचानने के लिए एक कमांड-लाइन टूल और लाइब्रेरी प्रदान करता है।

कृत्रिम बुद्धिमत्ताडेवलपर टूलMultimodal AI
paperless-ngxpaperless-ngx
नया

Paperless-ngx एक दस्तावेज़ प्रबंधन प्रणाली है जो कागज़ के उपयोग को कम करने के लिए भौतिक दस्तावेज़ों को एक खोजने योग्य ऑनलाइन संग्रह में बदल देती है।

गेम्सGame servers
नया

एक Python टूल जो अधिकृत YouTube वीडियो को हिन्दी उपशीर्षक में स्थानीयकृत करता है और B站 पर प्रकाशन में सहायता करता है, जो ध्वनि अनुलेखन, OCR पहचान, LLM अनुवाद और हार्ड सबटाइटल रेंडरिंग का समर्थन करता है।

संगीतAudio editing
skill_seekersyusufkaraaslan
नया

Skill Seekers एक CLI टूल है जो दस्तावेज़ों, GitHub रिपोजिटरीज़, PDFs, वीडियो और अन्य स्रोतों को AI स्किल्स में बदलता है। यह Claude, Gemini, OpenAI सहित 22 निर्यात लक्ष्यों का समर्थन करता है।

संगीतDAW & production
pageledgerpeterbussch
नया

PageLedger एक ओपन-सोर्स Python CLI लाइब्रेरी है जो OCR और दस्तावेज़ निष्कर्षण के लिए पृष्ठ-स्तर पर पत्रपुस्तकीय, गुणवत्ता संकेत और बजट ट्रैकिंग प्रदान करती है। यह निरंतर रन, पुनरीक्षण कतारें और मानव-में-लूप सत्यापन का समर्थन करती है।

डेवलपर टूलकृत्रिम बुद्धिमत्ताCLI & terminal
mineruopendatalab
नया

MinerU एक ओपन-सोर्स डॉक्यूमेंट पार्सिंग इंजन है जो PDF, इमेज, DOCX, PPTX और XLSX को LLM, RAG और एजेंट वर्कफ़्लो के लिए संरचित Markdown/JSON में बदलता है। यह VLM+OCR डुअल इंजन, 109 भाषाओं का OCR और प्राइवेट/ऑफ़लाइन डिप्लॉयमेंट सपोर्ट करता है।

कृत्रिम बुद्धिमत्ताडेवलपर टूलRAG & knowledge
नया

Tesseract.js is a JavaScript OCR library that extracts text from images in over 100 languages. It runs in browsers via WebAssembly and on Node.js, wrapping the Tesseract engine without modifying its recognition model.

डेवलपर टूलकृत्रिम बुद्धिमत्ताComponent libraries
easyocrJaidedAI
नया

EasyOCR एक तैयार-उपयोग ऑप्टिकल कैरेक्टर पहचान लाइब्रेरी है जो 80+ भाषाओं और प्रमुख लेखन लिपियों का समर्थन करती है। यह सरल Python API और CLI प्रदान करती है, जिसमें PyTorch-आधारित डिटेक्शन और रिकग्निशन मॉडल शामिल हैं, साथ ही कस्टम प्रशिक्षण के विकल्प भी हैं।

कृत्रिम बुद्धिमत्ताडेवलपर टूलMultimodal AI
dolphinbytedance
नया

डॉल्फिन बाइटडांस का ओपन-सोर्स दस्तावेज़ छवि पार्सिंग मॉडल है जो पीडीएफ़ और फोटो खींचे गए पृष्ठों को संरचित मार्कडाउन/जेएसओएन में बदलता है, जिसमें लेआउट, पढ़ने का क्रम, पाठ, तालिकाएं, सूत्र और कोड शामिल हैं।

कृत्रिम बुद्धिमत्ताउत्पादकताMultimodal AI
नया

X-AnyLabeling एक क्रॉस-प्लेटफ़ॉर्म डेस्कटॉप एप्लिकेशन है जो इमेज, वीडियो, टेक्स्ट और मल्टीमोडल डेटा की AI-सहायता प्राप्त एनोटेशन के लिए बनाया गया है। इसमें कई बिल्ट-इन डीप लर्निंग मॉडल, विविध लेबलिंग टूल्स और अनेक फ़ॉर्मेट इम्पोर्ट/एक्सपोर्ट समर्थित हैं।

कृत्रिम बुद्धिमत्ताडेवलपर टूलTraining & evaluation
aksharamdK2alyan
नया

AksharaMD एक स्थानीय, पार्सर-अज्ञेयवादी उपकरण है जो मूल्यांकन करता है कि चुने गए दस्तावेज़ पार्सर ने स्रोत फ़ाइल को AI-अनुकूल Markdown में कितनी अच्छी तरह बदला, प्रति-दस्तावेज़ तत्परता स्कोर, ब्लॉक-स्तरीय उत्पत्ति टैग, नामित चेतावनियाँ, और वैकल्पिक स्रोत-आधारित ACCEPT/REJECT निर्णय लौटाता है।

कृत्रिम बुद्धिमत्ताडेवलपर टूलRAG & knowledge
umi-ocrhiroi-sora
नया

Umi-OCR एक मुफ्त और ओपन-सोर्स ऑफ़लाइन OCR टेक्स्ट पहचान उपकरण है, जो स्क्रीनशॉट पहचान, बैच इमेज आयात, PDF दस्तावेज़ पहचान, QR कोड स्कैन और जनरेशन का समर्थन करता है, इसमें कई भाषाओं की ऑफ़लाइन पहचान लाइब्रेरी अंतर्निहित है, और कमांड लाइन तथा HTTP इंटरफ़ेस कॉल प्रदान करता है।

उत्पादकताकृत्रिम बुद्धिमत्ताUtilities
ocrmypdfocrmypdf
नया

OCRmyPDF एक कमांड-लाइन टूल है जो स्कैन किए गए PDF फ़ाइलों में खोजने योग्य OCR टेक्स्ट लेयर जोड़ता है और वैध PDF/A आउटपुट उत्पन्न करता है। यह 100+ भाषाओं में पहचान के लिए Tesseract का उपयोग करता है, डेस्क्यू और रोटेशन सुधार का समर्थन करता है, और Linux, macOS, Windows, FreeBSD पर चलता है।

उत्पादकताऑटोमेशनUtilities
bobripperhe
नया

Bob एक macOS मेनू बार अनुवाद और OCR उपकरण है, जो चयन, स्क्रीनशॉट, इनपुट अनुवाद, साथ ही स्क्रीनशॉट OCR, मूक पहचान, QR कोड पहचान आदि का समर्थन करता है। यह कई अनुवाद और OCR सेवाओं से जुड़ सकता है और ऑफ़लाइन पहचान व वाक् संश्लेषण प्रदान करता है।

उत्पादकताकृत्रिम बुद्धिमत्ताUtilities
नया

AurexTranslator एक क्रॉस-प्लेटफॉर्म, रीयल-टाइम स्क्रीन ट्रांसलेटर है जो Windows और Linux (X11/XWayland) के लिए है। यह OCR द्वारा कैप्चर किए गए टेक्स्ट, क्लिपबोर्ड से, या गेम-विशिष्ट प्लगइन्स के माध्यम से सीधे गेम प्रोसेस से हुक किए गए टेक्स्ट का अनुवाद करता है।

उत्पादकतागेम्सUtilities