প্রকল্প সম্পর্কে
paperless-paddle-ocr একটি বাহ্যিক ওয়ার্কার হিসেবে PaddleOCR PP-OCRv6-কে paperless-ngx-এর সাথে সংযুক্ত করে। এটি কনফিগারযোগ্য ইনপুট ট্যাগের সাথে মিলে যাওয়া ডকুমেন্টের জন্য paperless API পোল করে, একটি প্রসেসিং ট্যাগ দিয়ে সেগুলো দাবি করে, ফাইল ডাউনলোড করে, PyMuPDF ব্যবহার করে PDF পৃষ্ঠাগুলোকে ছবিতে রেন্ডার করে, OCR চালায় এবং提取 করা টেক্সট ডকুমেন্ট কনটেন্টে PATCH করে। সম্পন্ন ডকুমেন্টগুলো একটি আউটপুট ট্যাগ পায়, আর ব্যর্থতাগুলো একটি এরর ট্যাগ পায়।
প্রকল্পটি CPU ব্যবহারের জন্য ডিজাইন করা হয়েছে এবং Intel হার্ডওয়্যারের জন্য PaddlePaddle, ONNX Runtime এবং ঐচ্ছিক OpenVINO ব্যাকএন্ড অফার করে। কনফিগারেশন এনভায়রনমেন্ট ভেরিয়েবলের মাধ্যমে সরবরাহ করা হয়, যার মধ্যে রয়েছে paperless URL ও API টোকেন, OCR ভাষা, মডেল টিয়ার, DPI, পোলিং ইন্টারভাল, থ্রেড সংখ্যা, প্রসেসিং ট্যাগ, পুনঃপ্রক্রিয়াকরণ আচরণ এবং ড্রাই-রান মোড। এটি একটি ডেমন হিসেবে একটানা চলতে পারে বা একবার পাস সম্পাদন করতে পারে।
ডিপ্লয়মেন্ট Docker Compose এবং একটি সাধারণ Docker কমান্ড দিয়ে ডকুমেন্ট করা হয়েছে। ইমেজটি একটি নন-রুট ব্যবহারকারী হিসেবে চলে, একটি হেলথ চেক অন্তর্ভুক্ত করে এবং linux/amd64 ও linux/arm64 সমর্থন করে। স্থানীয় ডেভেলপমেন্ট ওয়ার্কফ্লোতে Ruff লিন্টিং, mypy টাইপ চেকিং এবং ভারী OCR নির্ভরতা স্টাব করা pytest অন্তর্ভুক্ত।
ওয়ার্কারটি paperless-ngx-এর সাথে শুধুমাত্র তার HTTP API-এর মাধ্যমে যোগাযোগ করে এবং paperless-ngx বা PaddleOCR সোর্স কোড বান্ডল করে না। এটি ডিজাইন অনুযায়ী শুধুমাত্র CPU-ভিত্তিক, খুব বড় সেটের মিলে যাওয়া ডকুমেন্ট দিয়ে লোড-টেস্ট করা হয়নি, এবং OCR ফলাফল স্ক্যানের গুণমান, মডেল টিয়ার ও DPI সেটিংসের উপর নির্ভর করে। রিপোজিটরিটি MIT লাইসেন্সের অধীনে।
Comments
0 people shared their preference · Deer Point appears after 10 participants
Sign in to join the discussion.