প্রকল্প সম্পর্কে

PolyOCR Service হলো একটি কমিউনিটি-চালিত স্বতন্ত্র পরিষেবা, যা PaddleOCR 3.x এর জন্য সুবিধাজনক API ডেপ্লয়মেন্ট প্রদানের উদ্দেশ্যে তৈরি। এর মূল ক্ষমতাগুলোর মধ্যে রয়েছে: - **বহুভাষিক OCR**: এটি ৭৮টি ভাষা সমর্থন করে (যার মধ্যে চাইনিজ, জাপানিজ, কোরিয়ান, ল্যাটিন, সিরিলিক, আরবি ইত্যাদি অন্তর্ভুক্ত), এবং ভাষা কোড, ইংরেজি নাম বা চাইনিজ নামের মাধ্যমে ভাষা নির্দিষ্ট করার সুবিধা প্রদান করে। - **অনুবাদ ইন্টিগ্রেশন**: এটি ঐচ্ছিক অনুবাদ ইন্টারফেস প্রদান করে, যা OpenAI সামঞ্জস্যপূর্ণ অনুবাদ পরিষেবা সমর্থন করে এবং ইনপুট এন্ট্রির সংখ্যা ও অক্ষরের সংখ্যার উপর সীমাবদ্ধতা আরোপ করে। - **PaddleOCR-VL**: এটি একটি স্বতন্ত্র ভিশন-ল্যাঙ্গুয়েজ মডেল পরিষেবা প্রদান করে, যার জন্য আলাদা API Key প্রয়োজন এবং এটি শুধুমাত্র ফাইল আপলোড গ্রহণ করে। - **রোবাস্টনেস এবং ভ্যালিডেশন**: রিকোয়েস্ট বাউন্ডারিতে ভাষা যাচাইকরণ সম্পন্ন করা হয়; ছবির বাইট সংখ্যা, পিক্সেল সংখ্যা এবং কনফিডেন্স থ্রেশহোল্ডের প্রাক-যাচাই করা হয়; সিনক্রোনাস ইনফারেন্স থ্রেড পুলের মাধ্যমে সম্পাদিত হয় এবং সেমাফোর দ্বারা কনকারেন্সি সীমিত করা হয়। - **বেঞ্চমার্কিং**: প্রজেক্টটিতে নির্ভুলতা, রোবাস্টনেস (ঝাপসা, কমপ্রেশন, রোটেশন ইত্যাদি ডিগ্রেডেশন সিনারিওর জন্য) এবং বাস্তব ছবির (CORD-v2 ডেটাসেট) উপর ভিত্তি করে বিস্তারিত বেঞ্চমার্কিং টুল বিল্ট-ইন করা আছে। এই পরিষেবাটি ওয়েব পেজ এবং REST API প্রদান করে, Docker ডেপ্লয়মেন্ট সমর্থন করে এবং Apache License 2.0 লাইসেন্স ব্যবহার করে।