PaddleOCR هو أداة OCR مفتوحة المصدر تحوّل ملفات PDF والصور إلى بيانات مهيكلة (JSON/Markdown) جاهزة لدمجها مع نماذج الذكاء الاصطناعي. يتضمن PP-OCRv6 للتعرف متعدد اللغات (أكثر من 100 لغة)، وPaddleOCR-VL لتحليل المستندات، وPP-StructureV3 للتحوّل المدروس بالتصميم. يدعم وحدات CPU وGPU ومسرّعات الذكاء الاصطناعي المتنوعة.
OPEN SOURCE, OPEN TO EVERYONE
مصدر مفتوح. آفاق جديدة.
اكتشف مشاريع مفتوحة المصدر عالية الجودة، وأرسل المشاريع بشكل مجهول، وطالب بمشروعك المفتوح المصدر وحرّره.
✳اختيار بشري · اكتشف مصادر مفتوحة جيدة4109تم اكتشافها
فضول صغير. عالم من المصادر المفتوحة.
THE FIRST COLLECTIONTopic: ai4science清除
paddleocrPaddlePaddle
جديدclio-agentiowarp
جديدCLIO Agent هو نظام ذكاء اصطناعي مستقل مصمم لإدارة البيانات العلمية على نطاق واسع. بُني هذا النظام على منصة IOWarp، ويدير طبقات متعددة من الخبراء مع دعم FastMCP لأشكال HDF5 وParquet وCSV، ويتميز بواجهة مستخدم طرفية مبنية على Bubbletea. يتكامل النظام مع نماذج اللغة الكبيرة الرئيسية مثل Ollama وOpenAI وAnthropic، ويعمل كطبقة ذكاء اصطناعي (CEI) في نظام IOWarp البيئي.
mineruopendatalab
جديدMinerU هو محرك مفتوح المصدر لتحليل المستندات يحوّل ملفات PDF والصور وDOCX وPPTX وXLSX إلى Markdown/JSON منظم لسير عمل LLM وRAG والوكلاء. يدعم محركي VLM وOCR، وOCR بـ109 لغات، والنشر الخاص/دون اتصال.