newspaper3k هو مكتبة بايثون 3 مستخدمة في استخراج والمحرر من المقالات الإخبارية، توفر أدوات لاستخراج النص الكامل والبيانات الوصفية.
OPEN SOURCE, OPEN TO EVERYONE
مصدر مفتوح. آفاق جديدة.
اكتشف مشاريع مفتوحة المصدر عالية الجودة، وأرسل المشاريع بشكل مجهول، وطالب بمشروعك المفتوح المصدر وحرّره.
✳اختيار بشري · اكتشف مصادر مفتوحة جيدة4109تم اكتشافها
فضول صغير. عالم من المصادر المفتوحة.
THE FIRST COLLECTIONTopic: crawling清除
newspapercodelucas
جديدscrapyscrapy
جديدScrapy هو إطار عمل سريع وعالي المستوى لبرمجة الويب بلغة بايثون، يُستخدم لاستخراج البيانات المهيكلة من المواقع الإلكترونية. يدعم المنصات المتعددة ويتطلب بايثون 3.10 أو أحدث.
scraplingD4Vinci
جديدإطار عمل تكيُّفي لاستخراج بيانات الويب بلغة بايثون: تتبُّع ذكي لعناصر DOM، وجالبات بيانات لتجاوز أنظمة مكافحة الروبوتات، وزحف متزامن مع إمكانية الإيقاف والاستئناف، وتدوير الوكلاء، ومخرجات جاهزة للذكاء الاصطناعي عبر MCP.
crawlee-pythonapify
جديدCrawlee هي مكتبة Python لجمع بيانات الويب وأتمتة المتصفح لبناء زاحفات موثوقة. تدعم الزحف عبر HTTP والمتصفح بدون واجهة، وإعادة المحاولة التلقائية، وتدوير البروكسي، وتخزين البيانات لتطبيقات الذكاء الاصطناعي.