ڈوکی ڈاؤن لوڈر ایک ایسا ٹول ہے جو ڈو یین اور ٹک ٹاک کے مواد کو ڈاؤنلوڈ کرنے اور ڈیٹا اکٹھا کرنے کے لیے استعمال ہوتا ہے، جس میں ویدیوز، تصاویر، لائیو اسٹریم کے ڈیٹا اور کمنٹس کا احاطہ شامل ہے۔ یہ پروگرام Python 3.12+ پر مبنی ہے اور Docker ڈپلائمنٹ کی بھی سہولت فراہم کرتا ہے۔
اوپن سورس۔ نئے امکانات۔
معیاری اوپن سورس پروجیکٹس دریافت کریں، گمنام طور پر پروجیکٹس جمع کریں، اور اپنے پروجیکٹ کا دعویٰ کرکے اسے ایڈٹ کریں۔
تجسس کے ساتھ اوپن سورس کی دنیا دریافت کریں۔
THE FIRST COLLECTIONspotDL ایک کمانڈ لائن ٹول ہے جو Spotify پلے لسٹس سے گانے تلاش کرتا ہے اور انہیں YouTube کے ذریعے ڈاؤن لوڈ کرتا ہے، جس میں البم آرٹ، لیرکس اور میٹا ڈیٹا شامل ہیں۔
newspaper3k ویب سے مضامین اخذ اور مرتب کرنے کے لیے ڈیزائن کردہ پایتھن 3 لائبریری ہے جو مکمل متن اور میٹا ڈیٹا اخذ کے لیے آلات فراہم کرتی ہے۔
یہ ایک GitHub Actions پر مبنی خودکار پائپ لائن ہے جو Selenium کے ذریعے کوریا کے 42 بڑے ہسپتالوں کی بھرتی کے اشتہارات روزانہ جمع کرتی ہے، RaiT ویریفیکیشن گیٹ وے کے ذریعے ڈیٹا کی سالمیت کی جانچ کرتی ہے، اور ڈپلیکیٹ ڈیٹا کو فلٹر کر کے ایک ایکسل رپورٹ تیار کرتی ہے۔
ویبو اسپائیڈر ایک پائتھون ٹول ہے جو سینا ویبو صارفین کا ڈیٹا حاصل کرتا ہے، بشمول معلومات اور مواد (متن، تصاویر، ویڈیوز)، اور اسے CSV، JSON، TXT یا MySQL، MongoDB، SQLite میں محفوظ کرتا ہے، تعلیمی تحقیق کے لیے۔
Elysia اور FFmpeg کے ساتھ بنایا گیا ایک ہلکا پھلکا API جو anime ایپیسوڈز کے HLS لنکس سے اسکرین شاٹس لینے اور GIFs بنانے کے لیے استعمال ہوتا ہے۔
اسکرپی پائیتھن کے لیے ایک تیز اور ہائی لیول ویب اسکرپنگ فریم ورک ہے جو ویب سائٹس سے ساختی ڈیٹا نکالنے کے لیے استعمال ہوتا ہے۔ یہ کراس پلیٹ فارم ہے اور پائیتھن 3.10 یا اس سے نیا ورژن درکار ہے۔
پائتھون کے لیے موافق ویب اسکریپنگ فریم ورک: ذہین DOM ٹریکنگ، اینٹی بوٹ بائی پاس فیچرز، توقف/بحالی کے ساتھ متوازی کرالنگ، پراکسی روٹیشن، اور MCP/AI کے لیے تیار آؤٹ پٹ۔
OCRmyPDF ایک کمانڈ لائن ٹول ہے جو سکین شدہ پی ڈی ایف فائلوں میں تلاش کرنے کے قابل OCR ٹیکسٹ لیئر شامل کرتا ہے۔ یہ Tesseract کا استعمال کرتا ہے، ڈیسکewing اور گھماؤ کی اصلاح کی حمایت کرتا ہے، اور Linux، macOS، Windows اور FreeBSD پر چلتا ہے۔