منصوبے کے بارے میں

AnimeLek Scraper ایک Python پر مبنی ٹول ہے جو animelek.vip ویب سائٹ سے ڈیٹا نکالنے کے لیے ڈیزائن کیا گیا ہے۔ یہ anime کیٹلاگ کے تمام 83 صفحات کو منظم طریقے سے کرال کرتا ہے، ہر anime کے لیے میٹا ڈیٹا (عنوان، پوسٹر، اسٹیٹس، انواع، تفصیل، اسٹوڈیوز، سال) کے ساتھ ساتھ ایپی سوڈ کی فہرستیں، واچ سرور یو آر ایل (data-ep-url) اور فی ایپی سوڈ ڈاؤن لوڈ لنکس جمع کرتا ہے۔ اسکراپر ساختہ JSON فائلیں آؤٹ پٹ کرتا ہے: ایک جامع `data/animes.json` جس میں anime اشیاء کی ایک صف ہوتی ہے، اور ہر ایپی سوڈ کے لیے `data/episodes/` کے تحت انفرادی JSON فائلیں۔ یہ پیشرفت کو ٹریک کرنے کے لیے ایک `state.json` فائل بھی برقرار رکھتا ہے، جس سے دوبارہ شروع کرنے کے قابل رن ممکن ہوتے ہیں—صارفین Ctrl+C کے ساتھ محفوظ طریقے سے مداخلت کر سکتے ہیں اور مکمل شدہ آئٹمز کو دوبارہ اسکریپ کیے بغیر دوبارہ شروع کر سکتے ہیں۔ ایک رولنگ لاگ فائل (`scraper.log`) سرگرمی کو ریکارڈ کرتی ہے۔ مقامی استعمال کے لیے، ٹول کو Python اور `requirements.txt` میں درج انحصار کی ضرورت ہوتی ہے۔ یہ عوامی صفحات کو لانے کے لیے `cloudscraper` اور `BeautifulSoup` کا استعمال کرتا ہے، جس میں کوئی بامعاوضہ API شامل نہیں ہے۔ پتہ لگانے سے بچاؤ کے اقدامات میں `fake-useragent` کے ذریعے بے ترتیب User-Agent گردش، درخواستوں کے درمیان بے ترتیب تاخیر (1.5–3.5 سیکنڈ)، 429/5xx غلطیوں پر ایکسپونینشل بیک آف، اور فی URL 4 تک دوبارہ کوشش شامل ہیں۔ اس پروجیکٹ میں ایک GitHub Actions ورک فلو بھی شامل ہے جو تقریباً ہر 5.5 گھنٹے بعد اسکراپر چلاتا ہے (دو کرون شیڈولز کو ملا کر)۔ یہ تصدیق کے لیے بلٹ ان `GITHUB_TOKEN` کا استعمال کرتا ہے، جس کے لیے ریپوزٹری میں ایکشنز کے لیے 'پڑھنے اور لکھنے کی اجازتیں' فعال ہونی چاہئیں۔ یہ دستی رازوں کے بغیر خودکار، طے شدہ اسکریپنگ کی اجازت دیتا ہے۔ README anime اور ایپی سوڈ دونوں فائلوں کے لیے تفصیلی JSON اسکیما فراہم کرتا ہے، مثالوں کے ساتھ ساخت کو واضح کرتا ہے۔ مجموعی طور پر، یہ ٹول ان لوگوں کے لیے مفید ہے جو animelek.vip سے anime ڈیٹا کو آرکائیو یا تجزیہ کرنا چاہتے ہیں، جو دوبارہ شروع کرنے کی صلاحیت اور آٹومیشن سپورٹ کے ساتھ مضبوط اسکریپنگ پیش کرتا ہے۔