منصوبے کے بارے میں
Punjab Data Project 1910-1912 کے برٹش پنجاب پرنٹ رجسٹر کے لیے ایک انٹرایکٹو ایکسپلورر فراہم کرتا ہے، جس میں 4,502 کتابوں کے اندراجات ہیں جو 6,944,051 رجسٹرڈ کاپیوں کی نمائندگی کرتے ہیں۔ اس ایکسپلورر کی خصوصیات میں ایک فلٹر ایبل انٹری ٹیبل، پرنٹر-پبلشر نیٹ ورک ویژولائزیشن، اسکرپٹ-مارکیٹ تجزیہ، منتخب نمائشیں، اور مربوط پیج اسکین ویوور شامل ہیں۔
اس ریپوزٹری میں ایک ڈیٹا ایکسٹریکشن پائپ لائن شامل ہے جو کیٹلاگ پیج کی تصاویر کو لفظ بہ لفظ ریکارڈز اور ایک نارملائزڈ ڈیٹا لیئر میں تبدیل کرتی ہے، جس میں غیر یقینی ریڈنگز کے لیے ویلیڈیشن چیکس اور ایڈجودیکیشن کیوز موجود ہیں۔ تجزیاتی ٹولز نیٹ ورک گراف اور اسکرپٹ-مارکیٹ رپورٹس تیار کرتے ہیں۔ یہ پروجیکٹ ڈیٹا کی خصوصیات کی دستاویزات فراہم کرتا ہے، جیسے کہ ٹیکسٹ پر مبنی 'copies' فیلڈ جس کے لیے نیومیرک کنورژن کی ضرورت ہوتی ہے اور زبان کے لحاظ سے مختلف mức کی تکمیل۔
سورس ڈیٹا برٹش لائبریری انڈیا آفس ریکارڈز (پبلک ڈومین) سے لیا گیا ہے۔ فراہم کردہ اسکرپٹس کا استعمال کرتے ہوئے پائپ لائن سے سائٹ کو دوبارہ بنایا جا سکتا ہے۔ کوڈ GPLv3 ہے، ڈیٹا CC0 ہے، اور نثر CC BY 4.0 ہے۔
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.