इस प्रोजेक्ट के बारे में

यह रिपॉजिटरी Monash University द्वारा प्रकाशित पार्किंग रिक्ति डेटा एकत्र करती है। विश्वविद्यालय एक सार्वजनिक JSON फ़ाइल उपलब्ध कराता है जिसमें पार्किंग सेंसर से लैस हर Monash कारपार्क की उपलब्धता सूचीबद्ध है, जिसमें सभी प्रमुख कारपार्क शामिल हैं। वह JSON हर दो मिनट में रिफ्रेश होता है और एक सार्वजनिक URL पर उपलब्ध है, जिसे यह प्रोजेक्ट अपने डेटा स्रोत के रूप में उपयोग करता है। यह रिपॉजिटरी एक सिंगल Python स्क्रिप्ट, scraper.py पर केंद्रित है, जो उस JSON को पढ़ती है और परिणामों को monash_all_parking_availabilities.csv नामक एक CSV फ़ाइल में रिकॉर्ड करती है। इस स्क्रिप्ट को मैन्युअल रूप से चलाने के बजाय स्वचालित रूप से चलाने के लिए डिज़ाइन किया गया है: एक वर्कफ़्लो फ़ाइल, scrape.yml, इसे GitHub Actions के माध्यम से चलाती है, और बाहरी शेड्यूलिंग सेवा cron-job.org द्वारा हर छह मिनट में इसे ट्रिगर किया जाता है। लेखक का कहना है कि डेटा संचय 21 अगस्त 2026 को शुरू हुआ था और उम्मीद है कि CSV निकट भविष्य में बढ़ता रहेगा, और कोई भी परिणामी डेटा का कानूनी रूप से अपनी इच्छानुसार उपयोग कर सकता है। README प्रोजेक्ट की उत्पत्ति के बारे में स्पष्ट है। यह लेखक का पहला GitHub प्रोजेक्ट है और इसे मुख्य रूप से यह सीखने के लिए किया गया था कि GitHub कैसे काम करता है। अधिकांश स्क्रिप्ट लेखक की देखरेख में Gemini असिस्टेंट की मदद से लिखी गई थीं, और रिपॉजिटरी सेटअप असिस्टेंट के निर्देशों का पालन करके किया गया था। लेखक नोट करता है कि डेटा अंततः बड़ा हो जाएगा: 29 अगस्त 2026 के अपडेट में कहा गया है कि लगभग पांच महीनों में फ़ाइल आकार की सीमाएं समाप्त होने की संभावना है, और इसमें आगामी कार्यों की सूची दी गई है। उन योजनाओं में सभी डेटा श्रृंखलाओं का विश्लेषण करना; संग्रह को कारपार्क N1 (सभी परमिट) के सक्रिय श्रृंखलाओं और अन्य ब्लू- या रेड-परमिट कारपार्कों तक सीमित करना; डेटा को वाइड फॉर्मेट में स्टोर करना (इस तर्क के साथ कि डेटा घना होना चाहिए न कि विरल, क्योंकि एक वर्ष के भीतर बहुत कम श्रृंखलाएं बदलती हैं); और संभवतः एक GitHub वेबपेज प्रकाशित करना जो ऐतिहासिक रुझानों के आधार पर यह दिखाए कि एक घंटे पहले पार्किंग स्पॉट उपलब्ध होने की भविष्यवाणी है या नहीं, साथ ही CSV डेटा का एक इंटरैक्टिव दृश्य, जिसे मासिक फ़ाइलों में विभाजित किया जा सकता है। अपनी वर्तमान स्थिति में, यह प्रोजेक्ट एक सीधा अनुसूचित डेटा संग्रह पाइपलाइन है: स्रोत के रूप में एक होस्टेड JSON एंडपॉइंट, एक Python fetch-and-append स्क्रिप्ट, निष्पादन के लिए एक GitHub Actions वर्कफ़्लो, और समय निर्धारण के लिए एक बाहरी cron सेवा। README प्रमाणीकरण, पार्सिंग विवरण, त्रुटि हैंडलिंग या किसी विश्लेषण टूलिंग का वर्णन नहीं करता है, और सूचीबद्ध भविष्य की मदें कार्यान्वित सुविधाओं के बजाय इरादों के रूप में बताई गई हैं।