প্রকল্প সম্পর্কে

এই রিপোজিটরিটিতে Monash University দ্বারা প্রকাশিত পার্কিং ভ্যাকেন্সি ডেটা সংগ্রহ করা হয়েছে। বিশ্ববিদ্যালয়টি একটি পাবলিক JSON ফাইল প্রকাশ করে যেখানে পার্কিং সেন্সরযুক্ত প্রতিটি Monash কারপার্কের (সবগুলো প্রধান কারপার্কসহ) পার্কিং সহজলভ্যতার তালিকা থাকে। ওই JSON ফাইলটি প্রতি দুই মিনিটে একবার রিফ্রেশ হয় এবং একটি পাবলিক URL-এ উপলব্ধ থাকে, যা এই প্রজেক্টটি তার ডেটা সোর্স হিসেবে ব্যবহার করে। এই রিপোজিটরিটির মূল কেন্দ্র হলো একটি একক Python স্ক্রিপ্ট, scraper.py, যা ওই JSON ফাইলটি পড়ে এবং ফলাফলগুলো monash_all_parking_availabilities.csv নামক একটি CSV ফাইলে রেকর্ড করে। স্ক্রিপ্টটি হাতে চালানোর পরিবর্তে স্বয়ংক্রিয়ভাবে চালানোর জন্য তৈরি করা হয়েছে: একটি ওয়ার্কফ্লো ফাইল, scrape.yml, GitHub Actions-এর মাধ্যমে এটি পরিচালনা করে এবং এক্সটারনাল শিডিউলিং সার্ভিস cron-job.org দ্বারা প্রতি ছয় মিনিটে একবার এটি ট্রিগার করা হয়। লেখকের বক্তব্য অনুযায়ী, ডেটা সংগ্রহ ২১ আগস্ট ২০২৬ থেকে শুরু হয়েছে এবং আশা করা হচ্ছে যে CSV ফাইলটি অদূর ভবিষ্যতে আরও বড় হতে থাকবে, এবং যে কেউ আইনত এই resulting ডেটা তাদের ইচ্ছামতো ব্যবহার করতে পারে। README-তে প্রজেক্টটির উৎস সম্পর্কে স্পষ্টভাবে বলা হয়েছে। এটি লেখকের প্রথম GitHub প্রজেক্ট এবং মূলত GitHub কীভাবে কাজ করে তা শেখার উপায় হিসেবে এটি undertaken করা হয়েছিল। বেশিরভাগ স্ক্রিপ্ট লেখকের তত্ত্বাবধানে Gemini অ্যাসিস্ট্যান্টের সাহায্যে লেখা হয়েছে এবং রিপোজিটরি সেটআপটি অ্যাসিস্ট্যান্টের নির্দেশনা অনুসরণ করে করা হয়েছে। লেখক উল্লেখ করেছেন যে ডেটা শেষ পর্যন্ত অনেক বড় হয়ে যাবে: ২৯ আগস্ট ২০২৬-এর একটি আপডেট অনুযায়ী, প্রায় পাঁচ মাসের মধ্যে ফাইল সাইজ লিমিট স্পর্শ করার সম্ভাবনা রয়েছে এবং পরবর্তী কাজের পরিকল্পনা তালিকাভুক্ত করা হয়েছে। সেই পরিকল্পনাগুলোর মধ্যে রয়েছে সমস্ত ডেটা সিরিজ বিশ্লেষণ করা; কারপার্ক N1 (সব পারমিট) এবং অন্যান্য ব্লু- বা রেড-পারমিট কারপার্কের জন্য সংগ্রহ সীমাবদ্ধ করা; ডেটাগুলোকে একটি wide ফরম্যাটে সংরক্ষণ করা, কারণ এক বছরের মধ্যে খুব কম সিরিজ পরিবর্তিত হয় বিধায় ডেটা sparse-এর বদলে dense হওয়া উচিত; এবং সম্ভবত একটি GitHub ওয়েবপেজ প্রকাশ করা যা ঐতিহাসিক ট্রেন্ডের ভিত্তিতে এক ঘণ্টা আগে পার্কিং স্পট উপলব্ধ থাকার সম্ভাবনা প্রেডিক্ট করবে, সাথে CSV ডেটার একটি ইন্টারঅ্যাক্টিভ ভিউ থাকবে, যা মাসিক ফাইলে বিভক্ত হতে পারে। বর্তমান অবস্থায় প্রজেক্টটি একটি সহজ শিডিউলড ডেটা কালেকশন পাইপলাইন: সোর্স হিসেবে একটি হোস্ট করা JSON এন্ডপয়েন্ট, একটি Python fetch-and-append স্ক্রিপ্ট, এক্সিকিউশনের জন্য একটি GitHub Actions ওয়ার্কফ্লো এবং টাইমিংয়ের জন্য একটি এক্সটারনাল ক্রন সার্ভিস। README-তে অথেন্টিকেশন, পার্সিং ডিটেইলস, এরর হ্যান্ডলিং বা কোনো অ্যানালাইসিস টুলিংয়ের বর্ণনা নেই এবং তালিকাভুক্ত ভবিষ্যৎ বিষয়গুলো বাস্তবায়িত ফিচারের বদলে উদ্দেশ্য হিসেবে উল্লেখ করা হয়েছে।