Об этом проекте
В этом репозитории собраны данные о наличии свободных парковочных мест, публикуемые Университетом Monash. Университет предоставляет публичный JSON-файл со списком доступных мест для каждой парковки Monash, оснащенной датчиками, включая все основные. Этот JSON обновляется каждые две минуты и доступен по публичному URL, который проект использует в качестве источника данных.
Центральным элементом репозитория является один Python-скрипт, scraper.py, который считывает этот JSON и записывает результаты в CSV-файл с именем monash_all_parking_availabilities.csv. Скрипт предназначен для автоматического, а не ручного запуска: файл рабочего процесса scrape.yml запускает его через GitHub Actions, а запуски инициируются каждые шесть минут внешним сервисом планирования cron-job.org. Автор заявляет, что накопление данных началось 21 августа 2026 года, CSV-файл будет продолжать расти в обозримом будущем, и любой может использовать полученные данные по своему усмотрению в рамках закона.
В файле README честно говорится о происхождении проекта. Это первый проект автора на GitHub, созданный в основном для того, чтобы изучить принципы работы GitHub. Большинство скриптов были написаны с помощью ассистента Gemini под руководством автора, а настройка репозитория следовала инструкциям ассистента. Автор отмечает, что объем данных со временем станет значительным: в обновлении от 29 августа 2026 года говорится, что лимиты размера файлов, вероятно, будут достигнуты примерно через пять месяцев, и перечисляются планируемые последующие работы. Эти планы включают анализ всех серий данных; ограничение сбора активными сериями для парковки N1 (все разрешения), а также другими парковками с синими или красными разрешениями; хранение данных в широком формате, исходя из соображений о том, что данные должны быть плотными, а не разреженными, учитывая, как мало серий меняется в течение года; и, возможно, публикацию веб-страницы на GitHub, которая на основе исторических тенденций будет показывать, будет ли парковочное место доступно через час, вместе с интерактивным представлением данных CSV, которые могут быть разделены на ежемесячные файлы.
В своем нынешнем состоянии проект представляет собой простой конвейер запланированного сбора данных: хостинг JSON-эндпоинта в качестве источника, Python-скрипт для получения и добавления данных, рабочий процесс GitHub Actions для выполнения и внешний сервис cron для синхронизации. В README не описаны аутентификация, детали парсинга, обработка ошибок или какие-либо инструменты анализа, а перечисленные будущие пункты указаны как намерения, а не реализованные функции.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.