这个项目能做什么
该仓库收集了 Monash University 发布的停车空位数据。该大学提供一个公开的 JSON 文件,列出了所有安装了停车传感器的 Monash 停车场的可用情况,包括所有主要停车场。该 JSON 每两分钟刷新一次,可通过公开 URL 访问,本项目将其作为数据源。
该仓库的核心是一个名为 scraper.py 的 Python 脚本,它读取该 JSON 并将结果记录在名为 monash_all_parking_availabilities.csv 的 CSV 文件中。该脚本旨在自动运行而非手动运行:一个名为 scrape.yml 的工作流文件通过 GitHub Actions 运行它,且运行由外部调度服务 cron-job.org 每六分钟触发一次。作者表示,数据积累始于 2026 年 8 月 21 日,预计 CSV 文件在可预见的未来将持续增长,任何人均可合法地随意使用所得数据。
README 对项目的起源十分坦诚。这是作者的第一个 GitHub 项目,开展该项目主要是为了学习 GitHub 的运作方式。大多数脚本是在作者监督下借助 Gemini 助手编写的,仓库的设置也遵循了助手的指示。作者指出数据最终会变得很大:2026 年 8 月 29 日的一项更新称,大约五个月后可能会达到文件大小限制,并列出了计划的后续工作。这些计划包括:分析所有数据系列;将收集范围限制在 N1 停车场(所有许可证)的活跃系列以及其他蓝色或红色许可证停车场;以宽格式存储数据,理由是考虑到一年内变化的数据系列很少,数据应该是密集而非稀疏的;以及可能发布一个 GitHub 网页,基于历史趋势预测一小时后是否有可用车位,并提供 CSV 数据的交互式视图(数据可能会被拆分为月度文件)。
就目前状态而言,该项目是一个简单的定时数据收集流水线:以托管的 JSON 端点作为源,一个 Python 获取并追加的脚本,一个用于执行的 GitHub Actions 工作流,以及一个用于计时的外部 cron 服务。README 中没有描述身份验证、解析细节、错误处理或任何分析工具,且列出的未来事项被表述为意向而非已实现的功能。
评论
0 评分人数达到10人后显示
登录后参与讨论。