Sobre el proyecto

Este repositorio recopila datos de vacantes de estacionamiento publicados por Monash University. La universidad expone un archivo JSON público que enumera la disponibilidad de estacionamiento para cada estacionamiento de Monash equipado con sensores, incluidos todos los principales. Ese JSON se actualiza cada dos minutos y está disponible en una URL pública, que el proyecto utiliza como fuente de datos. El repositorio se centra en un único script de Python, scraper.py, que lee ese JSON y registra los resultados en un archivo CSV llamado monash_all_parking_availabilities.csv. El script está diseñado para ejecutarse automáticamente en lugar de manualmente: un archivo de flujo de trabajo, scrape.yml, lo ejecuta a través de GitHub Actions, y las ejecuciones se activan cada seis minutos mediante el servicio de programación externo cron-job.org. El autor afirma que la acumulación de datos comenzó el 21 de agosto de 2026 y que se espera que el CSV siga creciendo en el futuro previsible, y que cualquier persona puede utilizar los datos resultantes como desee, legalmente. El README es sincero sobre los orígenes del proyecto. Es el primer proyecto de GitHub del autor y se llevó a cabo principalmente como una forma de aprender cómo funciona GitHub. La mayoría de los scripts fueron escritos con la ayuda del asistente Gemini bajo la supervisión del autor, y la configuración del repositorio siguió las instrucciones del asistente. El autor señala que los datos eventualmente crecerán mucho: una actualización con fecha del 29 de agosto de 2026 dice que es probable que se alcancen los límites de tamaño de archivo en unos cinco meses, y enumera el trabajo de seguimiento previsto. Esos planes consisten en analizar todas las series de datos; restringir la recopilación a las series activas para el estacionamiento N1 (todos los permisos) más otros estacionamientos de permisos azules o rojos; almacenar los datos en un formato ancho, bajo el razonamiento de que los datos deberían ser densos en lugar de dispersos dado que muy pocas series cambian en un año; y posiblemente publicar una página web de GitHub que muestre, basándose en tendencias históricas, si se predice que un lugar de estacionamiento estará disponible una hora antes, junto con una vista interactiva de los datos CSV, que podrían dividirse en archivos mensuales. En su estado actual, el proyecto es un pipeline de recopilación de datos programado y sencillo: un endpoint JSON alojado como fuente, un script de Python de obtención y anexado, un flujo de trabajo de GitHub Actions para la ejecución y un servicio cron externo para la temporización. El README no describe la autenticación, los detalles de análisis sintáctico, el manejo de errores ni ninguna herramienta de análisis, y los elementos futuros enumerados se presentan como intenciones en lugar de características implementadas.