Sobre el proyecto
Compute Atlas es un conjunto de datos abierto y con fuentes citadas que abarca centros de datos, sitios de minería de criptomonedas y la generación eléctrica dedicada construida para abastecerlos en todos los Estados Unidos, desde propuestos y autorizados hasta en construcción y operativos. También registra información sobre la huella cívica, como energía, agua, subsidios, empleos, emisiones y recepción comunitaria, recopilada de portales de planificación de condados, presentaciones ante la SEC, permisos estatales de calidad del aire, colas de interconexión de ISO/RTO, presentaciones de servicios públicos y divulgaciones de subsidios.
El proyecto afirma que no existe un registro nacional de centros de datos y se posiciona como una alternativa con fuentes. Cada registro de instalación cita al menos una fuente pública con una URL, etiqueta, tipo de fuente y fecha de recuperación, y un sourceIndex vincula afirmaciones específicas con documentos específicos. Los registros llevan un nivel de confianza (confirmado, reportado, rumor) y un estado (propuesto, autorizado, en construcción, operativo, cancelado).
Las opciones de acceso incluyen un mapa y una tabla filtrables, una vista de exploración por estado, operador, área metropolitana, energía, estado, cripto y oposición comunitaria, además de una API pública con CORS abierto y endpoints para instalaciones, instalaciones individuales, búsqueda, estadísticas y esquema. El conjunto de datos completo también se publica como un único archivo JSON bifurcable, con un archivo de metadatos separado que registra su marca de tiempo asOf. Las escrituras están moderadas: las contribuciones y las pistas de URL se ponen en cola para revisión humana, y la gestión de envíos requiere un token de administrador.
Los principios de diseño declarados incluyen tratar los campos faltantes como desconocidos en lugar de cero, informar qué proporción de registros divulga un campo agregado, mantener los rangos y las proyecciones modeladas en notas en lugar de campos numéricos, prohibir las cifras derivadas y exigir aprobación humana explícita antes de publicar cualquier cosa. Los candidatos del pipeline de descubrimiento tienen URL citadas que se obtienen y comparan con las afirmaciones que respaldan antes de ponerse en cola.
El modelo de datos se valida contra un esquema Zod como una unión discriminada por facilityType, con campos para id, name, operator, status, confidence, clasificación de IA, ubicación, capacidad en megavatios, historial de estado, fuentes y lastUpdated, además de bloques específicos por tipo y cívicos. La suite de pruebas valida cada registro en cada pull request.
El stack es Next.js, React, TypeScript, Zod, Neon Postgres con Drizzle, MapLibre GL, Tailwind con shadcn/ui, Vitest y Playwright. Ejecutarlo sin una URL de base de datos renderiza desde la instantánea JSON. El proyecto apunta a WCAG 2.2 AA, con la tabla de datos como alternativa de primera clase al mapa y auditorías de accesibilidad automatizadas en la suite de extremo a extremo. El código tiene licencia MIT y los datos son CC BY 4.0; el proyecto se describe a sí mismo como no partidista y proporciona los datos tal cual, sin garantía.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.