À propos du projet

Compute Atlas est un jeu de données ouvert et sourcé couvrant les centres de données, les sites de minage de cryptomonnaies et la production d'électricité dédiée construite pour les alimenter à travers les États-Unis, depuis les projets proposés et autorisés jusqu'aux installations en construction et opérationnelles. Il enregistre également des informations sur l'empreinte civique telles que l'énergie, l'eau, les subventions, les emplois, les émissions et l'accueil de la communauté, recueillies auprès des portails de planification des comtés, des dépôts auprès de la SEC, des permis de qualité de l'air des États, des files d'attente d'interconnexion des ISO/RTO, des dépôts des services publics et des divulgations de subventions. Le projet affirme qu'il n'existe aucun registre national des centres de données et se positionne comme une alternative sourcée. Chaque fiche d'installation cite au moins une source publique avec une URL, un libellé, un type de source et une date de consultation, et un sourceIndex relie des affirmations précises à des documents précis. Les fiches portent un niveau de confiance (confirmé, rapporté, rumeur) et un statut (proposé, autorisé, en construction, opérationnel, annulé). Les options d'accès comprennent une carte et un tableau filtrables, une vue d'exploration par État, opérateur, métropole, puissance, statut, cryptomonnaie et opposition communautaire, ainsi qu'une API publique ouverte au CORS avec des points de terminaison pour les installations, les installations individuelles, la recherche, les statistiques et le schéma. Le jeu de données complet est également publié sous forme d'un unique fichier JSON forkable, avec un fichier de métadonnées distinct enregistrant son horodatage asOf. Les écritures sont modérées : les contributions et les pistes d'URL sont mises en attente pour examen humain, et la gestion des soumissions nécessite un jeton d'administration. Les principes de conception énoncés incluent le traitement des champs manquants comme inconnus plutôt que comme zéro, la communication de la part des fiches qui divulguent un champ agrégé, le maintien des plages et des projections modélisées dans les notes plutôt que dans des champs numériques, l'interdiction des chiffres dérivés et l'exigence d'une approbation humaine explicite avant toute publication. Les candidats issus du pipeline de découverte ont des URL citées, récupérées et comparées aux affirmations qu'elles étayent avant la mise en attente. Le modèle de données est validé par un schéma Zod en tant qu'union discriminée sur facilityType, avec des champs pour id, name, operator, status, confidence, classification IA, location, capacity en mégawatts, status history, sources et lastUpdated, plus des blocs spécifiques au type et civiques. La suite de tests valide chaque fiche à chaque pull request. La pile technique est Next.js, React, TypeScript, Zod, Neon Postgres avec Drizzle, MapLibre GL, Tailwind avec shadcn/ui, Vitest et Playwright. L'exécution sans URL de base de données génère le rendu à partir de l'instantané JSON. Le projet vise WCAG 2.2 AA, avec le tableau de données comme alternative de premier ordre à la carte et des audits d'accessibilité automatisés dans la suite de tests de bout en bout. Le code est sous licence MIT et les données sous CC BY 4.0 ; le projet se décrit comme non partisan et fournit les données en l'état, sans garantie.