Sobre o projeto

O Compute Atlas é um conjunto de dados aberto e com fontes citadas que abrange data centers, sites de mineração de criptomoedas e a geração de energia dedicada construída para alimentá-los em todos os Estados Unidos, desde propostos e licenciados até em construção e operacionais. Ele também registra informações de pegada cívica, como energia, água, subsídios, empregos, emissões e recepção da comunidade, coletadas de portais de planejamento de condados, registros da SEC, licenças estaduais de qualidade do ar, filas de interconexão de ISO/RTO, registros de concessionárias e divulgações de subsídios. O projeto afirma que não existe um registro nacional de data centers e se posiciona como uma alternativa com fontes. Cada registro de instalação cita pelo menos uma fonte pública com URL, rótulo, tipo de fonte e data de recuperação, e um sourceIndex vincula afirmações específicas a documentos específicos. Os registros carregam um nível de confiança (confirmado, reportado, rumor) e um status (proposto, licenciado, em construção, operacional, cancelado). As opções de acesso incluem um mapa e uma tabela filtráveis, uma visão de exploração por estado, operador, região metropolitana, energia, status, cripto e oposição da comunidade, além de uma API pública com CORS aberto e endpoints para instalações, instalações individuais, busca, estatísticas e esquema. O conjunto de dados completo também é publicado como um único arquivo JSON forkável, com um arquivo de metadados separado que registra seu carimbo de data/hora asOf. As gravações são moderadas: contribuições e indicações de URL são preparadas para revisão humana, e o gerenciamento de envios exige um token de administrador. Os princípios de design declarados incluem tratar campos ausentes como desconhecidos em vez de zero, informar qual parcela dos registros divulga um campo agregado, manter intervalos e projeções modeladas em notas em vez de campos numéricos, proibir números derivados e exigir aprovação humana explícita antes que qualquer coisa seja publicada. Os candidatos do pipeline de descoberta têm URLs citadas buscadas e comparadas com as afirmações que sustentam antes da preparação. O modelo de dados é validado contra um esquema Zod como uma união discriminada em facilityType, com campos para id, name, operator, status, confidence, classificação por IA, localização, capacidade em megawatts, histórico de status, fontes e lastUpdated, além de blocos específicos por tipo e cívicos. A suíte de testes valida cada registro em cada pull request. A stack é Next.js, React, TypeScript, Zod, Neon Postgres com Drizzle, MapLibre GL, Tailwind com shadcn/ui, Vitest e Playwright. Executar sem uma URL de banco de dados renderiza a partir do snapshot JSON. O projeto tem como meta WCAG 2.2 AA, com a tabela de dados como alternativa de primeira classe ao mapa e auditorias automatizadas de acessibilidade na suíte de ponta a ponta. O código é licenciado sob MIT e os dados sob CC BY 4.0; o projeto se descreve como não partidário e fornece os dados como estão, sem garantia.