OPEN SOURCE, OPEN TO EVERYONE

Code ouvert. Horizons nouveaux.

Découvrez des projets open source de qualité, soumettez des projets anonymement, puis revendiquez et éditez votre propre projet.

Sélection humaine · Découvrez de bons projets open source4109découverts

Un peu de curiosité. Un monde de code ouvert.

THE FIRST COLLECTION
Topic: data-science清除
go-flowetl-madness
NOUVEAU

Flow est un moteur ETL et un orchestrateur de workflow haute performance, écrit en Go, à partir d'un seul binaire. Il dispose d'un constructeur web visuel intégré, de pipelines XML déclaratifs, de prise en charge multi-base de données et de télémétrie d'audit intégrée.

DonnéesAutomatisationData integration
NOUVEAU

Un dépôt éducatif enseignant l'apprentissage automatique supervisé à partir des principes fondamentaux avec Python, couvrant les bases mathématiques et les implémentations pratiques.

IADonnéesTraining & evaluation

Un cursus gratuit de 10 semaines et 20 leçons sur la data science, conçu par Microsoft, avec projets, quiz et traductions dans plus de 50 langues.

DonnéesIAAnalytics & BI
fiftyonevoxel51
NOUVEAU

FiftyOne est un outil open-source pour créer des jeux de données de haute qualité et affiner des modèles d'vision par ordinateur, offrant une interface visuelle pour l'exploration, l'étiquetage, l'évaluation et la purification des données visuelles.

IADonnéesTraining & evaluation
OpenRefineOpenRefine
NOUVEAU

OpenRefine est un outil open-source basé sur Java conçu pour nettoyer, transformer et réconcilier des données complexes via une interface de navigateur web.

DonnéesProductivitéData integration
NOUVEAU

Great Expectations (GX Core) est une bibliothèque Python open-source pour la qualité des données, offrant un cadre pour créer des tests unitaires afin d'en garantir la cohérence et la fiabilité.

DonnéesDéveloppementData integration
vectorbtpolakowo
NOUVEAU

VectorBT est une bibliothèque Python open-source de backtesting qui vectorise la recherche de stratégies : elle regroupe des milliers de combinaisons de paramètres dans des tableaux NumPy et les accélère avec Numba et un moteur Rust optionnel, plus des analyses de portefeuille et une visualisation interactive Plotly.

DonnéesDéveloppementAnalytics & BI
data-research-analysis-platformData-Research-Analysis
NOUVEAU

Une plateforme de recherche et d'analyse de données permettant aux utilisateurs d'importer des ensembles de données personnalisés pour la visualisation et l'analyse.

DonnéesAnalytics & BI
evidenceevidence-dev
NOUVEAU

Evidence est une alternative open-source et basée sur le code aux outils BI glisser-déposer : créez des rapports interactifs avec SQL et markdown, puis publiez ou auto-hébergez le site statique généré.

DonnéesAnalytics & BI
supersetapache
NOUVEAU

Apache Superset est une application web d'informatique décisionnelle moderne et prête pour l'entreprise, utilisée pour l'exploration et la visualisation de données.

DonnéesAnalytics & BI
tsfreshblue-yonder
NOUVEAU

tsfresh est un package Python pour l'extraction et la sélection automatiques de caractéristiques de séries temporelles, combinant statistiques, traitement du signal et tests d'hypothèses pour générer des centaines de caractéristiques pertinentes pour l'apprentissage automatique.

DonnéesIAAnalytics & BI
ipythonipython
NOUVEAU

IPython est un shell de commande interactif puissant pour le calcul dans plusieurs langages de programmation, principalement Python, offrant une introspection et une intégration shell améliorées.

DéveloppementDonnéesCLI & terminal
pandaspandas-dev
NOUVEAU

pandas est une bibliothèque Python puissante offrant des structures de données rapides, flexibles et expressives, conçues pour travailler avec des données relationnelles ou étiquetées.

DonnéesData integration
airflowapache
NOUVEAU

Apache Airflow est une plateforme permettant de concevoir, d'ordonnancer et de surveiller des flux de travail sous forme de code, couramment utilisée pour les pipelines de données et l'orchestration AI/ML.

AutomatisationDonnéesWorkflow automation
trinotrinodb
NOUVEAU

Trino est un moteur de requête SQL distribué et rapide conçu pour l'analyse de données massives, anciennement connu sous le nom de PrestoSQL.

DonnéesRelational databases
myclidbcli
NOUVEAU

Un client terminal MySQL riche offrant l'auto-complétion, la coloration syntaxique et l'intégration de dataframes.

DéveloppementDonnéesCLI & terminal
marimomarimo-team
NOUVEAU

marimo est un notebook Python réactif qui assure la cohérence entre le code et les sorties, stocké sous forme de fichiers Python purs pour faciliter l'utilisation de git et le déploiement.

DéveloppementDonnéesEditors & IDEs
statsmodelsstatsmodels
NOUVEAU

Statsmodels est une bibliothèque Python pour la modélisation statistique et l'économétrie, offrant des outils pour la régression, les séries temporelles, l'analyse de survie, et plus encore.

DonnéesDéveloppementAnalytics & BI
NOUVEAU

Une bibliothèque Python pour enrichir les DataFrames pandas en ajoutant de nouvelles colonnes générées par des modèles d'IA basés sur des instructions en langage naturel.

DonnéesIAData integration
cudfNVIDIA
NOUVEAU

cuDF est une bibliothèque de DataFrames accélérée par GPU pour le traitement de données tabulaires, offrant des API compatibles pandas, un moteur GPU pour Polars et un backend Dask.

DonnéesAnalytics & BI