Apache Arrow est un format de mémoire colonnaire universel et une boîte à outils multi-langages conçue pour l'échange efficace de données et l'analyse en mémoire.
Code ouvert. Horizons nouveaux.
Découvrez des projets open source de qualité, soumettez des projets anonymement, puis revendiquez et éditez votre propre projet.
Un peu de curiosité. Un monde de code ouvert.
THE FIRST COLLECTIONPolars est un moteur de requête analytique extrêmement rapide pour DataFrames écrit en Rust, doté d'une exécution multithread et du support pour des jeux de données dépassant la RAM.
Suite de test ADBC pluggable basée sur Python/pytest pour valider les pilotes, exécutant des requêtes SQL et générant une documentation des fonctionnalités supportées.
Un pilote ADBC pour Apache DataFusion, offrant une interface standard pour se connecter et interroger des moteurs de données à l'aide d'Apache Arrow. Implémenté en Rust et actuellement expérimentale.
Apache DataFusion est un moteur de requête extensible écrit en Rust qui utilise Apache Arrow comme format en mémoire, offrant des API SQL et DataFrame pour créer des systèmes analytiques rapides.
cuDF est une bibliothèque de DataFrames accélérée par GPU pour le traitement de données tabulaires, offrant des API compatibles pandas, un moteur GPU pour Polars et un backend Dask.
Arrow est une bibliothèque Python qui simplifie la création, la manipulation, le formatage et la conversion des dates, heures et horodatages, avec gestion des fuseaux horaires et une API conviviale.