À propos du projet

Vector est un pipeline de données d'observabilité open-source et de bout en bout, écrit en Rust. Il est conçu pour fonctionner à la fois comme agent sur des hôtes individuels et comme agrégateur, de sorte que le même outil peut être déployé en bordure d'un parc de machines et à un point de collecte central. Le modèle central est « collecter, transformer et acheminer » : les sources ingestent les données (par exemple fichiers, journald, logs Docker, sockets, HTTP et Kafka), les transformations les traitent (un langage de remappage appelé VRL, filtre, dédoublonnage, log_to_metric et Lua sont des exemples documentés), et les sinks les délivrent à des destinations telles qu'Elasticsearch, ClickHouse, AWS S3, AWS CloudWatch Logs et Google Cloud Storage. Les logs et les métriques sont tous deux pris en charge, les métriques étant marquées comme bêta dans le README ; les traces sont listées comme en développement, elles ne doivent donc pas être considérées comme disponibles actuellement. Les fonctionnalités opérationnelles mises en avant dans le README incluent la persistance par tampon disque et les garanties de livraison, une implémentation sûre sur le plan mémoire grâce à Rust, une exploitation multi-cœur, ainsi que la documentation pour la validation, la gestion et la surveillance de la configuration. Les déploiements peuvent être ajustés par rôle et topologie, et l'installation Kubernetes est documentée. Le projet est maintenu par l'équipe Community Open Source Engineering de Datadog. Le dépôt publie ses propres comparaisons de tests de performance et de correction face à des outils tels que Filebeat, Fluent Bit, Fluentd, Logstash, Splunk Universal/Heavy Forwarders et Telegraf ; ces chiffres proviennent de la suite de benchmarks de Vector elle-même, et l'affirmation du README selon lequel Vector est jusqu'à 10 fois plus rapide que les alternatives est une revendication du projet plutôt qu'une mesure indépendante. Le README note également l'adoption par une longue liste d'entreprises nommées, le volume de téléchargements et le nombre de contributeurs. Les usages typiques décrits comprennent la réduction des coûts d'observabilité, le changement de fournisseur sans perturber les workflows, l'amélioration de la qualité des données, la consolidation de multiples agents et l'amélioration de la fiabilité des pipelines. La configuration et les références, les guides de démarrage rapide et d'installation, les listes d'intégration des composants, les images conteneurisées et la documentation des crates Rust sont tous liés depuis le site du projet et le dépôt.