OPEN SOURCE, OPEN TO EVERYONE

Открытый код. Новые возможности.

Находите качественные проекты с открытым исходным кодом, отправляйте проекты анонимно, заявляйте права на свои проекты и редактируйте их.

Выбор редакции · Находите хороший open source4109найдено

Немного любопытства. Мир открытого кода.

THE FIRST COLLECTION
Topic: big-data清除
НОВОЕ

Исходный код официального сайта Apache Doris (doris.apache.org), созданного на Docusaurus 3. Содержит многоязычную документацию, публикации в блоге и материалы сообщества для Apache Doris — MPP-СУБД аналитики в реальном времени.

РазработкаДанныеTemplates & starters
sparkapache
НОВОЕ

Apache Spark — это унифицированный аналитический движок для крупномасштабной обработки данных, предлагающий высокоуровневые API и оптимизированный движок для общих графов вычислений.

ДанныеData integration
flinkapache
НОВОЕ

Apache Flink — это фреймворк с открытым исходным кодом для потоковой обработки данных, предоставляющий мощные возможности как для потоковой, так и для пакетной обработки.

Кино, видео и медиаVideo editing
beamapache
НОВОЕ

Apache Beam — это унифицированная модель программирования для определения конвейеров параллельной обработки данных как в пакетном, так и в потоковом режимах.

ДанныеData integration
deltadelta-io
НОВОЕ

Delta Lake — это открытый фреймворк хранения, обеспечивающий архитектуру Lakehouse. Он интегрируется с вычислительными движками, такими как Spark, PrestoDB, Flink, Trino и Hive, предлагая ACID-транзакции, путешествие во времени и эволюцию схемы для надёжного управления данными.

ДанныеStreaming & warehousing
arkimearkime
НОВОЕ

Arkime — это крупномасштабная система анализа сети и захвата пакетов с открытым исходным кодом, предназначенная для хранения и индексации сетевого трафика в формате PCAP.

ДанныеСвой серверSearch & indexing
trinotrinodb
НОВОЕ

Trino — это быстрый распределенный SQL-движок запросов, предназначенный для аналитики больших данных, ранее известный как PrestoSQL.

ДанныеRelational databases
catboostcatboost
НОВОЕ

CatBoost — библиотека градиентного бустинга с открытым исходным кодом от Yandex для классификации, регрессии и ранжирования, с поддержкой категориальных признаков, обучением на CPU/GPU, распределённым обучением через Apache Spark и API для Python, R, Java и C++.

ИИTraining & evaluation
awesome-scalabilitybinhnguyennus
НОВОЕ

Подборка материалов о построении масштабируемых, надёжных и высокопроизводительных крупномасштабных систем: принципы проектирования, примеры из практики технологических гигантов и ресурсы для подготовки к интервью.

РазработкаBackend & APIs
НОВОЕ

Apache DataFusion — это расширяемый движок запросов на языке Rust, использующий Apache Arrow в качестве формата данных в памяти и предоставляющий SQL и DataFrame API для создания быстрых аналитических систем.

ИгрыGame engines
ClickHouseClickHouse
НОВОЕ

ClickHouse — это система управления базами данных с колоночным хранением с открытым исходным кодом, предназначенная для создания аналитических отчетов в режиме реального времени.

ДанныеRelational databases
cythoncython
НОВОЕ

Cython — это оптимизирующий компилятор Python, который переводит код Python в C/C++ для создания эффективных расширений.

РазработкаTesting & debugging