Об этом проекте
Apache Flink — это среда выполнения, ориентированная в первую очередь на потоковую передачу, разработанная для обеспечения высокой пропускной способности и низкой задержки событий. Она поддерживает программы пакетной и потоковой обработки через удобные Java API.
Ключевые возможности включают:
- Обработка времени событий и данных, поступающих вне очереди, на основе Dataflow Model.
- Гибкие варианты окон, включая временные, количественные и сессионные окна.
- Отказоустойчивость с гарантиями обработки exactly-once.
- Естественная обработка обратного давления (back-pressure) в потоковых программах.
- Специализированные библиотеки для обработки графов, машинного обучения и сложной обработки событий (CEP).
- Пользовательское управление памятью для эффективной обработки данных в памяти и за ее пределами.
- Интеграция с экосистемой Apache Hadoop, включая YARN, HDFS и HBase, со слоями совместимости для MapReduce.
Проект предоставляет широкий спектр внешних коннекторов для различных источников и приемников данных, таких как Kafka, Elasticsearch, MongoDB, Cassandra и AWS.