Sobre o projeto

O Apache Flink é um runtime focado em streaming, projetado para alta taxa de transferência e baixa latência de eventos. Ele suporta programas de processamento em lote e em fluxo por meio de APIs Java fluentes. As principais capacidades incluem: - Tempo de evento e processamento fora de ordem baseados no Dataflow Model. - Opções flexíveis de janelamento, incluindo janelas de tempo, contagem e sessão. - Tolerância a falhas com garantias de processamento exactly-once. - Manipulação natural de back-pressure em programas de streaming. - Bibliotecas especializadas para processamento de Graph, Machine Learning e Complex Event Processing (CEP). - Gerenciamento de memória personalizado para processamento de dados eficiente em memória e out-of-core. - Integração com o ecossistema Apache Hadoop, incluindo YARN, HDFS e HBase, com camadas de compatibilidade para MapReduce. O projeto fornece uma ampla gama de conectores externalizados para várias fontes e sinks de dados, como Kafka, Elasticsearch, MongoDB, Cassandra e AWS.