このプロジェクトについて
Apache Flinkは、高スループットと低イベントレイテンシ向けに設計されたストリーミングファーストのランタイムです。流暢なJava APIを通じて、バッチ処理とストリーム処理プログラムの両方をサポートしています。
主な機能は以下の通りです:
- Dataflow Modelに基づくイベント時間および順不同処理。
- 時間、カウント、セッションウィンドウを含む柔軟なウィンドウオプション。
- exactly-once処理保証によるフォールトトレランス。
- ストリーミングプログラムにおける自然なバックプレッシャー処理。
- グラフ処理、機械学習、および複合イベント処理(CEP)のための専用ライブラリ。
- 効率的なインメモリおよびアウトオブコアデータ処理のためのカスタムメモリ管理。
- YARN、HDFS、HBaseを含むApache Hadoopエコシステムとの統合、およびMapReduce用の互換レイヤー。
本プロジェクトは、Kafka、Elasticsearch、MongoDB、Cassandra、AWSなど、さまざまなデータソースおよびシンク向けの幅広い外部コネクタを提供しています。