このプロジェクトについて

Apache Flinkは、高スループットと低イベントレイテンシ向けに設計されたストリーミングファーストのランタイムです。流暢なJava APIを通じて、バッチ処理とストリーム処理プログラムの両方をサポートしています。 主な機能は以下の通りです: - Dataflow Modelに基づくイベント時間および順不同処理。 - 時間、カウント、セッションウィンドウを含む柔軟なウィンドウオプション。 - exactly-once処理保証によるフォールトトレランス。 - ストリーミングプログラムにおける自然なバックプレッシャー処理。 - グラフ処理、機械学習、および複合イベント処理(CEP)のための専用ライブラリ。 - 効率的なインメモリおよびアウトオブコアデータ処理のためのカスタムメモリ管理。 - YARN、HDFS、HBaseを含むApache Hadoopエコシステムとの統合、およびMapReduce用の互換レイヤー。 本プロジェクトは、Kafka、Elasticsearch、MongoDB、Cassandra、AWSなど、さまざまなデータソースおよびシンク向けの幅広い外部コネクタを提供しています。