عن المشروع
Apache Flink هو بيئة تشغيل تعتمد على التدفق أولاً، مصممة لتحقيق إنتاجية عالية وزمن انتقال منخفض للأحداث. وهو يدعم برامج المعالجة الدفعية ومعالجة التدفق من خلال واجهات برمجة تطبيقات Java سلسة.
تشمل القدرات الرئيسية ما يلي:
- وقت الحدث والمعالجة غير المرتبة بناءً على Dataflow Model.
- خيارات تقسيم النوافذ المرنة بما في ذلك نوافذ الوقت، والعدد، والجلسات.
- تحمل الأخطاء مع ضمانات معالجة "مرة واحدة بالضبط" (exactly-once).
- التعامل الطبيعي مع الضغط العكسي (back-pressure) في برامج التدفق.
- مكتبات متخصصة لمعالجة الرسوم البيانية (Graph processing)، والتعلم الآلي (Machine Learning)، ومعالجة الأحداث المعقدة (CEP).
- إدارة مخصصة للذاكرة لمعالجة البيانات بكفاءة داخل الذاكرة وخارجها.
- التكامل مع منظومة Apache Hadoop، بما في ذلك YARN و HDFS و HBase، مع طبقات توافق لـ MapReduce.
يوفر المشروع مجموعة واسعة من الموصلات الخارجية لمصادر ومصبات بيانات متنوعة، مثل Kafka و Elasticsearch و MongoDB و Cassandra و AWS.