Apache Flink একটি ওপেন-সোর্স স্ট্রিম প্রসেসিং ফ্রেমওয়ার্ক যা ডেটা স্ট্রিমিং এবং ব্যাচ প্রসেসিং উভয়ের জন্য শক্তিশালী ক্ষমতা প্রদান করে।
ওপেন সোর্স। নতুন সম্ভাবনা।
মানসম্মত ওপেন-সোর্স প্রজেক্ট আবিষ্কার করুন, বেনামে প্রজেক্ট জমা দিন এবং নিজের প্রজেক্ট দাবি করে সম্পাদনা করুন।
কৌতূহল নিয়ে ওপেন সোর্স আবিষ্কার করুন।
THE FIRST COLLECTIONApache Beam হলো ব্যাচ এবং স্ট্রিমিং ডেটা-প্যারালাল প্রসেসিং পাইপলাইন সংজ্ঞায়িত করার জন্য একটি ইউনিফাইড প্রোগ্রামিং মডেল।
ডেল্টা লেক একটি ওপেন-সোর্স স্টোরেজ ফ্রেমওয়ার্ক যা লেকহাউস আর্কিটেকচার সক্ষম করে। এটি Spark, PrestoDB, Flink, Trino এবং Hive-এর মতো কম্পিউট ইঞ্জিনের সাথে সংহত হয়, নির্ভরযোগ্য ডেটা ব্যবস্থাপনার জন্য ACID ট্রানজ্যাকশন, টাইম ট্রাভেল এবং স্কিমা ইভোলিউশন প্রদান করে।
Arkime হলো একটি বৃহৎ আকারের, ওপেন-সোর্স নেটওয়ার্ক বিশ্লেষণ এবং প্যাকেট ক্যাপচার সিস্টেম, যা PCAP ফরম্যাটে নেটওয়ার্ক ট্রাফিক সংরক্ষণ এবং ইনডেক্স করার জন্য ব্যবহৃত হয়।
Trino হলো বিগ ডেটা অ্যানালিটিক্সের জন্য ডিজাইন করা একটি দ্রুত ডিস্ট্রিবিউটেড SQL কুয়েরি ইঞ্জিন, যা আগে PrestoSQL নামে পরিচিত ছিল।
CatBoost হলো Yandex-এর ওপেন-সোর্স গ্রেডিয়েন্ট বুস্টিং লাইব্রেরি, যা শ্রেণিবিন্যাস, রিগ্রেশন এবং র্যাংকিংয়ের জন্য ব্যবহৃত হয়। এতে ক্যাটাগরিক্যাল ফিচার সাপোর্ট, CPU/GPU প্রশিক্ষণ, Apache Spark-এর মাধ্যমে ডিস্ট্রিবিউটেড প্রশিক্ষণ এবং Python, R, Java ও C++-এর জন্য API রয়েছে।
স্কেলযোগ্য, নির্ভরযোগ্য ও উচ্চ-কর্মক্ষমতাসম্পন্ন বৃহৎ-পরিসরের সিস্টেম নির্মাণের উপর সাজানো পড়ার তালিকা, যেখানে ডিজাইন নীতি, প্রযুক্তি জায়ান্টদের কেস স্টাডি ও ইন্টারভিউ রিসোর্স রয়েছে।
Apache DataFusion হলো Rust-এ লেখা একটি এক্সটেনসিবল কুয়েরি ইঞ্জিন যা ইন-মেমরি ফরম্যাট হিসেবে Apache Arrow ব্যবহার করে এবং দ্রুত অ্যানালিটিক সিস্টেম তৈরির জন্য SQL এবং DataFrame API প্রদান করে।
ClickHouse হলো একটি ওপেন-সোর্স, কলাম-ওরিয়েন্টেড ডাটাবেস ম্যানেজমেন্ট সিস্টেম যা রিয়েল-টাইম অ্যানালিটিক্যাল ডাটা রিপোর্টিংয়ের জন্য ডিজাইন করা হয়েছে।
সাইথন একটি অপ্টিমাইজিং কম্পাইলার যা পাইথন কোডকে সি/সি++ তে অনুবাদ করে দ্রুত ও দক্ষ এক্সটেনশ তৈরি করতে সাহায্য করে।
Apache Doris officielle ওয়েবসাইট (doris.apache.org) এর সোর্স কোড, Docusaurus 3 দিয়ে তৈরি। Apache Doris, একটি রিয়েল-টাইম MPP বিশ্লেষণात्मक ডেটাবেস, এর জন্য বহুভাষিক ডকুমেন্টেশন, ব্লগ পোস্ট এবং কমিউনিটি গাইড হোস্ট করে।
Apache Spark হলো বৃহৎ আকারের ডেটা প্রসেসিংয়ের জন্য ডিজাইন করা একটি ইউনিফাইড অ্যানালিটিক্স ইঞ্জিন, যা জেনারেল কম্পিউটেশন গ্রাফের জন্য হাই-লেভেল API এবং একটি অপ্টিমাইজড ইঞ্জিন প্রদান করে।