Tổng quan về Apache Flink và kỷ nguyên xử lý dữ liệu thời gian thực

Sự chuyển dịch trong tư duy xử lý dữ liệu lớn Trong kỷ nguyên số, dữ liệu không còn là những tệp tin tĩnh nằm yên trong ổ cứng mà là một dòng chảy liên tục. Hãy tưởng tượng một hệ thống thương mại điện tử cần phát hiện gian lận thanh toán ngay lập tức. Nếu sử dụng các công cụ lưu trữ và phân tích truyền thống, việc phát hiện có thể mất vài giờ, ...

Đăng vào ngày 25 tháng 7 lúc 16:04

Phát triển dựa trên mã nguồn Flink Stream API - Yêu cầu hệ thống động

Tổng quan Bài viết này trình bày cách thực hiện phát triển nâng cao dựa trên mã nguồn của Flink để xây dựng một hệ thống động quản lý quy tắc. Thông qua việc tạo các toán tử tùy chỉnh và bộ phối hợp toán tử, hệ thống có thể xử lý tính toán quy tắc theo thời gian thực và quản lý đồng bộ giữa các tác vụ. Mục tiêu là giúp người đọc hiểu rõ hơn về ...

Đăng vào ngày 2 tháng 7 lúc 09:07

Học Nền Tảng Apache Flink

Video tham khảo: https://www.bilibili.com/video/BV1qy4y1q728?p=14&spm_id_from=333.33.header_right.history_list.click Nguồn tài liệu gốc: https://ashiamd.github.io/docsify-notes/#/study/BigData/Flink/%E5%B0%9A%E7%A1%85%E8%B0%B7Flink%E5%85%A5%E9%97%A8%E5%88%B0%E5%AE%9E%E6%88%98-%E5%AD%A6%E4%B9%A0%E7%AC%94%E8%AE%B0?id=_11-flink-vs-spark-st ...

Đăng vào ngày 24 tháng 5 lúc 08:03

Xây dựng cơ sở hạ tầng Big Data - Flink (2)

# Địa chỉ node TaskManager. Cần cấu hình là tên máy hiện tại taskmanager.host: hadoop103 Thực thi lệnh: [hadoop@hadoop104 conf]$ vim flink-conf.yaml Nội dung đã sửa: # Địa chỉ node TaskManager. Cần cấu hình là tên máy hiện tại taskmanager.host: hadoop104 Ba. Khởi động và dừng cụm (Chế độ Standalone) Trên node máy chủ hadoop102, thực t ...

Đăng vào ngày 21 tháng 5 lúc 10:51