Gửi tin nhắn Kafka bất đồng bộ với aiokafka trong Python
Giới thiệu
AIOKafkaProducer là client bất đồng bộ dùng để xuất bản bản ghi lên cụm Kafka. Các ví dụ dưới đây được viết cho aiokafka 0.8+ và Python 3.8 trở lên, sử dụng asyncio.run thay vì truyền loop trực tiếp.
Gửi một tin nhắn đơn
Khi tạo producer, gọi start(), gửi tin bằng send_and_wait(), rồi dừng producer trong khối finally.
import asyncio ...
Đăng vào ngày 27 tháng 9 lúc 10:25
Xử lý sự cố Kafka Consumer Group Coordinator không khả dụng
Khi ứng dụng Kafka consumer khởi động, hệ thống liên tục ghi log lỗi liên quan đến việc không thể tham gia vào nhóm người tiêu thụ (consumer group). Nguyên nhân cốt lõi nằm ở trạng thái Group Coordinator — thành phần chịu trách nhiệm quản lý nhóm và phân bổ partition — bị báo cáo là "không khả dụng" hoặc "vô hiệu".
Phân tích dấu hiệu lỗi
Các t ...
Đăng vào ngày 24 tháng 8 lúc 05:12
Cài đặt và Triển khai HBase 2.0
Hướng dẫn này mô tả quy trình cài đặt và triển khai HBase phiên bản 2.0. Trước khi bắt đầu, hãy đảm bảo rằng bạn đã cài đặt thành công ZooKeeper, Kafka và Hadoop.
Kiến trúc hệ thống
Hệ thống được cấu hình trên ba máy chủ: hadoop101, hadoop102 và hadoop103. Cụ thể:
HDFS: NameNode trên hadoop101, SecondaryNameNode trên hadoop103. DataNode đ ...
Đăng vào ngày 24 tháng 7 lúc 22:31
Thiết kế ID nhóm người tiêu dùng Apache Kafka 3.1: Chiến lược ngăn ngừa tiêu dùng trùng lặp
Trong các hệ thống tin nhắn phân tán, ID nhóm người tiêu dùng (Consumer Group ID) đóng vai trò thiết yếu trong việc đảm bảo thứ tự tin nhắn và ngăn ngừa tiêu dùng trùng lặp. Thiết kế sai lệch về ID có thể dẫn đến xử lý dữ liệu trùng lặp, độ trễ tiêu dùng thậm chí là bất thường trong logic nghiệp vụ. Bài viết này phân tích từ thực tiễn ứng dụng ...
Đăng vào ngày 11 tháng 7 lúc 08:29
Triển khai Kafka bằng Docker
Kafka là một hệ thống nhắn tin phân tán mạnh mẽ, thường được sử dụng cho các ứng dụng truyền dữ liệu thời gian thực. Việc triển khai Kafka có thể trở nên phức tạp, nhưng Docker cung cấp một giải pháp hiệu quả để đơn giản hóa quá trình này.
Các Khái Niệm Cơ Bản Của Kafka
Producer (Nhà sản xuất): Ứng dụng gửi dữ liệu (tin nhắn) đến Kafka.
...
Đăng vào ngày 3 tháng 7 lúc 13:23
Các lệnh Kafka thông dụng
Khởi động Zookeeper
bin/zkServer.sh start
Hoặc sử dụng script có sẵn của Kafka:
bin/zookeeper-server-start.sh config/zookeeper.properties
Khởi động Kafka broker
bin/kafka-server-start.sh -daemon config/server.properties
Dừng Kafka broker (cần đợi vài giây để hoàn tất tiến trình dọn dẹp)
bin/kafka-server-stop.sh config/server.properties
T ...
Đăng vào ngày 1 tháng 7 lúc 19:52
Kết hợp Kafka và ClickHouse: Xây dựng hệ thống xử lý dữ liệu thời gian thực hiệu suất cao
Vấn đề thực tiễn cần giải quyết
Hãy tưởng tượng bạn đang quản lý hệ thống thu thập dữ liệu bán hàng từ nhiều cửa hàng phân tán. Yêu cầu đặt ra là xử lý dữ liệu theo thời gian thực và hiển thị trên bảng điều khiển phân tích nâng cao.
ClickHouse nổi tiếng với tốc độ xử lý dữ liệu cực nhanh, nhưng việc ghi dữ liệu trực tiếp vào hệ thống này gặp n ...
Đăng vào ngày 29 tháng 6 lúc 23:55
Hướng dẫn chi tiết: Cách xây dựng ứng dụng Kafka hiệu quả và đáng tin cậy với librdkafka
librdkafka là một thư viện client mạnh mẽ dành cho C/C++, được thiết kế đặc biệt cho Apache Kafka, đảm bảo hiệu suất cao và độ tin cậy tuyệt vời. Bài viết này sẽ hướng dẫn bạn cách sử dụng thư viện mã nguồn mở này, từ các tính năng chính đến việc triển khai thực tế, giúp bạn nhanh chóng phát triển các ứng dụng Kafka ổn định.
Tại sao chọn libr ...
Đăng vào ngày 28 tháng 6 lúc 05:59
Bảo đảm Tính nhất quán Dữ liệu trong Hàng đợi Tin nhắn
Nguyên nhân gây ra vấn đề nhất quán dữ liệu
Các sự cố phổ biến trong hệ thống hàng đợi tin nhắn bao gồm:
Lỗi nhà sản xuất: Tin nhắn được nhận bởi broker nhưng chưa ghi đĩa trước khi mất điện
Lỗi người tiêu dùng: Xử lý nghiệp vụ thất bại sau khi tiêu thụ tin nhắn thành công
Phân phối trùng lặp: Do bất ổn mạng gây ra gửi tin nhắn nhiều lần
Bất đ ...
Đăng vào ngày 27 tháng 6 lúc 08:16
Spark Streaming với Kafka 1.0.1: Quản lý Offset trực tiếp vào HBase
Trong kiến trúc xử lý luồng thời gian thực, việc đảm bảo tính nhất quán và khả năng khôi phục sau sự cố phụ thuộc rất lớn vào cơ chế quản lý offset một cách đáng tin cậy. Bài viết này trình bày cách tích hợp Spark Streaming (phiên bản tương thích với Kafka 1.0.1) theo mô hình Direct Stream, đồng thời lưu trữ và truy vấn offset từ HBase — thay v ...
Đăng vào ngày 27 tháng 6 lúc 07:07