Xây một pipeline append-only: agent → Kafka → tiered storage (hot trong ClickHouse/ELK, cold trong object storage) kèm chính sách retention index dữ liệu gần đây và lưu trữ phần còn lại giá rẻ. 100M event/ngày là ~1.200/giây trung bình (đỉnh cao hơn nhiều) và hàng chục-đến-hàng trăm GB mỗi ngày — bạn tối ưu cho write rẻ và chi phí query có giới hạn, không phải semantics OLTP.
App/agents ─▶ Kafka ─▶ Consumers ─┬─▶ ClickHouse / ELK (hot: last 7–30d, indexed, fast search)
(Fluent Bit) (buffer, │
replay) └─▶ S3/Parquet (cold: 90d–years, cheap, scan-on-demand)
│
Lifecycle/tiering ─▶ Glacier (archive) ─▶ delete at retention
