Ndërtoni një pipeline append-only: agents → Kafka → tiered storage (i nxehtë në ClickHouse/ELK, i ftohtë në object storage) me një retention policy që indekson të dhënat e fundit dhe arkivon pjesën tjetër lirë. 100M events/ditë janë ~1,200/sek mesatarisht (spikes shumë më të larta) dhe dhjetëra-deri-qindra GB në ditë — optimizoni për shkrime të lira dhe kosto query të kufizuar, jo semantikë OLTP.
App/agents ─▶ Kafka ─▶ Consumers ─┬─▶ ClickHouse / ELK (hot: last 7–30d, indexed, fast search)
(Fluent Bit) (buffer, │
replay) └─▶ S3/Parquet (cold: 90d–years, cheap, scan-on-demand)
│
Lifecycle/tiering ─▶ Glacier (archive) ─▶ delete at retention
