Byg en append-only pipeline: agents → Kafka → tiered storage (hot i ClickHouse/ELK, cold i object storage) med en retention-politik der indekserer nylige data og billigt arkiverer resten. 100M events/dag er ~1.200/sek i gennemsnit (spikes langt højere) og titusinder-til-hundreder af GB dagligt — du optimerer for billige writes og afgrænset query-omkostning, ikke OLTP-semantik.
App/agents ─▶ Kafka ─▶ Consumers ─┬─▶ ClickHouse / ELK (hot: last 7–30d, indexed, fast search)
(Fluent Bit) (buffer, │
replay) └─▶ S3/Parquet (cold: 90d–years, cheap, scan-on-demand)
│
Lifecycle/tiering ─▶ Glacier (archive) ─▶ delete at retention
