Bouw een append-only pipeline: agents → Kafka → tiered storage (hot in ClickHouse/ELK, cold in object storage) met een retentiebeleid dat recente data indexeert en de rest goedkoop archiveert. 100M events/dag is gemiddeld ~1.200/sec (pieken veel hoger) en tientallen tot honderden GB per dag — je optimaliseert voor goedkope writes en begrensde querykosten, niet voor OLTP-semantiek.
App/agents ─▶ Kafka ─▶ Consumers ─┬─▶ ClickHouse / ELK (hot: laatste 7–30d, geïndexeerd, snelle search)
(Fluent Bit) (buffer, │
replay) └─▶ S3/Parquet (cold: 90d–jaren, goedkoop, scan-on-demand)
│
Lifecycle/tiering ─▶ Glacier (archief) ─▶ verwijder bij retentie
