Baue eine Append-only-Pipeline: Agents → Kafka → gestaffelter Storage (heiß in ClickHouse/ELK, kalt in Object Storage) mit einer Retention Policy, die aktuelle Daten indexiert und den Rest günstig archiviert. 100 Mio. Events/Tag sind ~1.200/Sek. im Schnitt (Spitzen weit höher) und zehn bis hunderte GB täglich - du optimierst für günstige Writes und begrenzte Query-Kosten, nicht für OLTP-Semantik.
App/agents ─▶ Kafka ─▶ Consumers ─┬─▶ ClickHouse / ELK (hot: last 7–30d, indexed, fast search)
(Fluent Bit) (buffer, │
replay) └─▶ S3/Parquet (cold: 90d–years, cheap, scan-on-demand)
│
Lifecycle/tiering ─▶ Glacier (archive) ─▶ delete at retention
