एक append-only pipeline बनवा: agents → Kafka → tiered storage (hot ClickHouse/ELK मध्ये, cold object storage मध्ये) एका retention policy सह जी अलीकडील data index करते आणि उर्वरित स्वस्तात archive करते. दररोज 10 कोटी events म्हणजे सरासरी ~1,200/sec (spikes खूप जास्त) आणि दररोज दहा-ते-शंभर GB — तुम्ही स्वस्त writes आणि बांधलेल्या query cost साठी optimize करता, OLTP semantics साठी नाही.
App/agents ─▶ Kafka ─▶ Consumers ─┬─▶ ClickHouse / ELK (hot: last 7–30d, indexed, fast search)
(Fluent Bit) (buffer, │
replay) └─▶ S3/Parquet (cold: 90d–years, cheap, scan-on-demand)
│
Lifecycle/tiering ─▶ Glacier (archive) ─▶ delete at retention
