ஒரு append-only pipeline உருவாக்குங்கள்: agents → Kafka → tiered storage (hot ClickHouse/ELK-இல், cold object storage-இல்) ஒரு retention policy உடன், இது சமீபத்திய data-ஐ index செய்து மீதத்தை மலிவாக archive செய்கிறது. 100M events/day என்பது சராசரியாக ~1,200/sec (spikes மிக அதிகம்) மற்றும் தினமும் பத்து-முதல்-நூறு GB — நீங்கள் OLTP semantics-க்கு அல்ல, மலிவான writes மற்றும் bounded query cost-க்கு optimize செய்கிறீர்கள்.
App/agents ─▶ Kafka ─▶ Consumers ─┬─▶ ClickHouse / ELK (hot: last 7–30d, indexed, fast search)
(Fluent Bit) (buffer, │
replay) └─▶ S3/Parquet (cold: 90d–years, cheap, scan-on-demand)
│
Lifecycle/tiering ─▶ Glacier (archive) ─▶ delete at retention
