ایک append-only pipeline بنائیں: agents → Kafka → tiered storage (hot ClickHouse/ELK میں، cold object storage میں) ایک retention policy کے ساتھ جو حالیہ ڈیٹا کو index کرے اور باقی کو سستے میں archive کرے۔ 10 کروڑ events/day اوسطاً تقریباً 1,200/sec (spikes کہیں زیادہ) اور روزانہ دسیوں سے سینکڑوں GB ہیں — آپ سستی writes اور محدود query لاگت کے لیے optimize کرتے ہیں، OLTP semantics کے لیے نہیں۔
App/agents ─▶ Kafka ─▶ Consumers ─┬─▶ ClickHouse / ELK (hot: last 7–30d, indexed, fast search)
(Fluent Bit) (buffer, │
replay) └─▶ S3/Parquet (cold: 90d–years, cheap, scan-on-demand)
│
Lifecycle/tiering ─▶ Glacier (archive) ─▶ delete at retention
