روزانہ کروڑوں events (تقریباً چند ہزار فی سیکنڈ، peaks پر زیادہ) پر جیتنے والی حکمتِ عملی یہ ہے کہ ingestion کو serving سے decouple کریں: writes کو ایک durable log میں جذب کریں، stream کو ایک بار process کریں، اور اسے دو ایسے stores کی طرف fan out کریں جو مخالف کاموں کے لیے tuned ہوں — والدین کے لیے pre-aggregated (تیز reads)، اور ML کے لیے raw اور full-fidelity۔
ایک mailroom — collector ڈاک وصول کرتا ہے، Kafka conveyor belt ہے، اور ہر چیز دو shelves پر copy کی جاتی ہے: ایک جسے والدین ایک نظر دیکھتے ہیں، اور ایک جسے ML team کھنگالتی ہے۔
