दररोज शेकडो दशलक्ष events/day (~काही हजार/sec, peaks ला जास्त) या प्रमाणात विजयी चाल म्हणजे ingestion ला serving पासून decouple करणे: writes एका durable log मध्ये शोषून घ्या, stream एकदाच process करा, आणि विरुद्ध कामांसाठी tuned केलेल्या दोन stores मध्ये fan out करा — parents साठी pre-aggregated (fast reads), ML साठी raw आणि full-fidelity.
एक mailroom — collector मेल घेतो, Kafka हा conveyor belt आहे, आणि प्रत्येक वस्तू दोन shelves वर copy होते: एक जो parents नजर टाकतात, आणि एक ज्यात ML team खोदून पाहते.
