Στα εκατοντάδες εκατομμύρια events/ημέρα (~μερικές χιλιάδες/δευτερόλεπτο, υψηλότερα στις αιχμές) η νικηφόρα κίνηση είναι να αποσυνδέσετε το ingestion από το serving: απορροφήστε τα writes σε ένα durable log, επεξεργαστείτε το stream μία φορά, και κάντε fan out σε δύο stores ρυθμισμένα για αντίθετες δουλειές — pre-aggregated για τους γονείς (γρήγορα reads), raw και πλήρους πιστότητας για ML.
ένα mailroom — ο collector παραλαμβάνει την αλληλογραφία, το Kafka είναι ο μεταφορικός ιμάντας, και κάθε αντικείμενο αντιγράφεται σε δύο ράφια: έναν που κοιτάζουν οι γονείς με μια ματιά, και ένα στο οποίο σκάβει η ομάδα ML.
