Bij honderden miljoenen events/dag (~enkele duizenden/sec, hoger bij pieken) is de winnende zet om ingest van serving te ontkoppelen: absorbeer writes in een duurzame log, verwerk de stream één keer, en fan out naar twee stores die voor tegengestelde taken zijn afgestemd — voor-geaggregeerd voor ouders (snelle reads), raw en met volledige detailgetrouwheid voor ML.
een postkamer — de collector ontvangt de post, Kafka is de lopende band, en elk item wordt op twee planken gekopieerd: een waar ouders even naar kijken, en een dat het ML-team doorspit.
