Vid hundratals miljoner händelser/dag (~några tusen/sek, högre vid toppar) är det vinnande draget att frikoppla ingestion från serving: absorbera skrivningar i en durable log, processa strömmen en gång, och fördela ut till två datalager finjusterade för motsatta jobb — föraggregerat för föräldrar (snabba läsningar), rått och fullständigt för ML.
ett postrum — collectorn tar emot post, Kafka är löpande bandet, och varje objekt kopieras till två hyllor: en som föräldrar ögnar igenom, och ett som ML-teamet gräver i.
