Przy setkach milionów zdarzeń dziennie (~kilka tysięcy/s, więcej w szczytach) zwycięskim ruchem jest oddzielenie ingestu od serwowania: pochłoń zapisy do trwałego logu, przetwórz strumień raz i rozprowadź do dwóch stores dostrojonych do przeciwnych zadań — wstępnie zagregowanych dla rodziców (szybkie odczyty), surowych i o pełnej wierności dla ML.
kancelaria pocztowa — collector odbiera pocztę, Kafka jest taśmociągiem, a każda przesyłka jest kopiowana na dwie półki: , na którą rodzice zerkają, oraz , które przekopuje zespół ML.
