Při stovkách milionů událostí/den (~pár tisíc/s, ve špičkách víc) je vítězným tahem oddělit ingest od servírování: pohltit zápisy do trvanlivého logu, zpracovat stream jednou a rozvětvit do dvou úložišť vyladěných na opačné úlohy — předagregovaná pro rodiče (rychlé čtení), surová a v plné věrnosti pro ML.
podatelna — collector přijímá poštu, Kafka je dopravní pás a každá položka se kopíruje na dvě police: , na kterou rodiče mrknou, a , ve kterém se prohrabuje ML tým.
