A centenas de milhões de eventos/dia (~alguns milhares/seg, mais nos picos) a jogada vencedora é desacoplar a ingestão do serviço: absorver as escritas num log durável, processar o stream uma vez e distribuir para dois stores otimizados para tarefas opostas — pré-agregado para os pais (leituras rápidas), bruto e de fidelidade total para ML.
uma sala de correio — o coletor recebe o correio, o Kafka é a passadeira transportadora, e cada item é copiado para duas prateleiras: um que os pais consultam de relance, e um que a equipa de ML explora a fundo.
