Ved hundredvis af millioner events/dag (~et par tusinde/sek, højere ved spidsbelastning) er det vindende træk at afkoble ingestion fra serving: absorbér writes ind i en durable log, processér streamen én gang, og fan ud til to stores tunet til modsatte jobs — præ-aggregeret til forældre (hurtige reads), rå og fuld-fidelitet til ML.
et postrum — collectoren modtager post, Kafka er transportbåndet, og hvert stykke kopieres til to hylder: en forældre kigger på, og et ML-teamet graver i.
