Bei Hunderten Millionen Events/Tag (~ein paar Tausend/Sek., in Spitzen höher) ist der entscheidende Zug, Ingestion vom Serving zu entkoppeln: Writes in ein durables Log aufnehmen, den Stream einmal verarbeiten und auf zwei für gegensätzliche Aufgaben getunte Stores fächern — vorab aggregiert für Eltern (schnelle Reads), roh und in voller Detailtreue für ML.
eine Poststelle — der Collector nimmt die Post entgegen, Kafka ist das Förderband, und jedes Stück wird auf zwei Regale kopiert: eine , auf die Eltern einen Blick werfen, und ein , das das ML-Team durchwühlt.
