Dies sind die drei Säulen der Observability. Sie beantworten unterschiedliche Fragen: Metriken sagen dir, dass etwas falsch ist, Logs sagen dir, passiert ist, und Traces sagen dir, in einem verteilten Fluss die Zeit oder der Fehler hingegangen ist.
Dies sind die drei Säulen der Observability. Sie beantworten unterschiedliche Fragen: Metriken sagen dir, dass etwas falsch ist, Logs sagen dir, passiert ist, und Traces sagen dir, in einem verteilten Fluss die Zeit oder der Fehler hingegangen ist.
METRICS aggregate numbers over time (counters, gauges, histograms)
→ cheap, low cardinality, great for trends & ALERTING
→ e.g. error rate = 2%, p99 latency = 800ms
LOGS discrete, timestamped events with detail (often structured JSON)
→ rich context for DEBUGGING a specific request
→ e.g. {"level":"error","user":123,"msg":"payment declined"}
TRACES the path of one request across services, with timing per span
→ shows latency BREAKDOWN and where a call fails
→ e.g. checkout 800ms = api 50ms + db 700ms + email 50ms
1. METRIC alerts: "checkout p99 latency jumped to 2s" → you know THERE's a problem
2. TRACE a slow request: 1.8s of 2s is spent in the inventory service
→ you know WHERE it is
3. LOGS of the inventory service at that time: "slow query: missing index"
→ you know WHAT happened
Metriken grenzen dich auf ein Symptom und Zeitfenster ein; Traces lokalisieren es auf einen Service oder Aufruf; Logs geben dir die exakte Ursache. Direkt zu Logs zu gehen ohne Metriken bedeutet, blind zu suchen.
Metriken sind aggregiert, daher bleiben sie auch bei großem Maßstab kostengünstig — ideal für ständig aktive Dashboards und Alerts. Logs und Traces sind pro Ereignis und teuer, daher werden sie normalerweise gesampelt und bei Bedarf während der Untersuchung abgefragt.
Die Wahl der falschen Säule verschwendet Zeit: Du kannst nicht effektiv auf rohe Logs alerting (zu laut, zu teuer), und du kannst eine bestimmte fehlerhafte Anfrage nicht von einer aggregierten Metrik aus debuggen. Zu wissen, dass Metriken erkennen, Traces lokalisieren und Logs erklären, gibt dir einen schnellen, wiederholbaren Weg von "etwas stimmt nicht" zur Grundursache.
Eine Sammlung von IT-Interviewfragen mit ausführlichen Antworten — vom Junior bis zum Senior.
Spenden