p99 = tail latency: de långsammaste 1% av requests tar 3 s. Första draget är att mäta och bryta ner, inte gissa. Jämför p50 mot p99 — om p50 är snabb men p99 är 3 s är vägen inte enhetligt långsam; något biter bara under last eller i edge cases (pool-mättnad, GC-pauser, N+1, kall cache, ett otajmat externt anrop).
p99 är den , inte den genomsnittliga väntetiden — att snabba upp genomsnittet gör inget för kunden som fastnat längst bak.
