p99 = tail latency: cele mai lente 1% dintre cereri durează 3s. Prima mișcare este să măsori și să descompui, nu să ghicești. Compară p50 vs p99 — dacă p50 este rapid, dar p99 este 3s, calea nu este uniform lentă; ceva mușcă doar sub sarcină sau în cazuri limită (saturarea pool-ului, pauze GC, N+1, cache rece, un apel extern necronometrat).
p99 este , nu așteptarea medie — accelerarea mediei nu face nimic pentru clientul blocat la coadă.
