p99 = tail latency: najwolniejszy 1% requestów zajmuje 3 s. Pierwszy ruch to zmierzyć i rozłożyć na części, nie zgadywać. Porównaj p50 z p99 — jeśli p50 jest szybkie, ale p99 to 3 s, ścieżka nie jest równomiernie wolna; coś gryzie tylko pod obciążeniem lub w przypadkach brzegowych (saturacja pooli, pauzy GC, N+1, zimny cache, nieobmierzone wywołanie zewnętrzne).
p99 to , a nie średni czas oczekiwania — przyspieszenie średniej nic nie daje klientowi utkniętemu na końcu.
