p99 = tail latency: de tregeste 1 % av requests bruker 3s. Det første trekket er å måle og bryte det ned, ikke gjette. Sammenlign p50 mot p99 — hvis p50 er rask, men p99 er 3s, er ikke veien jevnt treg; noe biter kun under load eller i edge cases (pool-metning, GC-pauser, N+1, kald cache, et utimet eksternt kall).
p99 er den , ikke gjennomsnittsventetiden — å gjøre gjennomsnittet raskere gjør ingenting for kunden som står fast bakerst.
