p99 = tail latency: de langsomste 1% af requests tager 3s. Det første træk er at måle og bryde det ned, ikke gætte. Sammenlign p50 vs p99 — hvis p50 er hurtig men p99 er 3s, er stien ikke ensartet langsom; noget bider kun under load eller i edge cases (pool-mætning, GC-pauser, N+1, cold cache, et un-timet eksternt kald).
p99 er den , ikke den gennemsnitlige ventetid — at gøre gennemsnittet hurtigere gør intet for kunden, der sidder fast bagerst.
