p99 = tail latency: os 1% de pedidos mais lentos demoram 3s. O primeiro passo é medir e decompor, não adivinhar. Compare p50 vs p99 — se a p50 é rápida mas a p99 é 3s, o caminho não é uniformemente lento; algo morde apenas sob carga ou em casos extremos (saturação do pool, pausas de GC, N+1, cache fria, uma chamada externa sem timing).
a p99 é a , não a espera média — acelerar a média não faz nada pelo cliente preso lá atrás.
