p99 = tail latency: l'1% di richieste più lente impiega 3s. La prima mossa è misurare e scomporre, non tirare a indovinare. Confronta p50 e p99 — se il p50 è veloce ma il p99 è 3s, il percorso non è uniformemente lento; qualcosa morde solo sotto carico o in casi limite (saturazione del pool, pause GC, N+1, cache fredda, una chiamata esterna senza timeout).
il p99 è la , non l'attesa media — velocizzare la media non fa nulla per il cliente bloccato in fondo.
