Il rate limiting protegge il server da troppe richieste; il caching HTTP evita di ripetere lavoro per richieste a cui ha già risposto. Entrambi sono standardizzati in HTTP ed entrambi sono essenziali per un'API di produzione su larga scala.
Rate limiting
Il server limita quante richieste un client può fare per finestra e restituisce 429 Too Many Requests quando viene superato. Pubblicizza i limiti tramite header così che un client ben educato possa auto-limitarsi:
HTTP/1.1 200 OK
RateLimit-Limit: 100
RateLimit-Remaining: 12
RateLimit-Reset: 30
