Rate limiting protejează serverul de prea multe cereri; HTTP caching evită repetarea muncii pentru cereri la care a răspuns deja. Ambele sunt standardizate în HTTP și ambele sunt esențiale pentru un API de producție la scară.
Rate limiting
Serverul limitează câte cereri poate face un client per fereastră și returnează 429 Too Many Requests când se depășește. Anunță limitele prin headere, astfel încât un client bine-manierat să se poată auto-limita:
HTTP/1.1 200 OK
RateLimit-Limit: 100
RateLimit-Remaining: 12
RateLimit-Reset: 30
