Rate limiting chrání server před příliš mnoha požadavky; HTTP cachování se vyhýbá opakování práce u požadavků, které už zodpovědělo. Obojí je standardizované v HTTP a obojí je nezbytné pro produkční API ve velkém.
Rate limiting
Server omezuje, kolik požadavků smí klient udělat za časové okno, a při překročení vrací 429 Too Many Requests. Limity oznamuje přes hlavičky, aby se slušně vychovaný klient mohl sám přiškrtit:
HTTP/1.1 200 OK
RateLimit-Limit: 100
RateLimit-Remaining: 12
RateLimit-Reset: 30
