Rate Limiting schützt den Server vor zu vielen Requests; HTTP-Caching vermeidet die Wiederholung von Arbeit für Requests, die es bereits beantwortet hat. Beide sind in HTTP standardisiert und beide sind essenziell für eine Produktions-API bei Skalierung.
Rate Limiting
Der Server begrenzt, wie viele Requests ein Client pro Fenster machen darf, und gibt 429 Too Many Requests zurück, wenn überschritten. Er bewirbt Limits über Header, sodass ein wohlerzogener Client sich selbst drosseln kann:
HTTP/1.1 200 OK
RateLimit-Limit: 100
RateLimit-Remaining: 12
RateLimit-Reset: 30
