Rate limiting server ને બહુ બધા requests થી સુરક્ષિત કરે છે; HTTP caching પહેલેથી જવાબ આપેલા requests માટે કામ પુનરાવર્તન ટાળે છે. બંને HTTP માં પ્રમાણભૂત છે અને બંને scale પર production API માટે આવશ્યક છે.
Rate limiting
Server એક client દર window કેટલા requests કરી શકે તે મર્યાદિત કરે છે અને વટાવાય ત્યારે 429 Too Many Requests પરત કરે છે. તે headers દ્વારા મર્યાદાઓ જાહેર કરે છે જેથી સારી રીતે વર્તતો client જાતે throttle કરી શકે:
HTTP/1.1 200 OK
RateLimit-Limit: 100
RateLimit-Remaining: 12
RateLimit-Reset: 30
