Rate limiting server کو بہت زیادہ requests سے بچاتی ہے؛ HTTP caching ان requests کے لیے کام دہرانے سے بچتی ہے جن کا وہ پہلے ہی جواب دے چکا ہے۔ دونوں HTTP میں معیاری ہیں اور دونوں بڑے پیمانے پر ایک production API کے لیے ضروری ہیں۔
Rate limiting
server یہ حد مقرر کرتا ہے کہ ایک client فی کھڑکی کتنی requests کر سکتا ہے اور حد سے تجاوز پر 429 Too Many Requests واپس کرتا ہے۔ یہ headers کے ذریعے حدود کا اعلان کرتا ہے تاکہ ایک اچھے رویے والا client خود کو محدود کر سکے:
HTTP/1.1 200 OK
RateLimit-Limit: 100
RateLimit-Remaining: 12
RateLimit-Reset: 30
