Requests são o que um container tem garantido (usado para scheduling); limits são o teto que ele não pode ultrapassar (imposto em runtime). Juntos, eles determinam onde os Pods são posicionados, como são throttled ou mortos sob pressão, e qual classe de Quality of Service (QoS) um Pod recebe.
