In Kubernetes, requests define the resources a pod is scheduled for, while limits cap usage. High requests waste money, low memory limits trigger OOM kills, and low CPU limits cause throttling. Right-sizing these values is a high-leverage cost lever.