Most replay failures need higher limits, while a smaller counterfactual cohort may require code changes or migration.