# Operational topics

## Topic  
### What it covers  
### Page

- **Rate limits and 429 responses**  
  RPM limits per product tier, throttling behavior, and rate-limit increases  
  [Limits and quotas](https://docs.parasail.io/parasail-docs/operate-in-production/limits-and-quotas#rate-limits)

- **Quota management**  
  GPU quota across Batch and Dedicated, quota errors, and increase requests  
  [Limits and quotas](https://docs.parasail.io/parasail-docs/operate-in-production/limits-and-quotas#gpu-quota)

- **Autoscaling and replicas**  
  Max concurrent requests, target concurrency, smoothing, and replica ranges  
  [Auto-Scaling](https://docs.parasail.io/parasail-docs/products/overview-1/auto-scaling)

- **Deployment lifecycle**  
  Create, pause, edit, resume, and destroy Dedicated Instances  
  [Dedicated Instances](https://docs.parasail.io/parasail-docs/products/overview-1)

- **Batch job lifecycle**  
  Submission, priority, status polling, cancellation, and terminal states  
  [Batch Quickstart](https://docs.parasail.io/parasail-docs/products/quickstart)

- **Batch troubleshooting**  
  Validation, file-size limits, stuck jobs, partial failures, and quota errors  
  [Batch Troubleshooting](https://docs.parasail.io/parasail-docs/products/quickstart/troubleshooting)

- **Retries and idempotency**  
  429 handling, exponential backoff, timeouts, and safe retry limits  
  [Retries and Idempotency](https://docs.parasail.io/parasail-docs/operate-in-production/retries-and-idempotency)

# Cost and capacity controls

Use the controls documented elsewhere in the docs to keep workloads predictable:

- **Dedicated status page:** Each Dedicated Instance has a status page for viewing deployment status and controlling the endpoint. See [Dedicated Instances](https://docs.parasail.io/parasail-docs/products/overview-1#dedicated-status-page).

- **Pause to stop billing:** Dedicated Instances bill while active. Pause an endpoint when it isn't needed, and use autoscaling settings to control replica counts. See [Auto-Scaling](https://docs.parasail.io/parasail-docs/products/overview-1/auto-scaling).

- **GPU quota:** The default GPU quota limits the amount of Batch and Dedicated capacity an organization can consume. See [Limits and quotas](https://docs.parasail.io/parasail-docs/operate-in-production/limits-and-quotas#gpu-quota).

- **Batch status:** Track batch jobs in the Batch UI or poll status through the API. See [Batch Troubleshooting](https://docs.parasail.io/parasail-docs/products/quickstart/troubleshooting).

# Next steps

- [Limits and quotas](https://docs.parasail.io/parasail-docs/operate-in-production/limits-and-quotas)—request rate limits, GPU quota, and quota increase guidance.
- [Retries and Idempotency](https://docs.parasail.io/parasail-docs/operate-in-production/retries-and-idempotency)—handle transient errors safely.
- [Auto-Scaling](https://docs.parasail.io/parasail-docs/products/overview-1/auto-scaling)—size replicas for production traffic.
