## Operational topics

### Rate limits and 429 responses

**What it covers:** RPM limits per product tier, throttling behavior, and rate-limit increases  
**Page:** [Limits and quotas](https://docs.parasail.io/parasail-docs/operate-in-production/limits-and-quotas#rate-limits)

### Quota management

**What it covers:** GPU quota across Batch and Dedicated, quota errors, and increase requests  
**Page:** [Limits and quotas](https://docs.parasail.io/parasail-docs/operate-in-production/limits-and-quotas#gpu-quota)

### Autoscaling and replicas

**What it covers:** Max concurrent requests, target concurrency, smoothing, and replica ranges  
**Page:** [Auto-Scaling](https://docs.parasail.io/parasail-docs/products/overview-1/auto-scaling)

### Deployment lifecycle

**What it covers:** Create, pause, edit, resume, and destroy Dedicated Instances  
**Page:** [Dedicated Instances](https://docs.parasail.io/parasail-docs/products/overview-1)

### Batch job lifecycle

**What it covers:** Submission, priority, status polling, cancellation, and terminal states  
**Page:** [Batch Quickstart](https://docs.parasail.io/parasail-docs/products/quickstart)

### Batch troubleshooting

**What it covers:** Validation, file-size limits, stuck jobs, partial failures, and quota errors  
**Page:** [Batch Troubleshooting](https://docs.parasail.io/parasail-docs/products/quickstart/troubleshooting)

### Retries and idempotency

**What it covers:** 429 handling, exponential backoff, timeouts, and safe retry limits  
**Page:** [Retries and Idempotency](https://docs.parasail.io/parasail-docs/operate-in-production/retries-and-idempotency)

## Cost and capacity controls

Use the controls documented elsewhere in the docs to keep workloads predictable:

- **Dedicated status page:** Each Dedicated Instance has a status page for viewing deployment status and controlling the endpoint. See [Dedicated Instances](https://docs.parasail.io/parasail-docs/products/overview-1#dedicated-status-page).
- **Pause to stop billing:** Dedicated Instances bill while active. Pause an endpoint when it isn't needed, and use autoscaling settings to control replica counts. See [Auto-Scaling](https://docs.parasail.io/parasail-docs/products/overview-1/auto-scaling).
- **GPU quota:** The default GPU quota limits the amount of Batch and Dedicated capacity an organization can consume. See [Limits and quotas](https://docs.parasail.io/parasail-docs/operate-in-production/limits-and-quotas#gpu-quota).
- **Batch status:** Track batch jobs in the Batch UI or poll status through the API. See [Batch Troubleshooting](https://docs.parasail.io/parasail-docs/products/quickstart/troubleshooting).

## Next steps

- [Limits and quotas](https://docs.parasail.io/parasail-docs/operate-in-production/limits-and-quotas)—request rate limits, GPU quota, and quota increase guidance.
- [Retries and Idempotency](https://docs.parasail.io/parasail-docs/operate-in-production/retries-and-idempotency)—handle transient errors safely.
- [Auto-Scaling](https://docs.parasail.io/parasail-docs/products/overview-1/auto-scaling)—size replicas for production traffic.
