## Embedding models

| Model                             | HuggingFace ID                      | Notes                                       |
|-----------------------------------|-------------------------------------|---------------------------------------------|
| GritLM                            | `parasail-ai/GritLM-7B-vllm`      | Developed by Contextual, rivals proprietary models |
| GTE-Qwen2-7B-Instruct            | `Alibaba-NLP/gte-Qwen2-7B-instruct` | From Alibaba, strong general-purpose embeddings |

Any embedding model on HuggingFace can be used with Parasail's batch and dedicated APIs.

## Generate embeddings

### Serverless (low volume)

```python
from openai import OpenAI

client = OpenAI(
    base_url="https://api.parasail.io/v1",
    api_key="<PARASAIL_API_KEY>"
)

response = client.embeddings.create(
    model="parasail-ai/GritLM-7B-vllm",
    input="Parasail provides affordable cloud GPUs for AI inference.",
    encoding_format="base64"
)

print(response.data[0].embedding[:5])
```

### Batch (large scale—50% off)

```python
from openai_batch import Batch

with Batch() as batch:
    for i in range(100):
        batch.add_to_batch(
            model="parasail-ai/GritLM-7B-vllm",
            encoding_format="base64",
            input=f"This is input #{i}"
        )
    result, output_path, error_path = batch.submit_wait_download()
```

Parasail strongly recommends using `encoding_format="base64"` to reduce output file sizes.

## Relevant guides

- [RAG guide](https://docs.parasail.io/parasail-docs/guides/rag)—step-by-step RAG implementation
- [Model selection](https://docs.parasail.io/parasail-docs/guides/model-recommendations#evaluate-candidates)—includes embedding model evaluation

## API reference

- [Embeddings API](https://docs.parasail.io/parasail-docs/api-reference/embeddings)
- [Batch API](https://docs.parasail.io/parasail-docs/api-reference/batch-api)—for large-scale embedding generation
- [Batch embedding models](https://docs.parasail.io/parasail-docs/products/quickstart#batch-embedding-models)

## Next steps

- [Batch quickstart](https://docs.parasail.io/parasail-docs/quickstart/batch)—submit your first batch embedding job
- [Batch full guide](https://docs.parasail.io/parasail-docs/products/quickstart)—comprehensive batch processing documentation
