> ## Documentation Index
> Fetch the complete documentation index at: https://docs.orq.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# Supported models in AI Gateway

> Browse LLM models available through the AI Gateway. Access GPT, Claude, Gemini, and 500+ models from top providers with unified API integration.

Each model's input and output prices, per 1M tokens, are listed on the **Models** page in **AI Gateway** ([Manage Models](/ai-gateway/using-the-router#enabling-new-models)).

## List of supported models

### Responses API

<CodeGroup>
  ```bash cURL theme={"theme":{"light":"github-light","dark":"github-dark"}}
  curl "https://my.orq.ai/v3/router/responses" \
    -H "Content-Type: application/json" \
    -H "Authorization: Bearer $ORQ_API_KEY" \
    -d '{
      "model": "openai/gpt-5.6-sol",
      "input": "Write a one-sentence bedtime story about a unicorn."
    }'
  ```

  ```python Python theme={"theme":{"light":"github-light","dark":"github-dark"}}
  from openai import OpenAI
  import os

  client = OpenAI(
    base_url="https://my.orq.ai/v3/router",
    api_key=os.getenv("ORQ_API_KEY"),
  )

  response = client.responses.create(
    model="openai/gpt-5.6-sol",
    input="Write a one-sentence bedtime story about a unicorn."
  )

  print(response.output_text)
  ```

  ```typescript TypeScript theme={"theme":{"light":"github-light","dark":"github-dark"}}
  import OpenAI from "openai";

  const client = new OpenAI({
    baseURL: 'https://my.orq.ai/v3/router',
    apiKey: process.env.ORQ_API_KEY,
  });

  async function main() {
    const response = await client.responses.create({
      model: "openai/gpt-5.6-sol",
      input: "Write a one-sentence bedtime story about a unicorn."
    });

    console.log(response.output_text);
  }

  main();
  ```
</CodeGroup>

#### Supported Models

| Provider | Model |
| - | - |
| Alibaba | `alibaba/deepseek-v4-flash` |
| Alibaba | `alibaba/deepseek-v4-pro` |
| Alibaba | `alibaba/kimi-k2.5` |
| Alibaba | `alibaba/kimi-k2.6` |
| Alibaba | `alibaba/qwen-mt-flash` |
| Alibaba | `alibaba/qwen-mt-lite` |
| Alibaba | `alibaba/qwen-plus` |
| Alibaba | `alibaba/qwen-plus-2025-12-01` |
| Alibaba | `alibaba/qwen3-max` |
| Alibaba | `alibaba/qwen3-vl-flash` |
| Alibaba | `alibaba/qwen3-vl-flash-2025-10-15` |
| Alibaba | `alibaba/qwen3-vl-plus` |
| Alibaba | `alibaba/qwen3.5-122b-a10b` |
| Alibaba | `alibaba/qwen3.5-27b` |
| Alibaba | `alibaba/qwen3.5-35b-a3b` |
| Alibaba | `alibaba/qwen3.5-flash` |
| Alibaba | `alibaba/qwen3.5-flash-2026-02-23` |
| Alibaba | `alibaba/qwen3.6-35b-a3b` |
| Alibaba | `alibaba/qwen3.6-flash` |
| Alibaba | `alibaba/qwen3.6-flash-2026-04-16` |
| Alibaba | `alibaba/qwen3.6-plus` |
| Alibaba | `alibaba/qwen3.6-plus-2026-04-02` |
| Alibaba | `alibaba/qwen3.7-max` |
| Alibaba | `alibaba/qwen3.7-max-2026-05-20` |
| Alibaba | `alibaba/qwen3.7-max-2026-06-08` |
| Alibaba | `alibaba/qwen3.7-plus` |
| Alibaba | `alibaba/qwen3.7-plus-2026-05-26` |
| Alibaba | `alibaba/qwen3.8-max` |
| Anthropic | `anthropic/claude-fable-5` |
| Anthropic | `anthropic/claude-fable-5-1` |
| Anthropic | `anthropic/claude-haiku-4-5` |
| Anthropic | `anthropic/claude-haiku-4-5-20251001` |
| Anthropic | `anthropic/claude-opus-4-5` |
| Anthropic | `anthropic/claude-opus-4-5-20251101` |
| Anthropic | `anthropic/claude-opus-4-6` |
| Anthropic | `anthropic/claude-opus-4-7` |
| Anthropic | `anthropic/claude-opus-4-8` |
| Anthropic | `anthropic/claude-opus-5` |
| Anthropic | `anthropic/claude-sonnet-4-5` |
| Anthropic | `anthropic/claude-sonnet-4-5-20250929` |
| Anthropic | `anthropic/claude-sonnet-4-6` |
| Anthropic | `anthropic/claude-sonnet-5` |
| AWS Bedrock | `aws/ai21.jamba-1-5-mini-v1:0` |
| AWS Bedrock | `aws/apac.amazon.nova-lite-v1:0` |
| AWS Bedrock | `aws/apac.amazon.nova-micro-v1:0` |
| AWS Bedrock | `aws/apac.amazon.nova-pro-v1:0` |
| AWS Bedrock | `aws/apac.anthropic.claude-sonnet-4-20250514-v1:0` |
| AWS Bedrock | `aws/au.anthropic.claude-haiku-4-5-20251001-v1:0` |
| AWS Bedrock | `aws/au.anthropic.claude-sonnet-4-5-20250929-v1:0` |
| AWS Bedrock | `aws/deepseek.v3.2` |
| AWS Bedrock | `aws/deepseek.v3.2-v1:0` |
| AWS Bedrock | `aws/eu.amazon.nova-2-lite-v1:0` |
| AWS Bedrock | `aws/eu.amazon.nova-lite-v1:0` |
| AWS Bedrock | `aws/eu.amazon.nova-micro-v1:0` |
| AWS Bedrock | `aws/eu.amazon.nova-pro-v1:0` |
| AWS Bedrock | `aws/eu.anthropic.claude-fable-5` |
| AWS Bedrock | `aws/eu.anthropic.claude-haiku-4-5-20251001-v1:0` |
| AWS Bedrock | `aws/eu.anthropic.claude-opus-4-5-20251101-v1:0` |
| AWS Bedrock | `aws/eu.anthropic.claude-opus-4-6-v1` |
| AWS Bedrock | `aws/eu.anthropic.claude-opus-4-7` |
| AWS Bedrock | `aws/eu.anthropic.claude-opus-4-8` |
| AWS Bedrock | `aws/eu.anthropic.claude-opus-5` |
| AWS Bedrock | `aws/eu.anthropic.claude-sonnet-4-20250514-v1:0` |
| AWS Bedrock | `aws/eu.anthropic.claude-sonnet-4-5-20250929-v1:0` |
| AWS Bedrock | `aws/eu.anthropic.claude-sonnet-4-6` |
| AWS Bedrock | `aws/eu.anthropic.claude-sonnet-5` |
| AWS Bedrock | `aws/global.amazon.nova-2-lite-v1:0` |
| AWS Bedrock | `aws/global.anthropic.claude-fable-5` |
| AWS Bedrock | `aws/global.anthropic.claude-fable-5-1` |
| AWS Bedrock | `aws/global.anthropic.claude-haiku-4-5-20251001-v1:0` |
| AWS Bedrock | `aws/global.anthropic.claude-opus-4-5-20251101-v1:0` |
| AWS Bedrock | `aws/global.anthropic.claude-opus-4-6-v1` |
| AWS Bedrock | `aws/global.anthropic.claude-opus-4-7` |
| AWS Bedrock | `aws/global.anthropic.claude-opus-4-8` |
| AWS Bedrock | `aws/global.anthropic.claude-opus-5` |
| AWS Bedrock | `aws/global.anthropic.claude-sonnet-4-20250514-v1:0` |
| AWS Bedrock | `aws/global.anthropic.claude-sonnet-4-5-20250929-v1:0` |
| AWS Bedrock | `aws/global.anthropic.claude-sonnet-4-6` |
| AWS Bedrock | `aws/global.anthropic.claude-sonnet-5` |
| AWS Bedrock | `aws/google.gemma-3-27b-it` |
| AWS Bedrock | `aws/jp.amazon.nova-2-lite-v1:0` |
| AWS Bedrock | `aws/jp.anthropic.claude-haiku-4-5-20251001-v1:0` |
| AWS Bedrock | `aws/jp.anthropic.claude-sonnet-4-5-20250929-v1:0` |
| AWS Bedrock | `aws/jp.anthropic.claude-sonnet-4-6` |
| AWS Bedrock | `aws/meta.llama3-1-405b-instruct-v1:0` |
| AWS Bedrock | `aws/minimax.minimax-m2.1` |
| AWS Bedrock | `aws/minimax.minimax-m2.5` |
| AWS Bedrock | `aws/mistral.devstral-2-123b` |
| AWS Bedrock | `aws/mistral.magistral-small-2509` |
| AWS Bedrock | `aws/mistral.ministral-3-3b-instruct` |
| AWS Bedrock | `aws/mistral.mistral-large-3-675b-instruct` |
| AWS Bedrock | `aws/mistral.pixtral-large-2502-v1:0` |
| AWS Bedrock | `aws/moonshotai.kimi-k2.5` |
| AWS Bedrock | `aws/nvidia.nemotron-nano-3-30b` |
| AWS Bedrock | `aws/nvidia.nemotron-super-3-120b` |
| AWS Bedrock | `aws/openai.gpt-oss-120b-1:0` |
| AWS Bedrock | `aws/qwen.qwen3-32b-v1:0` |
| AWS Bedrock | `aws/qwen.qwen3-coder-next` |
| AWS Bedrock | `aws/us.amazon.nova-2-lite-v1:0` |
| AWS Bedrock | `aws/us.amazon.nova-lite-v1:0` |
| AWS Bedrock | `aws/us.amazon.nova-micro-v1:0` |
| AWS Bedrock | `aws/us.amazon.nova-pro-v1:0` |
| AWS Bedrock | `aws/us.anthropic.claude-fable-5` |
| AWS Bedrock | `aws/us.anthropic.claude-fable-5-1` |
| AWS Bedrock | `aws/us.anthropic.claude-haiku-4-5-20251001-v1:0` |
| AWS Bedrock | `aws/us.anthropic.claude-opus-4-1-20250805-v1:0` |
| AWS Bedrock | `aws/us.anthropic.claude-opus-4-5-20251101-v1:0` |
| AWS Bedrock | `aws/us.anthropic.claude-opus-4-8` |
| AWS Bedrock | `aws/us.anthropic.claude-opus-5` |
| AWS Bedrock | `aws/us.anthropic.claude-sonnet-4-20250514-v1:0` |
| AWS Bedrock | `aws/us.anthropic.claude-sonnet-4-5-20250929-v1:0` |
| AWS Bedrock | `aws/us.anthropic.claude-sonnet-4-6` |
| AWS Bedrock | `aws/us.anthropic.claude-sonnet-5` |
| AWS Bedrock | `aws/us.writer.palmyra-x5-v1:0` |
| AWS Bedrock | `aws/writer.palmyra-x5-v1:0` |
| AWS Bedrock | `aws/zai.glm-4.7` |
| AWS Bedrock | `aws/zai.glm-5` |
| Azure | `azure/eu.gpt-5.6-luna` |
| Azure | `azure/eu.gpt-5.6-terra` |
| Azure | `azure/global.gpt-5.6-luna` |
| Azure | `azure/global.gpt-5.6-terra` |
| Azure | `azure/gpt-4.1` |
| Azure | `azure/gpt-4.1-mini` |
| Azure | `azure/gpt-4.1-nano` |
| Azure | `azure/gpt-4o` |
| Azure | `azure/gpt-5` |
| Azure | `azure/gpt-5-mini` |
| Azure | `azure/gpt-5-nano` |
| Azure | `azure/gpt-5.4` |
| Azure | `azure/gpt-5.6-sol` |
| Azure | `azure/gpt-5.6-sol-global` |
| baseten | `baseten/deepseek-v4-flash-0731` |
| baseten | `baseten/deepseek-v4-pro-0813` |
| baseten | `baseten/deepseek-v4.1-flash` |
| baseten | `baseten/glm-5.2` |
| baseten | `baseten/glm-5.2-fast` |
| baseten | `baseten/glm-5.3` |
| baseten | `baseten/glm-5.3-fast` |
| baseten | `baseten/glm-5.3-flash` |
| baseten | `baseten/gpt-oss-120b` |
| baseten | `baseten/kimi-k3` |
| baseten | `baseten/nemotron-ultra` |
| Cerebras | `cerebras/gpt-oss-120b` |
| Cerebras | `cerebras/qwen-3.8-27b` |
| Cohere | `cohere/c4ai-aya-expanse-32b` |
| Cohere | `cohere/c4ai-aya-vision-32b` |
| Cohere | `cohere/command-a-03-2025` |
| Cohere | `cohere/command-a-plus-05-2026` |
| Cohere | `cohere/command-a-reasoning-08-2025` |
| Cohere | `cohere/command-a-translate-08-2025` |
| Cohere | `cohere/command-a-vision-07-2025` |
| Cohere | `cohere/command-r-08-2024` |
| Cohere | `cohere/command-r-plus-08-2024` |
| Cohere | `cohere/command-r7b-12-2024` |
| Cohere | `cohere/command-r7b-arabic-02-2025` |
| Deepseek | `deepseek/deepseek-flash` |
| fireworks | `fireworks/deepseek-v4-pro` |
| fireworks | `fireworks/glm-5.2` |
| fireworks | `fireworks/kimi-k2.7-code` |
| fireworks | `fireworks/kimi-k3` |
| fireworks | `fireworks/kimi-k3-fast` |
| fireworks | `fireworks/minimax-m3` |
| fireworks | `fireworks/qwen3.7-plus` |
| Vertex AI | `google/claude-haiku-4-5` |
| Vertex AI | `google/claude-opus-4-5@20251101` |
| Vertex AI | `google/claude-opus-4-6` |
| Vertex AI | `google/claude-opus-4-7` |
| Vertex AI | `google/claude-opus-4-8` |
| Vertex AI | `google/claude-sonnet-4-5@20250929` |
| Vertex AI | `google/claude-sonnet-4-6` |
| Vertex AI | `google/claude-sonnet-4@20250514` |
| Vertex AI | `google/eu.claude-fable-5` |
| Vertex AI | `google/eu.claude-fable-5-1` |
| Vertex AI | `google/eu.claude-opus-4-7` |
| Vertex AI | `google/eu.claude-opus-4-8` |
| Vertex AI | `google/eu.claude-opus-5` |
| Vertex AI | `google/eu.claude-sonnet-5` |
| Vertex AI | `google/eu.gemini-3.1-flash-lite` |
| Vertex AI | `google/eu.gemini-3.5-flash` |
| Vertex AI | `google/eu.gemini-3.5-flash-lite` |
| Vertex AI | `google/eu.gemini-3.6-flash` |
| Vertex AI | `google/eu.gemini-3.7-flash` |
| Vertex AI | `google/eu.gemini-3.8-flash` |
| Vertex AI | `google/gemini-2.5-flash` |
| Vertex AI | `google/gemini-2.5-flash-lite` |
| Vertex AI | `google/gemini-2.5-pro` |
| Vertex AI | `google/gemini-3-flash-preview` |
| Vertex AI | `google/gemini-3.1-flash-lite` |
| Vertex AI | `google/gemini-3.1-pro-preview` |
| Vertex AI | `google/gemini-3.5-flash` |
| Vertex AI | `google/gemini-3.5-flash-lite` |
| Vertex AI | `google/gemini-3.6-flash` |
| Vertex AI | `google/gemini-3.7-flash` |
| Vertex AI | `google/gemini-3.8-flash` |
| Vertex AI | `google/global.claude-fable-5` |
| Vertex AI | `google/global.claude-fable-5-1` |
| Vertex AI | `google/global.claude-opus-4-7` |
| Vertex AI | `google/global.claude-opus-4-8` |
| Vertex AI | `google/global.claude-opus-5` |
| Vertex AI | `google/global.claude-sonnet-5` |
| Vertex AI | `google/us.claude-fable-5` |
| Vertex AI | `google/us.claude-fable-5-1` |
| Vertex AI | `google/us.claude-opus-4-7` |
| Vertex AI | `google/us.claude-opus-4-8` |
| Vertex AI | `google/us.claude-opus-5` |
| Vertex AI | `google/us.claude-sonnet-5` |
| Vertex AI | `google/us.gemini-3.1-flash-lite` |
| Vertex AI | `google/us.gemini-3.5-flash` |
| Vertex AI | `google/us.gemini-3.5-flash-lite` |
| Vertex AI | `google/us.gemini-3.6-flash` |
| Vertex AI | `google/us.gemini-3.7-flash` |
| Vertex AI | `google/us.gemini-3.8-flash` |
| Google AI | `google-ai/gemini-2.5-flash` |
| Google AI | `google-ai/gemini-2.5-flash-lite` |
| Google AI | `google-ai/gemini-2.5-pro` |
| Google AI | `google-ai/gemini-3-flash-preview` |
| Google AI | `google-ai/gemini-3.1-pro-preview` |
| Google AI | `google-ai/gemini-3.1-pro-preview-customtools` |
| Google AI | `google-ai/gemini-3.5-flash` |
| Google AI | `google-ai/gemini-3.5-flash-lite` |
| Google AI | `google-ai/gemini-3.6-flash` |
| Google AI | `google-ai/gemini-3.7-flash` |
| Google AI | `google-ai/gemini-3.8-flash` |
| Google AI | `google-ai/gemini-omni-flash-preview` |
| Google AI | `google-ai/gemma-4-26b-a4b-it` |
| Google AI | `google-ai/gemma-4-31b-it` |
| greenpt | `greenpt/deepseek-v4-flash-0731` |
| greenpt | `greenpt/gemma4` |
| greenpt | `greenpt/glm-5.2` |
| greenpt | `greenpt/glm-5.2-caveman` |
| greenpt | `greenpt/glm-5.2-caveman-lite` |
| greenpt | `greenpt/glm-5.2-caveman-ultra` |
| greenpt | `greenpt/glm-5.2-honey` |
| greenpt | `greenpt/glm-5.2-honey-lite` |
| greenpt | `greenpt/glm-5.2-honey-ultra` |
| greenpt | `greenpt/glm-5.2-ponytail` |
| greenpt | `greenpt/glm-5.2-ponytail-lite` |
| greenpt | `greenpt/glm-5.2-ponytail-ultra` |
| greenpt | `greenpt/gpt-oss-120b` |
| greenpt | `greenpt/green-l` |
| greenpt | `greenpt/green-l-raw` |
| greenpt | `greenpt/green-r` |
| greenpt | `greenpt/green-r-raw` |
| greenpt | `greenpt/kimi-k2.6` |
| greenpt | `greenpt/kimi-k2.7-code` |
| greenpt | `greenpt/kimi-k3` |
| greenpt | `greenpt/llama-3.3-70b-instruct` |
| greenpt | `greenpt/minimax-m2.5` |
| greenpt | `greenpt/mistral-medium-3.5-128b` |
| greenpt | `greenpt/mistral-small-3.2-24b-instruct-2506` |
| greenpt | `greenpt/qwen3-235b-a22b-instruct-2507` |
| greenpt | `greenpt/qwen3.5-397b-a17b` |
| greenpt | `greenpt/qwen3.6-35b-a3b` |
| Groq | `groq/allam-2-7b` |
| Groq | `groq/groq/compound` |
| Groq | `groq/groq/compound-mini` |
| Groq | `groq/meta-llama/llama-prompt-guard-2-22m` |
| Groq | `groq/meta-llama/llama-prompt-guard-2-86m` |
| Groq | `groq/openai/gpt-oss-120b` |
| Groq | `groq/openai/gpt-oss-20b` |
| Groq | `groq/openai/gpt-oss-safeguard-20b` |
| Groq | `groq/qwen/qwen3.6-27b` |
| Groq | `groq/qwen/qwen3.8-27b` |
| hcompany | `hcompany/holo3-1-35b-a3b` |
| hcompany | `hcompany/holo3-122b-a10b` |
| inceptron | `inceptron/deepseek-ai/DeepSeek-V4-Flash-0731` |
| inceptron | `inceptron/MiniMaxAI/MiniMax-M2.5` |
| inceptron | `inceptron/moonshotai/Kimi-K2.6` |
| inceptron | `inceptron/moonshotai/Kimi-K2.7-Code` |
| inceptron | `inceptron/zai-org/GLM-5.2` |
| inceptron | `inceptron/zai-org/GLM-5.3` |
| meta | `meta/muse-spark-1.1` |
| meta | `meta/muse-spark-1.2` |
| meta | `meta/muse-spark-1.2-contributor` |
| meta | `meta/muse-spark-1.3` |
| meta | `meta/muse-spark-1.3-contributor` |
| Minimax | `minimax/M2-her` |
| Minimax | `minimax/MiniMax-M2` |
| Minimax | `minimax/MiniMax-M2.1` |
| Minimax | `minimax/MiniMax-M2.1-highspeed` |
| Minimax | `minimax/MiniMax-M2.5` |
| Minimax | `minimax/MiniMax-M2.5-highspeed` |
| Minimax | `minimax/minimax-m2.5-lightning` |
| Minimax | `minimax/MiniMax-M2.7` |
| Minimax | `minimax/MiniMax-M2.7-highspeed` |
| Minimax | `minimax/MiniMax-M3` |
| Mistral | `mistral/codestral-2508` |
| Mistral | `mistral/codestral-latest` |
| Mistral | `mistral/labs-leanstral-1-5` |
| Mistral | `mistral/labs-leanstral-1-5-1` |
| Mistral | `mistral/ministral-14b-2512` |
| Mistral | `mistral/ministral-14b-latest` |
| Mistral | `mistral/ministral-3b-2512` |
| Mistral | `mistral/ministral-3b-latest` |
| Mistral | `mistral/ministral-8b-2512` |
| Mistral | `mistral/ministral-8b-latest` |
| Mistral | `mistral/mistral-large-2512` |
| Mistral | `mistral/mistral-large-latest` |
| Mistral | `mistral/mistral-medium-2604` |
| Mistral | `mistral/mistral-medium-3` |
| Mistral | `mistral/mistral-medium-3-5` |
| Mistral | `mistral/mistral-medium-3.5` |
| Mistral | `mistral/mistral-medium-latest` |
| Mistral | `mistral/mistral-small-2603` |
| Mistral | `mistral/mistral-small-latest` |
| Mistral | `mistral/mistral-tiny-2407` |
| Mistral | `mistral/mistral-tiny-latest` |
| Mistral | `mistral/voxtral-small-2507` |
| Mistral | `mistral/voxtral-small-latest` |
| Mistral | `mistral/zai-glm-5-2` |
| Moonshot AI | `moonshotai/kimi-k2.6` |
| Moonshot AI | `moonshotai/kimi-k2.7-code` |
| Moonshot AI | `moonshotai/kimi-k2.7-code-highspeed` |
| Moonshot AI | `moonshotai/kimi-k3` |
| nebius | `nebius/deepseek-ai/DeepSeek-V4-Flash-0731` |
| nebius | `nebius/deepseek-ai/DeepSeek-V4-Pro` |
| nebius | `nebius/deepseek-ai/DeepSeek-V4-Pro-0813` |
| nebius | `nebius/google/gemma-3-27b-it` |
| nebius | `nebius/MiniMaxAI/MiniMax-M3` |
| nebius | `nebius/moonshotai/Kimi-K2.6` |
| nebius | `nebius/moonshotai/Kimi-K2.7-Code` |
| nebius | `nebius/moonshotai/Kimi-K3` |
| nebius | `nebius/NousResearch/Hermes-4-405B` |
| nebius | `nebius/nvidia/Nemotron-3_5-Lightning` |
| nebius | `nebius/nvidia/nemotron-3-super-120b-a12b` |
| nebius | `nebius/nvidia/Nemotron-3-Ultra-550b-a55b` |
| nebius | `nebius/nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B` |
| nebius | `nebius/openai/gpt-oss-120b` |
| nebius | `nebius/openbmb/MiniCPM-V-4_5` |
| nebius | `nebius/Qwen/Qwen3-235B-A22B-Instruct-2507` |
| nebius | `nebius/Qwen/Qwen3-30B-A3B-Instruct-2507` |
| nebius | `nebius/Qwen/Qwen3.5-397B-A17B` |
| nebius | `nebius/zai-org/GLM-5.1` |
| nebius | `nebius/zai-org/GLM-5.2` |
| nebius | `nebius/zai-org/GLM-5.3` |
| nebius | `nebius/zai-org/GLM-5.3-Flash` |
| Nvidia | `nvidia/meta/muse-glimmer-30b` |
| Nvidia | `nvidia/moonshotai/kimi-k3` |
| Nvidia | `nvidia/nvidia/nemotron-3-super-120b-a12b` |
| Nvidia | `nvidia/nvidia/nemotron-3-ultra-550b-a55b` |
| Nvidia | `nvidia/nvidia/nemotron-3.5-content-safety` |
| Nvidia | `nvidia/nvidia/nemotron-3.5-lightning-30b-a3b` |
| Nvidia | `nvidia/poolside/laguna-xs-2.1` |
| OpenAI | `openai/eu.gpt-4.1` |
| OpenAI | `openai/eu.gpt-4.1-2025-04-14` |
| OpenAI | `openai/eu.gpt-4.1-mini` |
| OpenAI | `openai/eu.gpt-4.1-mini-2025-04-14` |
| OpenAI | `openai/eu.gpt-4o` |
| OpenAI | `openai/eu.gpt-4o-2024-08-06` |
| OpenAI | `openai/eu.gpt-4o-2024-11-20` |
| OpenAI | `openai/eu.gpt-4o-mini` |
| OpenAI | `openai/eu.gpt-4o-mini-2024-07-18` |
| OpenAI | `openai/eu.gpt-5` |
| OpenAI | `openai/eu.gpt-5-mini` |
| OpenAI | `openai/eu.gpt-5-nano` |
| OpenAI | `openai/eu.gpt-5.1` |
| OpenAI | `openai/eu.gpt-5.1-2025-11-13` |
| OpenAI | `openai/eu.gpt-5.2` |
| OpenAI | `openai/eu.gpt-5.2-2025-12-11` |
| OpenAI | `openai/eu.gpt-5.4` |
| OpenAI | `openai/eu.gpt-5.4-2026-03-05` |
| OpenAI | `openai/eu.gpt-5.4-mini` |
| OpenAI | `openai/eu.gpt-5.4-mini-2026-03-17` |
| OpenAI | `openai/eu.gpt-5.4-nano` |
| OpenAI | `openai/eu.gpt-5.4-nano-2026-03-17` |
| OpenAI | `openai/eu.gpt-5.5` |
| OpenAI | `openai/eu.gpt-5.5-2026-04-23` |
| OpenAI | `openai/eu.gpt-5.6-luna` |
| OpenAI | `openai/eu.gpt-5.6-sol` |
| OpenAI | `openai/eu.gpt-5.6-terra` |
| OpenAI | `openai/eu.gpt-6-astra` |
| OpenAI | `openai/eu.o1-2024-12-17` |
| OpenAI | `openai/eu.o3` |
| OpenAI | `openai/eu.o3-mini-2025-01-31` |
| OpenAI | `openai/eu.o4-mini-2025-04-16` |
| OpenAI | `openai/gpt-3.5-turbo-16k` |
| OpenAI | `openai/gpt-4.1` |
| OpenAI | `openai/gpt-4.1-2025-04-14` |
| OpenAI | `openai/gpt-4.1-mini` |
| OpenAI | `openai/gpt-4.1-mini-2025-04-14` |
| OpenAI | `openai/gpt-4o` |
| OpenAI | `openai/gpt-4o-2024-08-06` |
| OpenAI | `openai/gpt-4o-2024-11-20` |
| OpenAI | `openai/gpt-4o-mini` |
| OpenAI | `openai/gpt-4o-mini-2024-07-18` |
| OpenAI | `openai/gpt-5` |
| OpenAI | `openai/gpt-5-mini` |
| OpenAI | `openai/gpt-5-nano` |
| OpenAI | `openai/gpt-5.1` |
| OpenAI | `openai/gpt-5.1-2025-11-13` |
| OpenAI | `openai/gpt-5.2` |
| OpenAI | `openai/gpt-5.2-2025-12-11` |
| OpenAI | `openai/gpt-5.3-codex` |
| OpenAI | `openai/gpt-5.4` |
| OpenAI | `openai/gpt-5.4-2026-03-05` |
| OpenAI | `openai/gpt-5.4-mini` |
| OpenAI | `openai/gpt-5.4-mini-2026-03-17` |
| OpenAI | `openai/gpt-5.4-nano` |
| OpenAI | `openai/gpt-5.4-nano-2026-03-17` |
| OpenAI | `openai/gpt-5.5` |
| OpenAI | `openai/gpt-5.5-2026-04-23` |
| OpenAI | `openai/gpt-5.6-luna` |
| OpenAI | `openai/gpt-5.6-sol` |
| OpenAI | `openai/gpt-5.6-terra` |
| OpenAI | `openai/gpt-6-astra` |
| OpenAI | `openai/o1-2024-12-17` |
| OpenAI | `openai/o3` |
| OpenAI | `openai/o3-mini-2025-01-31` |
| OpenAI | `openai/o4-mini-2025-04-16` |
| Perplexity | `perplexity/sonar` |
| Perplexity | `perplexity/sonar-deep-research` |
| Perplexity | `perplexity/sonar-pro` |
| Perplexity | `perplexity/sonar-reasoning-pro` |
| poolside | `poolside/poolside/laguna-m.1` |
| poolside | `poolside/poolside/laguna-s-2.1` |
| poolside | `poolside/poolside/laguna-xs-2.1` |
| scaleway | `scaleway/deepseek-v4-flash-0731` |
| scaleway | `scaleway/gemma-4-26b-a4b-it` |
| scaleway | `scaleway/glm-5.2` |
| scaleway | `scaleway/gpt-oss-120b` |
| scaleway | `scaleway/llama-3.3-70b-instruct` |
| scaleway | `scaleway/mistral-medium-3.5-128b` |
| scaleway | `scaleway/mistral-small-3.2-24b-instruct-2506` |
| scaleway | `scaleway/qwen3-235b-a22b-instruct-2507` |
| scaleway | `scaleway/qwen3.5-397b-a17b` |
| scaleway | `scaleway/qwen3.6-35b-a3b` |
| tencent | `tencent/deepseek-v4-flash` |
| tencent | `tencent/deepseek-v4-flash-202605` |
| tencent | `tencent/deepseek-v4-pro` |
| tencent | `tencent/deepseek-v4-pro-202606` |
| tencent | `tencent/glm-5` |
| tencent | `tencent/glm-5-turbo` |
| tencent | `tencent/glm-5.1` |
| tencent | `tencent/glm-5.2` |
| tencent | `tencent/glm-5v-turbo` |
| tencent | `tencent/hy-mt2-plus` |
| tencent | `tencent/kimi-k2.5` |
| tencent | `tencent/kimi-k2.6` |
| tencent | `tencent/kimi-k2.7-code` |
| tencent | `tencent/kimi-k2.7-code-highspeed` |
| tencent | `tencent/minimax-m2.5` |
| tencent | `tencent/minimax-m2.7` |
| tencent | `tencent/minimax-m3` |
| tensorix | `tensorix/deepseek/deepseek-chat-v3.1` |
| tensorix | `tensorix/deepseek/deepseek-r1-0528` |
| tensorix | `tensorix/deepseek/deepseek-v3.2` |
| tensorix | `tensorix/deepseek/deepseek-v4-flash-0731` |
| tensorix | `tensorix/deepseek/deepseek-v4-pro` |
| tensorix | `tensorix/meta-llama/llama-3.3-70b-instruct` |
| tensorix | `tensorix/meta-llama/llama-4-maverick` |
| tensorix | `tensorix/minimax/minimax-m2` |
| tensorix | `tensorix/minimax/minimax-m2.5` |
| tensorix | `tensorix/minimax/minimax-m3` |
| tensorix | `tensorix/moonshotai/kimi-k2.5` |
| tensorix | `tensorix/moonshotai/kimi-k2.6` |
| tensorix | `tensorix/moonshotai/kimi-k2.7-code` |
| tensorix | `tensorix/moonshotai/kimi-k3` |
| tensorix | `tensorix/nvidia/nemotron-3-super-120b-a12b` |
| tensorix | `tensorix/openai/gpt-oss-120b` |
| tensorix | `tensorix/openai/gpt-oss-20b` |
| tensorix | `tensorix/qwen/qwen3-235b-a22b-2507` |
| tensorix | `tensorix/qwen/qwen3-coder-30b-a3b-instruct` |
| tensorix | `tensorix/qwen/qwen3-vl-235b-a22b-instruct` |
| tensorix | `tensorix/qwen/qwen3.5-122b-a10b` |
| tensorix | `tensorix/qwen/qwen3.5-9b` |
| tensorix | `tensorix/qwen/qwen3.8-2.4t-a95b` |
| tensorix | `tensorix/qwen/qwen3.8-flash-next` |
| tensorix | `tensorix/xiaomi/mimo-v2.5` |
| tensorix | `tensorix/z-ai/glm-4.6` |
| tensorix | `tensorix/z-ai/glm-4.7` |
| tensorix | `tensorix/z-ai/glm-5` |
| tensorix | `tensorix/z-ai/glm-5-turbo` |
| tensorix | `tensorix/z-ai/glm-5.1` |
| tensorix | `tensorix/z-ai/glm-5.2` |
| tensorix | `tensorix/z-ai/glm-5.3-flash` |
| tensorix | `tensorix/z-ai/glm-5v-turbo` |
| Together AI | `togetherai/meta-llama/Llama-3.3-70B-Instruct-Turbo` |
| Together AI | `togetherai/meta-llama/Llama-Guard-4-12B` |
| Together AI | `togetherai/moonshotai/Kimi-K2.6` |
| Together AI | `togetherai/moonshotai/Kimi-K2.7-Code` |
| Together AI | `togetherai/zai-org/GLM-5.2` |
| Wafer | `wafer/DeepSeek-V4-Flash-0423` |
| Wafer | `wafer/DeepSeek-V4-Flash-0731-Fast` |
| Wafer | `wafer/DeepSeek-V4.1-Flash` |
| Wafer | `wafer/GLM-5.1` |
| Wafer | `wafer/GLM-5.2` |
| Wafer | `wafer/GLM-5.3` |
| Wafer | `wafer/GLM-5.3-Flash` |
| Wafer | `wafer/glm5.2-fast` |
| Wafer | `wafer/Kimi-K2.6` |
| Wafer | `wafer/Kimi-K3` |
| Wafer | `wafer/kimi-k3-fast` |
| Wafer | `wafer/MiniMax-M3` |
| Wafer | `wafer/Qwen3.5-397B-A17B` |
| xai | `xai/grok-3-fast` |
| xai | `xai/grok-3-fast-latest` |
| xai | `xai/grok-3-latest` |
| xai | `xai/grok-3-mini` |
| xai | `xai/grok-3-mini-fast` |
| xai | `xai/grok-3-mini-fast-latest` |
| xai | `xai/grok-3-mini-latest` |
| xai | `xai/grok-4` |
| xai | `xai/grok-4-1-fast` |
| xai | `xai/grok-4-fast` |
| xai | `xai/grok-4.20-0309-non-reasoning` |
| xai | `xai/grok-4.20-0309-reasoning` |
| xai | `xai/grok-4.20-beta-latest-non-reasoning` |
| xai | `xai/grok-4.20-beta-latest-reasoning` |
| xai | `xai/grok-4.20-multi-agent-0309` |
| xai | `xai/grok-4.20-multi-agent-beta-latest` |
| xai | `xai/grok-4.3` |
| xai | `xai/grok-4.5` |
| xai | `xai/grok-4.6` |
| xai | `xai/grok-build-0.1` |
| Z AI | `zai/glm-4.5` |
| Z AI | `zai/glm-4.5-air` |
| Z AI | `zai/glm-4.5-flash` |
| Z AI | `zai/glm-4.5v` |
| Z AI | `zai/glm-4.6` |
| Z AI | `zai/glm-4.6v` |
| Z AI | `zai/glm-4.7` |
| Z AI | `zai/glm-4.7-flash` |
| Z AI | `zai/glm-4.7-flashx` |
| Z AI | `zai/glm-5` |
| Z AI | `zai/glm-5-turbo` |
| Z AI | `zai/glm-5.1` |
| Z AI | `zai/glm-5.2` |
| Z AI | `zai/glm-5.3` |
| Z AI | `zai/glm-5.3-flash` |
| Z AI | `zai/glm-5v-turbo` |

### Chat models

<CodeGroup>
  ```bash cURL theme={"theme":{"light":"github-light","dark":"github-dark"}}
  curl https://my.orq.ai/v3/router/chat/completions \
    -H "Content-Type: application/json" \
    -H "Authorization: Bearer $ORQ_API_KEY" \
    -d '{
      "model": "openai/gpt-5.6-sol",
      "messages": [
        {
          "role": "system",
          "content": "You are a helpful assistant."
        },
        {
          "role": "user",
          "content": "Hello!"
        }
      ]
    }'
  ```

  ```python Python theme={"theme":{"light":"github-light","dark":"github-dark"}}
  from openai import OpenAI
  import os

  client = OpenAI(
    base_url="https://my.orq.ai/v3/router",
    api_key=os.getenv("ORQ_API_KEY"),
  )

  completion = client.chat.completions.create(
    model="openai/gpt-5.6-sol",
    messages=[
      {"role": "system", "content": "You are a helpful assistant."},
      {"role": "user", "content": "Hello!"}
    ]
  )

  print(completion.choices[0].message)
  ```

  ```typescript TypeScript theme={"theme":{"light":"github-light","dark":"github-dark"}}
  import OpenAI from "openai";

  const client = new OpenAI({
    baseURL: 'https://my.orq.ai/v3/router',
    apiKey: process.env.ORQ_API_KEY,
  });

  async function main() {
    const completion = await client.chat.completions.create({
      messages: [{ role: "system", content: "You are a helpful assistant." }],
      model: "openai/gpt-5.6-sol"
    });

    console.log(completion.choices[0]);
  }

  main();
  ```
</CodeGroup>

| Provider | Model |
| - | - |
| Alibaba | `alibaba/deepseek-v4-flash` |
| Alibaba | `alibaba/deepseek-v4-pro` |
| Alibaba | `alibaba/kimi-k2.5` |
| Alibaba | `alibaba/kimi-k2.6` |
| Alibaba | `alibaba/qwen-mt-flash` |
| Alibaba | `alibaba/qwen-mt-lite` |
| Alibaba | `alibaba/qwen-plus` |
| Alibaba | `alibaba/qwen-plus-2025-12-01` |
| Alibaba | `alibaba/qwen3-max` |
| Alibaba | `alibaba/qwen3-vl-flash` |
| Alibaba | `alibaba/qwen3-vl-flash-2025-10-15` |
| Alibaba | `alibaba/qwen3-vl-plus` |
| Alibaba | `alibaba/qwen3.5-122b-a10b` |
| Alibaba | `alibaba/qwen3.5-27b` |
| Alibaba | `alibaba/qwen3.5-35b-a3b` |
| Alibaba | `alibaba/qwen3.5-flash` |
| Alibaba | `alibaba/qwen3.5-flash-2026-02-23` |
| Alibaba | `alibaba/qwen3.6-35b-a3b` |
| Alibaba | `alibaba/qwen3.6-flash` |
| Alibaba | `alibaba/qwen3.6-flash-2026-04-16` |
| Alibaba | `alibaba/qwen3.6-plus` |
| Alibaba | `alibaba/qwen3.6-plus-2026-04-02` |
| Alibaba | `alibaba/qwen3.7-max` |
| Alibaba | `alibaba/qwen3.7-max-2026-05-20` |
| Alibaba | `alibaba/qwen3.7-max-2026-06-08` |
| Alibaba | `alibaba/qwen3.7-plus` |
| Alibaba | `alibaba/qwen3.7-plus-2026-05-26` |
| Alibaba | `alibaba/qwen3.8-max` |
| Anthropic | `anthropic/claude-fable-5` |
| Anthropic | `anthropic/claude-fable-5-1` |
| Anthropic | `anthropic/claude-haiku-4-5` |
| Anthropic | `anthropic/claude-haiku-4-5-20251001` |
| Anthropic | `anthropic/claude-opus-4-5` |
| Anthropic | `anthropic/claude-opus-4-5-20251101` |
| Anthropic | `anthropic/claude-opus-4-6` |
| Anthropic | `anthropic/claude-opus-4-7` |
| Anthropic | `anthropic/claude-opus-4-8` |
| Anthropic | `anthropic/claude-opus-5` |
| Anthropic | `anthropic/claude-sonnet-4-5` |
| Anthropic | `anthropic/claude-sonnet-4-5-20250929` |
| Anthropic | `anthropic/claude-sonnet-4-6` |
| Anthropic | `anthropic/claude-sonnet-5` |
| AWS Bedrock | `aws/ai21.jamba-1-5-mini-v1:0` |
| AWS Bedrock | `aws/apac.amazon.nova-lite-v1:0` |
| AWS Bedrock | `aws/apac.amazon.nova-micro-v1:0` |
| AWS Bedrock | `aws/apac.amazon.nova-pro-v1:0` |
| AWS Bedrock | `aws/apac.anthropic.claude-sonnet-4-20250514-v1:0` |
| AWS Bedrock | `aws/au.anthropic.claude-haiku-4-5-20251001-v1:0` |
| AWS Bedrock | `aws/au.anthropic.claude-sonnet-4-5-20250929-v1:0` |
| AWS Bedrock | `aws/deepseek.v3.2` |
| AWS Bedrock | `aws/deepseek.v3.2-v1:0` |
| AWS Bedrock | `aws/eu.amazon.nova-2-lite-v1:0` |
| AWS Bedrock | `aws/eu.amazon.nova-lite-v1:0` |
| AWS Bedrock | `aws/eu.amazon.nova-micro-v1:0` |
| AWS Bedrock | `aws/eu.amazon.nova-pro-v1:0` |
| AWS Bedrock | `aws/eu.anthropic.claude-fable-5` |
| AWS Bedrock | `aws/eu.anthropic.claude-haiku-4-5-20251001-v1:0` |
| AWS Bedrock | `aws/eu.anthropic.claude-opus-4-5-20251101-v1:0` |
| AWS Bedrock | `aws/eu.anthropic.claude-opus-4-6-v1` |
| AWS Bedrock | `aws/eu.anthropic.claude-opus-4-7` |
| AWS Bedrock | `aws/eu.anthropic.claude-opus-4-8` |
| AWS Bedrock | `aws/eu.anthropic.claude-opus-5` |
| AWS Bedrock | `aws/eu.anthropic.claude-sonnet-4-20250514-v1:0` |
| AWS Bedrock | `aws/eu.anthropic.claude-sonnet-4-5-20250929-v1:0` |
| AWS Bedrock | `aws/eu.anthropic.claude-sonnet-4-6` |
| AWS Bedrock | `aws/eu.anthropic.claude-sonnet-5` |
| AWS Bedrock | `aws/global.amazon.nova-2-lite-v1:0` |
| AWS Bedrock | `aws/global.anthropic.claude-fable-5` |
| AWS Bedrock | `aws/global.anthropic.claude-fable-5-1` |
| AWS Bedrock | `aws/global.anthropic.claude-haiku-4-5-20251001-v1:0` |
| AWS Bedrock | `aws/global.anthropic.claude-opus-4-5-20251101-v1:0` |
| AWS Bedrock | `aws/global.anthropic.claude-opus-4-6-v1` |
| AWS Bedrock | `aws/global.anthropic.claude-opus-4-7` |
| AWS Bedrock | `aws/global.anthropic.claude-opus-4-8` |
| AWS Bedrock | `aws/global.anthropic.claude-opus-5` |
| AWS Bedrock | `aws/global.anthropic.claude-sonnet-4-20250514-v1:0` |
| AWS Bedrock | `aws/global.anthropic.claude-sonnet-4-5-20250929-v1:0` |
| AWS Bedrock | `aws/global.anthropic.claude-sonnet-4-6` |
| AWS Bedrock | `aws/global.anthropic.claude-sonnet-5` |
| AWS Bedrock | `aws/google.gemma-3-27b-it` |
| AWS Bedrock | `aws/jp.amazon.nova-2-lite-v1:0` |
| AWS Bedrock | `aws/jp.anthropic.claude-haiku-4-5-20251001-v1:0` |
| AWS Bedrock | `aws/jp.anthropic.claude-sonnet-4-5-20250929-v1:0` |
| AWS Bedrock | `aws/jp.anthropic.claude-sonnet-4-6` |
| AWS Bedrock | `aws/meta.llama3-1-405b-instruct-v1:0` |
| AWS Bedrock | `aws/minimax.minimax-m2.1` |
| AWS Bedrock | `aws/minimax.minimax-m2.5` |
| AWS Bedrock | `aws/mistral.devstral-2-123b` |
| AWS Bedrock | `aws/mistral.magistral-small-2509` |
| AWS Bedrock | `aws/mistral.ministral-3-3b-instruct` |
| AWS Bedrock | `aws/mistral.mistral-large-3-675b-instruct` |
| AWS Bedrock | `aws/mistral.pixtral-large-2502-v1:0` |
| AWS Bedrock | `aws/moonshotai.kimi-k2.5` |
| AWS Bedrock | `aws/nvidia.nemotron-nano-3-30b` |
| AWS Bedrock | `aws/nvidia.nemotron-super-3-120b` |
| AWS Bedrock | `aws/openai.gpt-oss-120b-1:0` |
| AWS Bedrock | `aws/qwen.qwen3-32b-v1:0` |
| AWS Bedrock | `aws/qwen.qwen3-coder-next` |
| AWS Bedrock | `aws/us.amazon.nova-2-lite-v1:0` |
| AWS Bedrock | `aws/us.amazon.nova-lite-v1:0` |
| AWS Bedrock | `aws/us.amazon.nova-micro-v1:0` |
| AWS Bedrock | `aws/us.amazon.nova-pro-v1:0` |
| AWS Bedrock | `aws/us.anthropic.claude-fable-5` |
| AWS Bedrock | `aws/us.anthropic.claude-fable-5-1` |
| AWS Bedrock | `aws/us.anthropic.claude-haiku-4-5-20251001-v1:0` |
| AWS Bedrock | `aws/us.anthropic.claude-opus-4-1-20250805-v1:0` |
| AWS Bedrock | `aws/us.anthropic.claude-opus-4-5-20251101-v1:0` |
| AWS Bedrock | `aws/us.anthropic.claude-opus-4-8` |
| AWS Bedrock | `aws/us.anthropic.claude-opus-5` |
| AWS Bedrock | `aws/us.anthropic.claude-sonnet-4-20250514-v1:0` |
| AWS Bedrock | `aws/us.anthropic.claude-sonnet-4-5-20250929-v1:0` |
| AWS Bedrock | `aws/us.anthropic.claude-sonnet-4-6` |
| AWS Bedrock | `aws/us.anthropic.claude-sonnet-5` |
| AWS Bedrock | `aws/us.writer.palmyra-x5-v1:0` |
| AWS Bedrock | `aws/writer.palmyra-x5-v1:0` |
| AWS Bedrock | `aws/zai.glm-4.7` |
| AWS Bedrock | `aws/zai.glm-5` |
| Azure | `azure/eu.gpt-5.6-luna` |
| Azure | `azure/eu.gpt-5.6-terra` |
| Azure | `azure/global.gpt-5.6-luna` |
| Azure | `azure/global.gpt-5.6-terra` |
| Azure | `azure/gpt-4.1` |
| Azure | `azure/gpt-4.1-mini` |
| Azure | `azure/gpt-4.1-nano` |
| Azure | `azure/gpt-4o` |
| Azure | `azure/gpt-5` |
| Azure | `azure/gpt-5-mini` |
| Azure | `azure/gpt-5-nano` |
| Azure | `azure/gpt-5.4` |
| Azure | `azure/gpt-5.6-sol` |
| Azure | `azure/gpt-5.6-sol-global` |
| baseten | `baseten/deepseek-v4-flash-0731` |
| baseten | `baseten/deepseek-v4-pro-0813` |
| baseten | `baseten/deepseek-v4.1-flash` |
| baseten | `baseten/glm-5.2` |
| baseten | `baseten/glm-5.2-fast` |
| baseten | `baseten/glm-5.3` |
| baseten | `baseten/glm-5.3-fast` |
| baseten | `baseten/glm-5.3-flash` |
| baseten | `baseten/gpt-oss-120b` |
| baseten | `baseten/kimi-k3` |
| baseten | `baseten/nemotron-ultra` |
| Cerebras | `cerebras/gpt-oss-120b` |
| Cerebras | `cerebras/qwen-3.8-27b` |
| Cohere | `cohere/c4ai-aya-expanse-32b` |
| Cohere | `cohere/c4ai-aya-vision-32b` |
| Cohere | `cohere/command-a-03-2025` |
| Cohere | `cohere/command-a-plus-05-2026` |
| Cohere | `cohere/command-a-reasoning-08-2025` |
| Cohere | `cohere/command-a-translate-08-2025` |
| Cohere | `cohere/command-a-vision-07-2025` |
| Cohere | `cohere/command-r-08-2024` |
| Cohere | `cohere/command-r-plus-08-2024` |
| Cohere | `cohere/command-r7b-12-2024` |
| Cohere | `cohere/command-r7b-arabic-02-2025` |
| Deepseek | `deepseek/deepseek-flash` |
| fireworks | `fireworks/deepseek-v4-pro` |
| fireworks | `fireworks/glm-5.2` |
| fireworks | `fireworks/kimi-k2.7-code` |
| fireworks | `fireworks/kimi-k3` |
| fireworks | `fireworks/kimi-k3-fast` |
| fireworks | `fireworks/minimax-m3` |
| fireworks | `fireworks/qwen3.7-plus` |
| Vertex AI | `google/claude-haiku-4-5` |
| Vertex AI | `google/claude-opus-4-5@20251101` |
| Vertex AI | `google/claude-opus-4-6` |
| Vertex AI | `google/claude-opus-4-7` |
| Vertex AI | `google/claude-opus-4-8` |
| Vertex AI | `google/claude-sonnet-4-5@20250929` |
| Vertex AI | `google/claude-sonnet-4-6` |
| Vertex AI | `google/claude-sonnet-4@20250514` |
| Vertex AI | `google/eu.claude-fable-5` |
| Vertex AI | `google/eu.claude-fable-5-1` |
| Vertex AI | `google/eu.claude-opus-4-7` |
| Vertex AI | `google/eu.claude-opus-4-8` |
| Vertex AI | `google/eu.claude-opus-5` |
| Vertex AI | `google/eu.claude-sonnet-5` |
| Vertex AI | `google/eu.gemini-3.1-flash-lite` |
| Vertex AI | `google/eu.gemini-3.5-flash` |
| Vertex AI | `google/eu.gemini-3.5-flash-lite` |
| Vertex AI | `google/eu.gemini-3.6-flash` |
| Vertex AI | `google/eu.gemini-3.7-flash` |
| Vertex AI | `google/eu.gemini-3.8-flash` |
| Vertex AI | `google/gemini-2.5-flash` |
| Vertex AI | `google/gemini-2.5-flash-lite` |
| Vertex AI | `google/gemini-2.5-pro` |
| Vertex AI | `google/gemini-3-flash-preview` |
| Vertex AI | `google/gemini-3.1-flash-lite` |
| Vertex AI | `google/gemini-3.1-pro-preview` |
| Vertex AI | `google/gemini-3.5-flash` |
| Vertex AI | `google/gemini-3.5-flash-lite` |
| Vertex AI | `google/gemini-3.6-flash` |
| Vertex AI | `google/gemini-3.7-flash` |
| Vertex AI | `google/gemini-3.8-flash` |
| Vertex AI | `google/global.claude-fable-5` |
| Vertex AI | `google/global.claude-fable-5-1` |
| Vertex AI | `google/global.claude-opus-4-7` |
| Vertex AI | `google/global.claude-opus-4-8` |
| Vertex AI | `google/global.claude-opus-5` |
| Vertex AI | `google/global.claude-sonnet-5` |
| Vertex AI | `google/us.claude-fable-5` |
| Vertex AI | `google/us.claude-fable-5-1` |
| Vertex AI | `google/us.claude-opus-4-7` |
| Vertex AI | `google/us.claude-opus-4-8` |
| Vertex AI | `google/us.claude-opus-5` |
| Vertex AI | `google/us.claude-sonnet-5` |
| Vertex AI | `google/us.gemini-3.1-flash-lite` |
| Vertex AI | `google/us.gemini-3.5-flash` |
| Vertex AI | `google/us.gemini-3.5-flash-lite` |
| Vertex AI | `google/us.gemini-3.6-flash` |
| Vertex AI | `google/us.gemini-3.7-flash` |
| Vertex AI | `google/us.gemini-3.8-flash` |
| Google AI | `google-ai/gemini-2.5-flash` |
| Google AI | `google-ai/gemini-2.5-flash-lite` |
| Google AI | `google-ai/gemini-2.5-pro` |
| Google AI | `google-ai/gemini-3-flash-preview` |
| Google AI | `google-ai/gemini-3.1-pro-preview` |
| Google AI | `google-ai/gemini-3.1-pro-preview-customtools` |
| Google AI | `google-ai/gemini-3.5-flash` |
| Google AI | `google-ai/gemini-3.5-flash-lite` |
| Google AI | `google-ai/gemini-3.6-flash` |
| Google AI | `google-ai/gemini-3.7-flash` |
| Google AI | `google-ai/gemini-3.8-flash` |
| Google AI | `google-ai/gemini-omni-flash-preview` |
| Google AI | `google-ai/gemma-4-26b-a4b-it` |
| Google AI | `google-ai/gemma-4-31b-it` |
| greenpt | `greenpt/deepseek-v4-flash-0731` |
| greenpt | `greenpt/gemma4` |
| greenpt | `greenpt/glm-5.2` |
| greenpt | `greenpt/glm-5.2-caveman` |
| greenpt | `greenpt/glm-5.2-caveman-lite` |
| greenpt | `greenpt/glm-5.2-caveman-ultra` |
| greenpt | `greenpt/glm-5.2-honey` |
| greenpt | `greenpt/glm-5.2-honey-lite` |
| greenpt | `greenpt/glm-5.2-honey-ultra` |
| greenpt | `greenpt/glm-5.2-ponytail` |
| greenpt | `greenpt/glm-5.2-ponytail-lite` |
| greenpt | `greenpt/glm-5.2-ponytail-ultra` |
| greenpt | `greenpt/gpt-oss-120b` |
| greenpt | `greenpt/green-l` |
| greenpt | `greenpt/green-l-raw` |
| greenpt | `greenpt/green-r` |
| greenpt | `greenpt/green-r-raw` |
| greenpt | `greenpt/kimi-k2.6` |
| greenpt | `greenpt/kimi-k2.7-code` |
| greenpt | `greenpt/kimi-k3` |
| greenpt | `greenpt/llama-3.3-70b-instruct` |
| greenpt | `greenpt/minimax-m2.5` |
| greenpt | `greenpt/mistral-medium-3.5-128b` |
| greenpt | `greenpt/mistral-small-3.2-24b-instruct-2506` |
| greenpt | `greenpt/qwen3-235b-a22b-instruct-2507` |
| greenpt | `greenpt/qwen3.5-397b-a17b` |
| greenpt | `greenpt/qwen3.6-35b-a3b` |
| Groq | `groq/allam-2-7b` |
| Groq | `groq/groq/compound` |
| Groq | `groq/groq/compound-mini` |
| Groq | `groq/meta-llama/llama-prompt-guard-2-22m` |
| Groq | `groq/meta-llama/llama-prompt-guard-2-86m` |
| Groq | `groq/openai/gpt-oss-120b` |
| Groq | `groq/openai/gpt-oss-20b` |
| Groq | `groq/openai/gpt-oss-safeguard-20b` |
| Groq | `groq/qwen/qwen3.6-27b` |
| Groq | `groq/qwen/qwen3.8-27b` |
| hcompany | `hcompany/holo3-1-35b-a3b` |
| hcompany | `hcompany/holo3-122b-a10b` |
| inceptron | `inceptron/deepseek-ai/DeepSeek-V4-Flash-0731` |
| inceptron | `inceptron/MiniMaxAI/MiniMax-M2.5` |
| inceptron | `inceptron/moonshotai/Kimi-K2.6` |
| inceptron | `inceptron/moonshotai/Kimi-K2.7-Code` |
| inceptron | `inceptron/zai-org/GLM-5.2` |
| inceptron | `inceptron/zai-org/GLM-5.3` |
| meta | `meta/muse-spark-1.1` |
| meta | `meta/muse-spark-1.2` |
| meta | `meta/muse-spark-1.2-contributor` |
| meta | `meta/muse-spark-1.3` |
| meta | `meta/muse-spark-1.3-contributor` |
| Minimax | `minimax/M2-her` |
| Minimax | `minimax/MiniMax-M2` |
| Minimax | `minimax/MiniMax-M2.1` |
| Minimax | `minimax/MiniMax-M2.1-highspeed` |
| Minimax | `minimax/MiniMax-M2.5` |
| Minimax | `minimax/MiniMax-M2.5-highspeed` |
| Minimax | `minimax/minimax-m2.5-lightning` |
| Minimax | `minimax/MiniMax-M2.7` |
| Minimax | `minimax/MiniMax-M2.7-highspeed` |
| Minimax | `minimax/MiniMax-M3` |
| Mistral | `mistral/codestral-2508` |
| Mistral | `mistral/codestral-latest` |
| Mistral | `mistral/labs-leanstral-1-5` |
| Mistral | `mistral/labs-leanstral-1-5-1` |
| Mistral | `mistral/ministral-14b-2512` |
| Mistral | `mistral/ministral-14b-latest` |
| Mistral | `mistral/ministral-3b-2512` |
| Mistral | `mistral/ministral-3b-latest` |
| Mistral | `mistral/ministral-8b-2512` |
| Mistral | `mistral/ministral-8b-latest` |
| Mistral | `mistral/mistral-large-2512` |
| Mistral | `mistral/mistral-large-latest` |
| Mistral | `mistral/mistral-medium-2604` |
| Mistral | `mistral/mistral-medium-3` |
| Mistral | `mistral/mistral-medium-3-5` |
| Mistral | `mistral/mistral-medium-3.5` |
| Mistral | `mistral/mistral-medium-latest` |
| Mistral | `mistral/mistral-small-2603` |
| Mistral | `mistral/mistral-small-latest` |
| Mistral | `mistral/mistral-tiny-2407` |
| Mistral | `mistral/mistral-tiny-latest` |
| Mistral | `mistral/voxtral-small-2507` |
| Mistral | `mistral/voxtral-small-latest` |
| Mistral | `mistral/zai-glm-5-2` |
| Moonshot AI | `moonshotai/kimi-k2.6` |
| Moonshot AI | `moonshotai/kimi-k2.7-code` |
| Moonshot AI | `moonshotai/kimi-k2.7-code-highspeed` |
| Moonshot AI | `moonshotai/kimi-k3` |
| nebius | `nebius/deepseek-ai/DeepSeek-V4-Flash-0731` |
| nebius | `nebius/deepseek-ai/DeepSeek-V4-Pro` |
| nebius | `nebius/deepseek-ai/DeepSeek-V4-Pro-0813` |
| nebius | `nebius/google/gemma-3-27b-it` |
| nebius | `nebius/MiniMaxAI/MiniMax-M3` |
| nebius | `nebius/moonshotai/Kimi-K2.6` |
| nebius | `nebius/moonshotai/Kimi-K2.7-Code` |
| nebius | `nebius/moonshotai/Kimi-K3` |
| nebius | `nebius/NousResearch/Hermes-4-405B` |
| nebius | `nebius/nvidia/Nemotron-3_5-Lightning` |
| nebius | `nebius/nvidia/nemotron-3-super-120b-a12b` |
| nebius | `nebius/nvidia/Nemotron-3-Ultra-550b-a55b` |
| nebius | `nebius/nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B` |
| nebius | `nebius/openai/gpt-oss-120b` |
| nebius | `nebius/openbmb/MiniCPM-V-4_5` |
| nebius | `nebius/Qwen/Qwen3-235B-A22B-Instruct-2507` |
| nebius | `nebius/Qwen/Qwen3-30B-A3B-Instruct-2507` |
| nebius | `nebius/Qwen/Qwen3.5-397B-A17B` |
| nebius | `nebius/zai-org/GLM-5.1` |
| nebius | `nebius/zai-org/GLM-5.2` |
| nebius | `nebius/zai-org/GLM-5.3` |
| nebius | `nebius/zai-org/GLM-5.3-Flash` |
| Nvidia | `nvidia/meta/muse-glimmer-30b` |
| Nvidia | `nvidia/moonshotai/kimi-k3` |
| Nvidia | `nvidia/nvidia/nemotron-3-super-120b-a12b` |
| Nvidia | `nvidia/nvidia/nemotron-3-ultra-550b-a55b` |
| Nvidia | `nvidia/nvidia/nemotron-3.5-content-safety` |
| Nvidia | `nvidia/nvidia/nemotron-3.5-lightning-30b-a3b` |
| Nvidia | `nvidia/poolside/laguna-xs-2.1` |
| OpenAI | `openai/eu.gpt-4.1` |
| OpenAI | `openai/eu.gpt-4.1-2025-04-14` |
| OpenAI | `openai/eu.gpt-4.1-mini` |
| OpenAI | `openai/eu.gpt-4.1-mini-2025-04-14` |
| OpenAI | `openai/eu.gpt-4o` |
| OpenAI | `openai/eu.gpt-4o-2024-08-06` |
| OpenAI | `openai/eu.gpt-4o-2024-11-20` |
| OpenAI | `openai/eu.gpt-4o-mini` |
| OpenAI | `openai/eu.gpt-4o-mini-2024-07-18` |
| OpenAI | `openai/eu.gpt-5` |
| OpenAI | `openai/eu.gpt-5-mini` |
| OpenAI | `openai/eu.gpt-5-nano` |
| OpenAI | `openai/eu.gpt-5.1` |
| OpenAI | `openai/eu.gpt-5.1-2025-11-13` |
| OpenAI | `openai/eu.gpt-5.2` |
| OpenAI | `openai/eu.gpt-5.2-2025-12-11` |
| OpenAI | `openai/eu.gpt-5.4` |
| OpenAI | `openai/eu.gpt-5.4-2026-03-05` |
| OpenAI | `openai/eu.gpt-5.4-mini` |
| OpenAI | `openai/eu.gpt-5.4-mini-2026-03-17` |
| OpenAI | `openai/eu.gpt-5.4-nano` |
| OpenAI | `openai/eu.gpt-5.4-nano-2026-03-17` |
| OpenAI | `openai/eu.gpt-5.5` |
| OpenAI | `openai/eu.gpt-5.5-2026-04-23` |
| OpenAI | `openai/eu.gpt-5.6-luna` |
| OpenAI | `openai/eu.gpt-5.6-sol` |
| OpenAI | `openai/eu.gpt-5.6-terra` |
| OpenAI | `openai/eu.gpt-6-astra` |
| OpenAI | `openai/eu.o1-2024-12-17` |
| OpenAI | `openai/eu.o3` |
| OpenAI | `openai/eu.o3-mini-2025-01-31` |
| OpenAI | `openai/eu.o4-mini-2025-04-16` |
| OpenAI | `openai/gpt-3.5-turbo-16k` |
| OpenAI | `openai/gpt-4.1` |
| OpenAI | `openai/gpt-4.1-2025-04-14` |
| OpenAI | `openai/gpt-4.1-mini` |
| OpenAI | `openai/gpt-4.1-mini-2025-04-14` |
| OpenAI | `openai/gpt-4o` |
| OpenAI | `openai/gpt-4o-2024-08-06` |
| OpenAI | `openai/gpt-4o-2024-11-20` |
| OpenAI | `openai/gpt-4o-mini` |
| OpenAI | `openai/gpt-4o-mini-2024-07-18` |
| OpenAI | `openai/gpt-5` |
| OpenAI | `openai/gpt-5-mini` |
| OpenAI | `openai/gpt-5-nano` |
| OpenAI | `openai/gpt-5.1` |
| OpenAI | `openai/gpt-5.1-2025-11-13` |
| OpenAI | `openai/gpt-5.2` |
| OpenAI | `openai/gpt-5.2-2025-12-11` |
| OpenAI | `openai/gpt-5.3-codex` |
| OpenAI | `openai/gpt-5.4` |
| OpenAI | `openai/gpt-5.4-2026-03-05` |
| OpenAI | `openai/gpt-5.4-mini` |
| OpenAI | `openai/gpt-5.4-mini-2026-03-17` |
| OpenAI | `openai/gpt-5.4-nano` |
| OpenAI | `openai/gpt-5.4-nano-2026-03-17` |
| OpenAI | `openai/gpt-5.5` |
| OpenAI | `openai/gpt-5.5-2026-04-23` |
| OpenAI | `openai/gpt-5.6-luna` |
| OpenAI | `openai/gpt-5.6-sol` |
| OpenAI | `openai/gpt-5.6-terra` |
| OpenAI | `openai/gpt-6-astra` |
| OpenAI | `openai/o1-2024-12-17` |
| OpenAI | `openai/o3` |
| OpenAI | `openai/o3-mini-2025-01-31` |
| OpenAI | `openai/o4-mini-2025-04-16` |
| Perplexity | `perplexity/sonar` |
| Perplexity | `perplexity/sonar-deep-research` |
| Perplexity | `perplexity/sonar-pro` |
| Perplexity | `perplexity/sonar-reasoning-pro` |
| poolside | `poolside/poolside/laguna-m.1` |
| poolside | `poolside/poolside/laguna-s-2.1` |
| poolside | `poolside/poolside/laguna-xs-2.1` |
| scaleway | `scaleway/deepseek-v4-flash-0731` |
| scaleway | `scaleway/gemma-4-26b-a4b-it` |
| scaleway | `scaleway/glm-5.2` |
| scaleway | `scaleway/gpt-oss-120b` |
| scaleway | `scaleway/llama-3.3-70b-instruct` |
| scaleway | `scaleway/mistral-medium-3.5-128b` |
| scaleway | `scaleway/mistral-small-3.2-24b-instruct-2506` |
| scaleway | `scaleway/qwen3-235b-a22b-instruct-2507` |
| scaleway | `scaleway/qwen3.5-397b-a17b` |
| scaleway | `scaleway/qwen3.6-35b-a3b` |
| tencent | `tencent/deepseek-v4-flash` |
| tencent | `tencent/deepseek-v4-flash-202605` |
| tencent | `tencent/deepseek-v4-pro` |
| tencent | `tencent/deepseek-v4-pro-202606` |
| tencent | `tencent/glm-5` |
| tencent | `tencent/glm-5-turbo` |
| tencent | `tencent/glm-5.1` |
| tencent | `tencent/glm-5.2` |
| tencent | `tencent/glm-5v-turbo` |
| tencent | `tencent/hy-mt2-plus` |
| tencent | `tencent/kimi-k2.5` |
| tencent | `tencent/kimi-k2.6` |
| tencent | `tencent/kimi-k2.7-code` |
| tencent | `tencent/kimi-k2.7-code-highspeed` |
| tencent | `tencent/minimax-m2.5` |
| tencent | `tencent/minimax-m2.7` |
| tencent | `tencent/minimax-m3` |
| tensorix | `tensorix/deepseek/deepseek-chat-v3.1` |
| tensorix | `tensorix/deepseek/deepseek-r1-0528` |
| tensorix | `tensorix/deepseek/deepseek-v3.2` |
| tensorix | `tensorix/deepseek/deepseek-v4-flash-0731` |
| tensorix | `tensorix/deepseek/deepseek-v4-pro` |
| tensorix | `tensorix/meta-llama/llama-3.3-70b-instruct` |
| tensorix | `tensorix/meta-llama/llama-4-maverick` |
| tensorix | `tensorix/minimax/minimax-m2` |
| tensorix | `tensorix/minimax/minimax-m2.5` |
| tensorix | `tensorix/minimax/minimax-m3` |
| tensorix | `tensorix/moonshotai/kimi-k2.5` |
| tensorix | `tensorix/moonshotai/kimi-k2.6` |
| tensorix | `tensorix/moonshotai/kimi-k2.7-code` |
| tensorix | `tensorix/moonshotai/kimi-k3` |
| tensorix | `tensorix/nvidia/nemotron-3-super-120b-a12b` |
| tensorix | `tensorix/openai/gpt-oss-120b` |
| tensorix | `tensorix/openai/gpt-oss-20b` |
| tensorix | `tensorix/qwen/qwen3-235b-a22b-2507` |
| tensorix | `tensorix/qwen/qwen3-coder-30b-a3b-instruct` |
| tensorix | `tensorix/qwen/qwen3-vl-235b-a22b-instruct` |
| tensorix | `tensorix/qwen/qwen3.5-122b-a10b` |
| tensorix | `tensorix/qwen/qwen3.5-9b` |
| tensorix | `tensorix/qwen/qwen3.8-2.4t-a95b` |
| tensorix | `tensorix/qwen/qwen3.8-flash-next` |
| tensorix | `tensorix/xiaomi/mimo-v2.5` |
| tensorix | `tensorix/z-ai/glm-4.6` |
| tensorix | `tensorix/z-ai/glm-4.7` |
| tensorix | `tensorix/z-ai/glm-5` |
| tensorix | `tensorix/z-ai/glm-5-turbo` |
| tensorix | `tensorix/z-ai/glm-5.1` |
| tensorix | `tensorix/z-ai/glm-5.2` |
| tensorix | `tensorix/z-ai/glm-5.3-flash` |
| tensorix | `tensorix/z-ai/glm-5v-turbo` |
| Together AI | `togetherai/meta-llama/Llama-3.3-70B-Instruct-Turbo` |
| Together AI | `togetherai/meta-llama/Llama-Guard-4-12B` |
| Together AI | `togetherai/moonshotai/Kimi-K2.6` |
| Together AI | `togetherai/moonshotai/Kimi-K2.7-Code` |
| Together AI | `togetherai/zai-org/GLM-5.2` |
| Wafer | `wafer/DeepSeek-V4-Flash-0423` |
| Wafer | `wafer/DeepSeek-V4-Flash-0731-Fast` |
| Wafer | `wafer/DeepSeek-V4.1-Flash` |
| Wafer | `wafer/GLM-5.1` |
| Wafer | `wafer/GLM-5.2` |
| Wafer | `wafer/GLM-5.3` |
| Wafer | `wafer/GLM-5.3-Flash` |
| Wafer | `wafer/glm5.2-fast` |
| Wafer | `wafer/Kimi-K2.6` |
| Wafer | `wafer/Kimi-K3` |
| Wafer | `wafer/kimi-k3-fast` |
| Wafer | `wafer/MiniMax-M3` |
| Wafer | `wafer/Qwen3.5-397B-A17B` |
| xai | `xai/grok-3-fast` |
| xai | `xai/grok-3-fast-latest` |
| xai | `xai/grok-3-latest` |
| xai | `xai/grok-3-mini` |
| xai | `xai/grok-3-mini-fast` |
| xai | `xai/grok-3-mini-fast-latest` |
| xai | `xai/grok-3-mini-latest` |
| xai | `xai/grok-4` |
| xai | `xai/grok-4-1-fast` |
| xai | `xai/grok-4-fast` |
| xai | `xai/grok-4.20-0309-non-reasoning` |
| xai | `xai/grok-4.20-0309-reasoning` |
| xai | `xai/grok-4.20-beta-latest-non-reasoning` |
| xai | `xai/grok-4.20-beta-latest-reasoning` |
| xai | `xai/grok-4.20-multi-agent-0309` |
| xai | `xai/grok-4.20-multi-agent-beta-latest` |
| xai | `xai/grok-4.3` |
| xai | `xai/grok-4.5` |
| xai | `xai/grok-4.6` |
| xai | `xai/grok-build-0.1` |
| Z AI | `zai/glm-4.5` |
| Z AI | `zai/glm-4.5-air` |
| Z AI | `zai/glm-4.5-flash` |
| Z AI | `zai/glm-4.5v` |
| Z AI | `zai/glm-4.6` |
| Z AI | `zai/glm-4.6v` |
| Z AI | `zai/glm-4.7` |
| Z AI | `zai/glm-4.7-flash` |
| Z AI | `zai/glm-4.7-flashx` |
| Z AI | `zai/glm-5` |
| Z AI | `zai/glm-5-turbo` |
| Z AI | `zai/glm-5.1` |
| Z AI | `zai/glm-5.2` |
| Z AI | `zai/glm-5.3` |
| Z AI | `zai/glm-5.3-flash` |
| Z AI | `zai/glm-5v-turbo` |

### Completion models

<CodeGroup>
  ```bash cURL theme={"theme":{"light":"github-light","dark":"github-dark"}}
  curl https://my.orq.ai/v3/router/completions \
    -H "Content-Type: application/json" \
    -H "Authorization: Bearer $ORQ_API_KEY" \
    -d '{
      "model": "openai/gpt-3.5-turbo-instruct",
      "prompt": "Once upon a time",
      "max_tokens": 100
    }'
  ```

  ```python Python theme={"theme":{"light":"github-light","dark":"github-dark"}}
  from openai import OpenAI
  import os

  client = OpenAI(
    base_url="https://my.orq.ai/v3/router",
    api_key=os.getenv("ORQ_API_KEY"),
  )

  completion = client.completions.create(
    model="openai/gpt-3.5-turbo-instruct",
    prompt="Once upon a time",
    max_tokens=100
  )

  print(completion.choices[0].text)
  ```

  ```typescript TypeScript theme={"theme":{"light":"github-light","dark":"github-dark"}}
  import OpenAI from "openai";

  const client = new OpenAI({
    baseURL: 'https://my.orq.ai/v3/router',
    apiKey: process.env.ORQ_API_KEY,
  });

  async function main() {
    const completion = await client.completions.create({
      model: "openai/gpt-3.5-turbo-instruct",
      prompt: "Once upon a time",
      max_tokens: 100
    });

    console.log(completion.choices[0].text);
  }

  main();
  ```
</CodeGroup>

| Provider | Model |
| - | - |
| OpenAI | `openai/gpt-3.5-turbo-instruct` |

### Embedding models

<CodeGroup>
  ```bash cURL theme={"theme":{"light":"github-light","dark":"github-dark"}}
  curl https://my.orq.ai/v3/router/embeddings \
    -H "Content-Type: application/json" \
    -H "Authorization: Bearer $ORQ_API_KEY" \
    -d '{
      "model": "openai/text-embedding-3-small",
      "input": "Hello world"
    }'
  ```

  ```python Python theme={"theme":{"light":"github-light","dark":"github-dark"}}
  from openai import OpenAI
  import os

  client = OpenAI(
    base_url="https://my.orq.ai/v3/router",
    api_key=os.getenv("ORQ_API_KEY"),
  )

  embedding = client.embeddings.create(
    model="openai/text-embedding-3-small",
    input="Hello world"
  )

  print(embedding.data[0].embedding)
  ```

  ```typescript TypeScript theme={"theme":{"light":"github-light","dark":"github-dark"}}
  import OpenAI from "openai";

  const client = new OpenAI({
    baseURL: 'https://my.orq.ai/v3/router',
    apiKey: process.env.ORQ_API_KEY,
  });

  async function main() {
    const embedding = await client.embeddings.create({
      model: "openai/text-embedding-3-small",
      input: "Hello world"
    });

    console.log(embedding.data[0].embedding);
  }

  main();
  ```
</CodeGroup>

| Provider | Model |
| - | - |
| AWS Bedrock | `aws/amazon.titan-embed-g1-text-02` |
| AWS Bedrock | `aws/amazon.titan-embed-image-v1` |
| AWS Bedrock | `aws/amazon.titan-embed-text-v2:0` |
| Azure | `azure/text-embedding-3-small` |
| Azure | `azure/text-embedding-ada-002` |
| Cohere | `cohere/embed-english-light-v3.0` |
| Cohere | `cohere/embed-english-v3.0` |
| Cohere | `cohere/embed-multilingual-light-v3.0` |
| Cohere | `cohere/embed-multilingual-v3.0` |
| Cohere | `cohere/embed-v4.0` |
| Vertex AI | `google/eu.gemini-embedding-2` |
| Vertex AI | `google/gemini-embedding-001` |
| Vertex AI | `google/gemini-embedding-2` |
| Vertex AI | `google/multimodalembedding@001` |
| Vertex AI | `google/text-multilingual-embedding-002` |
| Vertex AI | `google/us.gemini-embedding-2` |
| Google AI | `google-ai/gemini-embedding-001` |
| Google AI | `google-ai/gemini-embedding-2` |
| greenpt | `greenpt/bge-multilingual-gemma2` |
| greenpt | `greenpt/green-embedding` |
| greenpt | `greenpt/green-embeddings` |
| greenpt | `greenpt/qwen3-embedding-8b` |
| Jina AI | `jina/jina-clip-v1` |
| Jina AI | `jina/jina-clip-v2` |
| Jina AI | `jina/jina-code-embeddings-0.5b` |
| Jina AI | `jina/jina-code-embeddings-1.5b` |
| Jina AI | `jina/jina-embeddings-v2-base-code` |
| Jina AI | `jina/jina-embeddings-v2-base-de` |
| Jina AI | `jina/jina-embeddings-v2-base-en` |
| Jina AI | `jina/jina-embeddings-v2-base-es` |
| Jina AI | `jina/jina-embeddings-v2-base-zh` |
| Jina AI | `jina/jina-embeddings-v3` |
| Jina AI | `jina/jina-embeddings-v4` |
| Jina AI | `jina/jina-embeddings-v5-omni-nano` |
| Jina AI | `jina/jina-embeddings-v5-omni-small` |
| Jina AI | `jina/jina-embeddings-v5-text-nano` |
| Jina AI | `jina/jina-embeddings-v5-text-small` |
| Mistral | `mistral/codestral-embed` |
| Mistral | `mistral/codestral-embed-2505` |
| Mistral | `mistral/mistral-embed` |
| Mistral | `mistral/mistral-embed-2312` |
| nebius | `nebius/Qwen/Qwen3-Embedding-8B` |
| Nvidia | `nvidia/nvidia/nemotron-3-embed-1b` |
| OpenAI | `openai/eu.text-embedding-3-large` |
| OpenAI | `openai/eu.text-embedding-3-small` |
| OpenAI | `openai/eu.text-embedding-ada-002` |
| OpenAI | `openai/text-embedding-3-large` |
| OpenAI | `openai/text-embedding-3-small` |
| OpenAI | `openai/text-embedding-ada-002` |
| scaleway | `scaleway/bge-multilingual-gemma2` |
| scaleway | `scaleway/qwen3-embedding-8b` |
| tencent | `tencent/kinfra-text-embedding-0.6b` |
| tencent | `tencent/kinfra-text-embedding-4b` |
| tensorix | `tensorix/qwen/qwen3-embedding-8b` |

### Image models

#### Image Generation

<CodeGroup>
  ```bash cURL theme={"theme":{"light":"github-light","dark":"github-dark"}}
  curl https://my.orq.ai/v3/router/images/generations \
    -H "Content-Type: application/json" \
    -H "Authorization: Bearer $ORQ_API_KEY" \
    -d '{
      "model": "openai/gpt-image-2",
      "prompt": "A beautiful sunset over mountains",
      "n": 1,
      "size": "1024x1024"
    }'
  ```

  ```python Python theme={"theme":{"light":"github-light","dark":"github-dark"}}
  from openai import OpenAI
  import os

  client = OpenAI(
    base_url="https://my.orq.ai/v3/router",
    api_key=os.getenv("ORQ_API_KEY"),
  )

  response = client.images.generate(
    model="openai/gpt-image-2",
    prompt="A beautiful sunset over mountains",
    n=1,
    size="1024x1024"
  )

  print(response.data[0].url)
  ```

  ```typescript TypeScript theme={"theme":{"light":"github-light","dark":"github-dark"}}
  import OpenAI from "openai";

  const client = new OpenAI({
    baseURL: 'https://my.orq.ai/v3/router',
    apiKey: process.env.ORQ_API_KEY,
  });

  async function main() {
    const response = await client.images.generate({
      model: "openai/gpt-image-2",
      prompt: "A beautiful sunset over mountains",
      n: 1,
      size: "1024x1024"
    });

    console.log(response.data[0].url);
  }

  main();
  ```
</CodeGroup>

#### Image Edit

<CodeGroup>
  ```bash cURL theme={"theme":{"light":"github-light","dark":"github-dark"}}
  curl https://my.orq.ai/v3/router/images/edits \
    -H "Authorization: Bearer $ORQ_API_KEY" \
    -F model="openai/gpt-image-2" \
    -F image="@body-lotion.png" \
    -F image="@bath-bomb.png" \
    -F image="@incense-kit.png" \
    -F image="@soap.png" \
    -F prompt="Generate a photorealistic image of a gift basket on a white background labeled 'Relax & Unwind' with a ribbon and handwriting-like font, containing all the items in the reference pictures."
  ```

  ```python Python theme={"theme":{"light":"github-light","dark":"github-dark"}}
  import base64
  from openai import OpenAI
  import os

  client = OpenAI(
    base_url="https://my.orq.ai/v3/router",
    api_key=os.getenv("ORQ_API_KEY"),
  )

  prompt = """
  Generate a photorealistic image of a gift basket on a white background
  labeled 'Relax & Unwind' with a ribbon and handwriting-like font,
  containing all the items in the reference pictures.
  """

  result = client.images.edit(
      model="openai/gpt-image-2",
      image=[
          open("body-lotion.png", "rb"),
          open("bath-bomb.png", "rb"),
          open("incense-kit.png", "rb"),
          open("soap.png", "rb"),
      ],
      prompt=prompt
  )

  image_base64 = result.data[0].b64_json
  image_bytes = base64.b64decode(image_base64)

  # Save the image to a file
  with open("gift-basket.png", "wb") as f:
      f.write(image_bytes)
  ```

  ```typescript TypeScript theme={"theme":{"light":"github-light","dark":"github-dark"}}
  import fs from "fs";
  import OpenAI, { toFile } from "openai";

  const client = new OpenAI({
    baseURL: 'https://my.orq.ai/v3/router',
    apiKey: process.env.ORQ_API_KEY,
  });

  const imageFiles = [
      "bath-bomb.png",
      "body-lotion.png",
      "incense-kit.png",
      "soap.png",
  ];

  const images = await Promise.all(
      imageFiles.map(async (file) =>
          await toFile(fs.createReadStream(file), null, {
              type: "image/png",
          })
      ),
  );

  const response = await client.images.edit({
      model: "openai/gpt-image-2",
      image: images,
      prompt: "Create a lovely gift basket with these four items in it",
  });

  // Save the image to a file
  const image_base64 = response.data[0].b64_json;
  const image_bytes = Buffer.from(image_base64, "base64");
  fs.writeFileSync("basket.png", image_bytes);
  ```
</CodeGroup>

#### Image Variations

<CodeGroup>
  ```bash cURL theme={"theme":{"light":"github-light","dark":"github-dark"}}
  curl https://my.orq.ai/v3/router/images/variations \
    -H "Authorization: Bearer $ORQ_API_KEY" \
    -F model="openai/gpt-image-2" \
    -F image="@image_edit_original.png" \
    -F n=2 \
    -F size="1024x1024"
  ```

  ```python Python theme={"theme":{"light":"github-light","dark":"github-dark"}}
  from openai import OpenAI
  import os

  client = OpenAI(
    base_url="https://my.orq.ai/v3/router",
    api_key=os.getenv("ORQ_API_KEY"),
  )

  response = client.images.create_variation(
    model="openai/gpt-image-2",
    image=open("image_edit_original.png", "rb"),
    n=2,
    size="1024x1024"
  )

  print(response.data[0].url)
  ```

  ```typescript TypeScript theme={"theme":{"light":"github-light","dark":"github-dark"}}
  import fs from "fs";
  import OpenAI from "openai";

  const client = new OpenAI({
    baseURL: 'https://my.orq.ai/v3/router',
    apiKey: process.env.ORQ_API_KEY,
  });

  async function main() {
    const response = await client.images.createVariation({
      model: "openai/gpt-image-2",
      image: fs.createReadStream("otter.png"),
      n: 2,
      size: "1024x1024"
    });

    console.log(response.data);
  }

  main();
  ```
</CodeGroup>

#### Supported Image Models

| Provider | Model | Capabilities |
| - | - | - |
| bytedance | `bytedance/seedream-4-0-250828` | Generation, Edit |
| bytedance | `bytedance/seedream-4-5-251128` | Generation, Edit |
| FAL | `fal/flux-2` | Generation, Edit |
| FAL | `fal/flux-2-flex` | Generation, Edit |
| FAL | `fal/flux-2-max` | Generation, Edit |
| FAL | `fal/flux-2-pro` | Generation, Edit |
| FAL | `fal/flux-pro/v1.1` | Generation |
| FAL | `fal/flux/dev` | Generation |
| FAL | `fal/flux/schnell` | Generation |
| FAL | `fal/gemini-25-flash-image` | Generation |
| Vertex AI | `google/gemini-2.5-flash-image` | Generation |
| Vertex AI | `google/gemini-3.1-flash-image` | Generation |
| Vertex AI | `google/imagen-3.0-fast-generate-001` | Generation |
| Vertex AI | `google/imagen-3.0-generate-001` | Generation |
| Vertex AI | `google/imagen-4.0-fast-generate-001` | Generation |
| Vertex AI | `google/imagen-4.0-generate-001` | Generation |
| Vertex AI | `google/imagen-4.0-ultra-generate-001` | Generation |
| Google AI | `google-ai/gemini-3-pro-image` | Generation |
| Google AI | `google-ai/gemini-3.1-flash-image` | Generation |
| Google AI | `google-ai/gemini-3.1-flash-lite-image` | Generation |
| Leonardo AI | `leonardoai/leonard-diffusion-xl` | Generation |
| Leonardo AI | `leonardoai/leonard-kino-xl` | Generation |
| Leonardo AI | `leonardoai/leonard-lightning-xl` | Generation |
| Leonardo AI | `leonardoai/leonard-vision-xl` | Generation |
| meta | `meta/muse-image-1.0` | Generation, Edit |
| OpenAI | `openai/eu.gpt-image-2` | Generation, Edit |
| OpenAI | `openai/eu.gpt-image-2-2026-04-21` | Generation, Edit |
| OpenAI | `openai/eu.gpt-image-2.5-flare` | Generation, Edit |
| OpenAI | `openai/eu.gpt-image-2.5-flare-2026-09-08` | Generation, Edit |
| OpenAI | `openai/eu.gpt-image-2.5-sunburst` | Generation, Edit |
| OpenAI | `openai/eu.gpt-image-2.5-sunburst-2026-09-08` | Generation, Edit |
| OpenAI | `openai/gpt-image-2` | Generation, Edit |
| OpenAI | `openai/gpt-image-2-2026-04-21` | Generation, Edit |
| OpenAI | `openai/gpt-image-2.5-flare` | Generation, Edit |
| OpenAI | `openai/gpt-image-2.5-flare-2026-09-08` | Generation, Edit |
| OpenAI | `openai/gpt-image-2.5-sunburst` | Generation, Edit |
| OpenAI | `openai/gpt-image-2.5-sunburst-2026-09-08` | Generation, Edit |
| Z AI | `zai/cogview-4-250304` | Generation |

### Moderations models

<CodeGroup>
  ```bash cURL theme={"theme":{"light":"github-light","dark":"github-dark"}}
  curl https://my.orq.ai/v3/router/moderations \
    -H "Content-Type: application/json" \
    -H "Authorization: Bearer $ORQ_API_KEY" \
    -d '{
      "model": "openai/omni-moderation-latest",
      "input": "I want to check if this text is appropriate."
    }'
  ```

  ```python Python theme={"theme":{"light":"github-light","dark":"github-dark"}}
  from openai import OpenAI
  import os

  client = OpenAI(
    base_url="https://my.orq.ai/v3/router",
    api_key=os.getenv("ORQ_API_KEY"),
  )

  response = client.moderations.create(
    model="openai/omni-moderation-latest",
    input="I want to check if this text is appropriate."
  )

  print(response.results[0])
  ```

  ```typescript TypeScript theme={"theme":{"light":"github-light","dark":"github-dark"}}
  import OpenAI from "openai";

  const client = new OpenAI({
    baseURL: 'https://my.orq.ai/v3/router',
    apiKey: process.env.ORQ_API_KEY,
  });

  async function main() {
    const response = await client.moderations.create({
      model: "openai/omni-moderation-latest",
      input: "I want to check if this text is appropriate.",
    });

    console.log(response.results[0]);
  }

  main();
  ```
</CodeGroup>

| Provider | Model |
| - | - |
| Mistral | `mistral/mistral-moderation-2411` |
| Mistral | `mistral/mistral-moderation-2603` |
| OpenAI | `openai/eu.omni-moderation-2024-09-26` |
| OpenAI | `openai/eu.omni-moderation-latest` |
| OpenAI | `openai/omni-moderation-2024-09-26` |
| OpenAI | `openai/omni-moderation-latest` |

### Classify models

<CodeGroup>
  ```bash cURL theme={"theme":{"light":"github-light","dark":"github-dark"}}
  curl https://my.orq.ai/v3/router/classify \
    -H "Content-Type: application/json" \
    -H "Authorization: Bearer $ORQ_API_KEY" \
    -d '{
      "model": "typesafe/jev-latest",
      "state": "The package arrived two days late and the box was damaged.",
      "questions": {
        "is_complaint": {
          "type": "noul",
          "instructions": "Does the customer report a problem with their order?"
        }
      }
    }'
  ```

  ```python Python theme={"theme":{"light":"github-light","dark":"github-dark"}}
  import os
  import requests

  response = requests.post(
    "https://my.orq.ai/v3/router/classify",
    headers={"Authorization": f"Bearer {os.environ.get('ORQ_API_KEY')}"},
    json={
      "model": "typesafe/jev-latest",
      "state": "The package arrived two days late and the box was damaged.",
      "questions": {
        "is_complaint": {
          "type": "noul",
          "instructions": "Does the customer report a problem with their order?",
        }
      },
    },
  )

  print(response.json()["answers"])
  ```

  ```typescript TypeScript theme={"theme":{"light":"github-light","dark":"github-dark"}}
  const response = await fetch("https://my.orq.ai/v3/router/classify", {
    method: "POST",
    headers: {
      "Content-Type": "application/json",
      Authorization: `Bearer ${process.env.ORQ_API_KEY}`,
    },
    body: JSON.stringify({
      model: "typesafe/jev-latest",
      state: "The package arrived two days late and the box was damaged.",
      questions: {
        is_complaint: {
          type: "noul",
          instructions: "Does the customer report a problem with their order?",
        },
      },
    }),
  });

  console.log((await response.json()).answers);
  ```
</CodeGroup>

OpenAI GPT-6 Luna and `typesafe/jev-latest` answer natively. Other models in this table answer through structured outputs and report their own probabilities. See [Classify](/ai-gateway/features/classify) for the question types, and the [Create Classify](/reference/classify/create-classify) reference for the full request and response schema.

| Provider | Model |
| - | - |
| Anthropic | `anthropic/claude-haiku-4-5` |
| Anthropic | `anthropic/claude-haiku-4-5-20251001` |
| AWS Bedrock | `aws/au.anthropic.claude-haiku-4-5-20251001-v1:0` |
| AWS Bedrock | `aws/eu.anthropic.claude-haiku-4-5-20251001-v1:0` |
| AWS Bedrock | `aws/global.anthropic.claude-haiku-4-5-20251001-v1:0` |
| AWS Bedrock | `aws/jp.anthropic.claude-haiku-4-5-20251001-v1:0` |
| AWS Bedrock | `aws/qwen.qwen3-32b-v1:0` |
| AWS Bedrock | `aws/us.anthropic.claude-haiku-4-5-20251001-v1:0` |
| Azure | `azure/eu.gpt-5.6-luna` |
| Azure | `azure/global.gpt-5.6-luna` |
| baseten | `baseten/glm-5.3-flash` |
| Cerebras | `cerebras/qwen-3.8-27b` |
| Vertex AI | `google/claude-haiku-4-5` |
| Vertex AI | `google/eu.gemini-3.8-flash` |
| Vertex AI | `google/gemini-3.8-flash` |
| Vertex AI | `google/us.gemini-3.8-flash` |
| Google AI | `google-ai/gemini-3.8-flash` |
| Groq | `groq/openai/gpt-oss-120b` |
| Groq | `groq/openai/gpt-oss-20b` |
| Groq | `groq/openai/gpt-oss-safeguard-20b` |
| Groq | `groq/qwen/qwen3.8-27b` |
| nebius | `nebius/openai/gpt-oss-120b` |
| nebius | `nebius/zai-org/GLM-5.3-Flash` |
| OpenAI | `openai/eu.gpt-5.6-luna` |
| OpenAI | `openai/eu.gpt-6-luna` |
| OpenAI | `openai/gpt-5.6-luna` |
| OpenAI | `openai/gpt-6-luna` |
| tensorix | `tensorix/openai/gpt-oss-120b` |
| tensorix | `tensorix/openai/gpt-oss-20b` |
| tensorix | `tensorix/z-ai/glm-5.3-flash` |
| TypeSafe | `typesafe/jev-latest` |
| Wafer | `wafer/GLM-5.3-Flash` |
| Z AI | `zai/glm-5.3-flash` |

### Rerank models

<CodeGroup>
  ```bash cURL theme={"theme":{"light":"github-light","dark":"github-dark"}}
  curl https://my.orq.ai/v3/router/rerank \
    -H "Content-Type: application/json" \
    -H "Authorization: Bearer $ORQ_API_KEY" \
    -d '{
      "model": "cohere/rerank-v4.0-pro",
      "query": "What is machine learning?",
      "documents": [
        "Machine learning is a branch of AI",
        "Machine learning uses data to improve",
        "AI is changing the world"
      ]
    }'
  ```
</CodeGroup>

| Provider | Model |
| - | - |
| AWS Bedrock | `aws/amazon.rerank-v1:0` |
| Cohere | `cohere/rerank-english-v3.0` |
| Cohere | `cohere/rerank-multilingual-v3.0` |
| Cohere | `cohere/rerank-v3.5` |
| Cohere | `cohere/rerank-v4.0-fast` |
| Cohere | `cohere/rerank-v4.0-pro` |
| greenpt | `greenpt/green-rerank` |
| Jina AI | `jina/jina-colbert-v2` |
| Jina AI | `jina/jina-reranker-m0` |
| Jina AI | `jina/jina-reranker-v1-base-en` |
| Jina AI | `jina/jina-reranker-v1-tiny-en` |
| Jina AI | `jina/jina-reranker-v1-turbo-en` |
| Jina AI | `jina/jina-reranker-v2-base-multilingual` |
| Jina AI | `jina/jina-reranker-v3` |
| Jina AI | `jina/jina-reranker-v3.5` |

### OCR models

<CodeGroup>
  ```bash cURL theme={"theme":{"light":"github-light","dark":"github-dark"}}
  curl https://my.orq.ai/v3/router/ocr \
    -H "Content-Type: application/json" \
    -H "Authorization: Bearer $ORQ_API_KEY" \
    -d '{
      "model": "mistral/mistral-ocr-4-0",
      "document": {
        "type": "document_url",
        "document_url": "https://example.com/document.pdf"
      }
    }'
  ```
</CodeGroup>

| Provider | Model |
| - | - |
| Mistral | `mistral/mistral-ocr-4-0` |

### Speech-to-Text models

<CodeGroup>
  ```bash cURL theme={"theme":{"light":"github-light","dark":"github-dark"}}
  curl https://my.orq.ai/v3/router/audio/transcriptions \
    -H "Authorization: Bearer $ORQ_API_KEY" \
    -F file="@/path/to/audio.mp3" \
    -F model="openai/gpt-4o-transcribe"
  ```

  ```python Python theme={"theme":{"light":"github-light","dark":"github-dark"}}
  from openai import OpenAI
  import os

  client = OpenAI(
    base_url="https://my.orq.ai/v3/router",
    api_key=os.getenv("ORQ_API_KEY"),
  )

  audio_file = open("speech.mp3", "rb")
  transcript = client.audio.transcriptions.create(
    model="openai/gpt-4o-transcribe",
    file=audio_file
  )

  print(transcript.text)
  ```

  ```typescript TypeScript theme={"theme":{"light":"github-light","dark":"github-dark"}}
  import OpenAI from "openai";
  import fs from "fs";

  const client = new OpenAI({
    baseURL: 'https://my.orq.ai/v3/router',
    apiKey: process.env.ORQ_API_KEY,
  });

  async function main() {
    const transcript = await client.audio.transcriptions.create({
      file: fs.createReadStream("speech.mp3"),
      model: "openai/gpt-4o-transcribe",
    });

    console.log(transcript.text);
  }

  main();
  ```
</CodeGroup>

| Provider | Model |
| - | - |
| Azure | `azure/whisper` |
| Eleven Labs | `elevenlabs/scribe_v2` |
| Google AI | `google-ai/gemini-3.5-transcribe` |
| Google AI | `google-ai/gemini-3.5-transcribe-live` |
| greenpt | `greenpt/green-s` |
| greenpt | `greenpt/green-s-pro` |
| Groq | `groq/whisper-large-v3` |
| Groq | `groq/whisper-large-v3-turbo` |
| meta | `meta/muse-voice-transcribe-1.0` |
| Mistral | `mistral/voxtral-mini-2507` |
| Mistral | `mistral/voxtral-mini-2602` |
| Mistral | `mistral/voxtral-mini-transcribe-realtime-2602` |
| OpenAI | `openai/eu.gpt-4o-mini-transcribe` |
| OpenAI | `openai/eu.gpt-4o-transcribe` |
| OpenAI | `openai/eu.whisper-1` |
| OpenAI | `openai/gpt-4o-mini-transcribe` |
| OpenAI | `openai/gpt-4o-mini-transcribe-2025-03-20` |
| OpenAI | `openai/gpt-4o-mini-transcribe-2025-12-15` |
| OpenAI | `openai/gpt-4o-transcribe` |
| OpenAI | `openai/gpt-4o-transcribe-diarize` |
| OpenAI | `openai/gpt-live-transcribe` |
| OpenAI | `openai/gpt-realtime-whisper` |
| OpenAI | `openai/gpt-transcribe` |
| OpenAI | `openai/whisper-1` |
| reson8 | `reson8/prerecorded` |
| scaleway | `scaleway/whisper-large-v3` |
| tensorix | `tensorix/Systran/faster-whisper-large-v3` |
| Together AI | `togetherai/nvidia/parakeet-tdt-0.6b-v3` |
| Together AI | `togetherai/openai/whisper-large-v3` |

### Text-to-Speech models

<CodeGroup>
  ```bash cURL theme={"theme":{"light":"github-light","dark":"github-dark"}}
  curl https://my.orq.ai/v3/router/audio/speech \
    -H "Authorization: Bearer $ORQ_API_KEY" \
    -H "Content-Type: application/json" \
    -d '{
      "model": "openai/gpt-4o-mini-tts",
      "input": "Hello world!",
      "voice": "alloy"
    }' --output speech.mp3
  ```

  ```python Python theme={"theme":{"light":"github-light","dark":"github-dark"}}
  from openai import OpenAI
  import os

  client = OpenAI(
    base_url="https://my.orq.ai/v3/router",
    api_key=os.getenv("ORQ_API_KEY"),
  )

  response = client.audio.speech.create(
    model="openai/gpt-4o-mini-tts",
    voice="alloy",
    input="Hello world!"
  )

  response.stream_to_file("speech.mp3")
  ```

  ```typescript TypeScript theme={"theme":{"light":"github-light","dark":"github-dark"}}
  import OpenAI from "openai";
  import fs from "fs";

  const client = new OpenAI({
    baseURL: 'https://my.orq.ai/v3/router',
    apiKey: process.env.ORQ_API_KEY,
  });

  async function main() {
    const mp3 = await client.audio.speech.create({
      model: "openai/gpt-4o-mini-tts",
      voice: "alloy",
      input: "Hello world!",
    });

    const buffer = Buffer.from(await mp3.arrayBuffer());
    await fs.promises.writeFile("speech.mp3", buffer);
  }

  main();
  ```
</CodeGroup>

| Provider | Model |
| - | - |
| Eleven Labs | `elevenlabs/eleven_flash_v2` |
| Eleven Labs | `elevenlabs/eleven_flash_v2_5` |
| Eleven Labs | `elevenlabs/eleven_multilingual_v2` |
| Eleven Labs | `elevenlabs/eleven_turbo_v2_5` |
| Eleven Labs | `elevenlabs/eleven_v3` |
| Vertex AI | `google/gemini-2.5-flash-preview-tts` |
| Vertex AI | `google/gemini-2.5-pro-preview-tts` |
| Google AI | `google-ai/gemini-2.5-flash-preview-tts` |
| Google AI | `google-ai/gemini-2.5-pro-preview-tts` |
| Google AI | `google-ai/gemini-3.1-flash-tts-preview` |
| Groq | `groq/canopylabs/orpheus-arabic-saudi` |
| Groq | `groq/canopylabs/orpheus-v1-english` |
| Mistral | `mistral/voxtral-mini-tts-2603` |
| OpenAI | `openai/eu.gpt-4o-mini-tts` |
| OpenAI | `openai/eu.tts-1` |
| OpenAI | `openai/eu.tts-1-hd` |
| OpenAI | `openai/gpt-4o-mini-tts` |
| OpenAI | `openai/gpt-4o-mini-tts-2025-03-20` |
| OpenAI | `openai/gpt-4o-mini-tts-2025-12-15` |
| OpenAI | `openai/tts-1` |
| OpenAI | `openai/tts-1-hd` |
| tensorix | `tensorix/chatterbox-turbo` |
| Together AI | `togetherai/canopylabs/orpheus-3b-0.1-ft` |
| Together AI | `togetherai/cartesia/sonic-2` |
| Together AI | `togetherai/cartesia/sonic-3` |
| Together AI | `togetherai/hexgrad/Kokoro-82M` |

#### Text-to-Speech Voices

The following voices are available for Text-to-Speech models:

#### OpenAI

* `alloy`: Neutral, versatile voice
* `echo`: Neutral, soft-spoken voice
* `fable`: Expressive, narrative-focused voice
* `onyx`: Deep, authoritative voice
* `nova`: Warm, natural voice
* `shimmer`: Clear, optimistic voice

#### ElevenLabs

* `aria`: Neutral, versatile voice
* `roger`: Deep, authoritative voice
* `sarah`: Warm, friendly voice
* `laura`: Soft, gentle voice
* `charlie`: Casual, conversational voice
* `george`: Professional, articulate voice
* `callum`: Youthful, energetic voice
* `river`: Calm, soothing voice
* `liam`: Clear, confident voice
* `charlotte`: Elegant, refined voice
* `alice`: Bright, cheerful voice
* `matilda`: Thoughtful, measured voice
* `will`: Reliable, trustworthy voice
* `jessica`: Engaging, expressive voice
* `eric`: Authoritative, commanding voice
* `chris`: Friendly, approachable voice
* `brian`: Mature, distinguished voice
* `daniel`: Versatile, balanced voice
* `lily`: Sweet, melodious voice
* `bill`: Grounded, authentic voice

***

[Retries & Error Handling](/ai-gateway/features/retries)

[Streaming](/ai-gateway/features/streaming)


This documentation is built and hosted on [Mintlify](https://mintlify.com), a developer documentation platform.