> For the complete documentation index, see [llms.txt](https://docs.nexos.ai/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.nexos.ai/models/readme.md).

# Models

<mark style="color:$primary;">Explore all available models in nexos.ai; we suggest using search if you have a specific model in mind - unless you'd like to read about 99+ models.</mark>

## nexos.ai Recommended Models

We focus on a select group of recommended models to guarantee full feature support and superior result quality. By using these models, you can access nexos.ai's complete capabilities: **document generation, deep research, and tool integrations** (Slack, Jira, Confluence, GitHub, and more) - ensuring the best possible performance and stability.

<table data-view="cards"><thead><tr><th align="center"></th><th></th><th></th><th></th><th></th><th></th></tr></thead><tbody><tr><td align="center"><strong>Anthropic</strong></td><td><ul><li>Claude Haiku 4.5</li></ul></td><td><ul><li>Claude Sonnet 4.6</li></ul></td><td><ul><li>Claude Opus 4.7</li></ul></td><td><ul><li>Claude Opus 4.8</li></ul></td><td><ul><li>Claude Sonnet 5</li></ul></td></tr><tr><td align="center"><strong>Google</strong></td><td><ul><li>Gemini 3 Flash Preview</li></ul></td><td><ul><li>Gemini 3.1 Pro Preview</li></ul></td><td><ul><li>Gemini 3.5 Flash</li></ul></td><td></td><td></td></tr><tr><td align="center"><strong>OpenAI</strong></td><td><ul><li>GPT 5.4 mini</li></ul></td><td><ul><li>GPT-OSS 120b</li></ul></td><td><ul><li>GPT 5.5</li></ul></td><td><ul><li>GPT 5.6 Terra</li></ul></td><td><ul><li>GPT 5.6 Sol</li></ul></td></tr></tbody></table>

### All Models

<details>

<summary>Annotations</summary>

<table><thead><tr><th width="241.03125"></th><th></th></tr></thead><tbody><tr><td><strong>Model</strong></td><td>Name of the model variant (includes version or size).</td></tr><tr><td><strong>Hosted</strong></td><td>Platform where the model is served (e.g. Azure, Bedrock, nexos.ai).</td></tr><tr><td><strong>Developer</strong></td><td>Organization that created the model (e.g. OpenAI, Meta, Google).</td></tr><tr><td><strong>Region</strong></td><td>Deployment location. <strong>EU</strong> = Europe, <strong>US</strong> = United States, <strong>OTHER</strong> = global or unspecified region.</td></tr><tr><td><strong>Info used for model training</strong></td><td>Indicates whether user inputs and model outputs are used to improve or retrain the model.</td></tr><tr><td><strong>Data Retention Period (days)</strong></td><td>Number of days that user inputs and model outputs are stored by the provider before automatic deletion.</td></tr><tr><td><strong>Input cost per 1M tokens</strong></td><td>Price for 1 million tokens sent to the model as input.</td></tr><tr><td><strong>Output cost per 1M tokens</strong></td><td>Price for 1 million tokens generated by the model as output.</td></tr><tr><td><strong>Cost per image</strong></td><td>Price per image generated by the model.</td></tr><tr><td><strong>Long context boundary</strong></td><td>Token threshold beyond which long-context pricing rates apply.</td></tr><tr><td><strong>Long context input cost per 1M tokens</strong></td><td>Price for 1 million input tokens when context length exceeds the boundary.</td></tr><tr><td><strong>Long context output cost per 1M tokens</strong></td><td>Price for 1 million output tokens when context length exceeds the boundary.</td></tr><tr><td><strong>Cache creation cost per 1M tokens</strong></td><td>Price for storing 1 million tokens in prompt cache.</td></tr><tr><td><strong>Cached input cost per 1M tokens</strong></td><td>Price for 1 million input tokens retrieved from prompt cache.</td></tr><tr><td><strong>Input cost per audio second</strong></td><td>Price for every second of audio input processed by the model.</td></tr></tbody></table>

</details>

{% hint style="info" %}
You may enable or disable large language models (LLMs) at your discretion and are solely responsible for such choice. Information about the LLMs below is sourced from publicly available terms and may change without notice. We strive to provide accurate information but make no guarantees. We encourage you to review official provider terms to verify all details.
{% endhint %}

<details>

<summary>Hosted by nexos.ai</summary>

**OpenAI**

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT-OSS 120b</td></tr><tr><td>Hosted</td><td>nexos.ai</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.8</td></tr><tr><td>Output cost per 1M tokens</td><td>$1.6</td></tr></tbody></table>

</details>

<details>

<summary>Alibaba</summary>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Qwen 3.7 Plus</td></tr><tr><td>Hosted</td><td>Fireworks AI</td></tr><tr><td>Developer</td><td>Alibaba</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.4</td></tr><tr><td>Output cost per 1M tokens</td><td>$1.6</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.08</td></tr></tbody></table>

</details>

<details>

<summary>Amazon</summary>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Nova Lite</td></tr><tr><td>Hosted</td><td>Bedrock</td></tr><tr><td>Developer</td><td>Amazon</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.078</td></tr><tr><td>Output cost per 1M tokens</td><td>$0.312</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.0195</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Nova Pro</td></tr><tr><td>Hosted</td><td>Bedrock</td></tr><tr><td>Developer</td><td>Amazon</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.05</td></tr><tr><td>Output cost per 1M tokens</td><td>$4.2</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.2625</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Nova 2 Lite</td></tr><tr><td>Hosted</td><td>Bedrock</td></tr><tr><td>Developer</td><td>Amazon</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.43</td></tr><tr><td>Output cost per 1M tokens</td><td>$3.597</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Nova Lite</td></tr><tr><td>Hosted</td><td>Bedrock</td></tr><tr><td>Developer</td><td>Amazon</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.06</td></tr><tr><td>Output cost per 1M tokens</td><td>$0.24</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.015</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Nova Pro</td></tr><tr><td>Hosted</td><td>Bedrock</td></tr><tr><td>Developer</td><td>Amazon</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.8</td></tr><tr><td>Output cost per 1M tokens</td><td>$3.2</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.2</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Nova Premier</td></tr><tr><td>Hosted</td><td>Bedrock</td></tr><tr><td>Developer</td><td>Amazon</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$2.5</td></tr><tr><td>Output cost per 1M tokens</td><td>$12.5</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Nova 2 Lite</td></tr><tr><td>Hosted</td><td>Bedrock</td></tr><tr><td>Developer</td><td>Amazon</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.33</td></tr><tr><td>Output cost per 1M tokens</td><td>$2.75</td></tr></tbody></table>

</details>

<details>

<summary>Anthropic</summary>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Sonnet 4.5</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$3.3</td></tr><tr><td>Output cost per 1M tokens</td><td>$16.5</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$4.13</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.33</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$6.6</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$24.75</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$8.25</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.66</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Haiku 4.5</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.1</td></tr><tr><td>Output cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$1.375</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.11</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Opus 4.5</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Output cost per 1M tokens</td><td>$27.5</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$6.875</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.55</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Sonnet 4.5</td></tr><tr><td>Hosted</td><td>Anthropic</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>30</td></tr><tr><td>Input cost per 1M tokens</td><td>$3</td></tr><tr><td>Output cost per 1M tokens</td><td>$15</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$3.75</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.3</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Sonnet 4.5</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$3</td></tr><tr><td>Output cost per 1M tokens</td><td>$15</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$3.75</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.3</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$6</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$22.5</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$7.5</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.6</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Haiku 4.5</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.1</td></tr><tr><td>Output cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$1.375</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.11</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Haiku 4.5</td></tr><tr><td>Hosted</td><td>Anthropic</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>30</td></tr><tr><td>Input cost per 1M tokens</td><td>$1</td></tr><tr><td>Output cost per 1M tokens</td><td>$5</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$1.25</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.1</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Opus 4.5</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$5</td></tr><tr><td>Output cost per 1M tokens</td><td>$25</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$6.25</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.5</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Opus 4.6</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Output cost per 1M tokens</td><td>$27.5</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$6.875</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.55</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$27.5</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$6.875</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.55</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Sonnet 4.6</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$3.3</td></tr><tr><td>Output cost per 1M tokens</td><td>$16.5</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$4.13</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.33</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$3.3</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$16.5</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$4.13</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.33</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Sonnet 4.6</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$3</td></tr><tr><td>Output cost per 1M tokens</td><td>$15</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$3.75</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.3</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$3</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$15</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$3.75</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.3</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Opus 4.7</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Output cost per 1M tokens</td><td>$27.5</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$6.875</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.55</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$27.5</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$6.875</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.55</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Opus 4.8</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Output cost per 1M tokens</td><td>$27.5</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$6.875</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.55</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$27.5</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$6.875</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.55</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Opus 4.8</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$5</td></tr><tr><td>Output cost per 1M tokens</td><td>$25</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$6.25</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.5</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$5</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$25</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$6.25</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.5</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Sonnet 5</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$2.2</td></tr><tr><td>Output cost per 1M tokens</td><td>$11</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$2.75</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.22</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$2.2</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$11</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$2.75</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.22</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Sonnet 5</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$2</td></tr><tr><td>Output cost per 1M tokens</td><td>$10</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$2.5</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.2</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$2</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$10</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$2.5</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.2</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Fable 5</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>60</td></tr><tr><td>Input cost per 1M tokens</td><td>$11</td></tr><tr><td>Output cost per 1M tokens</td><td>$55</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$13.75</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$1.1</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$11</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$55</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$13.75</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$1.1</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Fable 5</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>60</td></tr><tr><td>Input cost per 1M tokens</td><td>$10</td></tr><tr><td>Output cost per 1M tokens</td><td>$50</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$12.5</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$1</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$10</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$50</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$12.5</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$1</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Opus 4.5</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Output cost per 1M tokens</td><td>$27.5</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$6.875</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.55</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Opus 4.6</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Output cost per 1M tokens</td><td>$27.5</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$6.875</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.55</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$27.5</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$6.875</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.55</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Opus 4.7</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Output cost per 1M tokens</td><td>$27.5</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$6.875</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.55</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$27.5</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$6.875</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.55</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Opus 4.8</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Output cost per 1M tokens</td><td>$27.5</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$6.875</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.55</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$27.5</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$6.875</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.55</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Sonnet 4.6</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$3.3</td></tr><tr><td>Output cost per 1M tokens</td><td>$16.5</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$4.13</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.33</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$3.3</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$16.5</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$4.13</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.33</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Sonnet 5</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$2.2</td></tr><tr><td>Output cost per 1M tokens</td><td>$11</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$2.75</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.22</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$2.2</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$11</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$2.75</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.22</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Claude Fable 5</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Anthropic</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>60</td></tr><tr><td>Input cost per 1M tokens</td><td>$11</td></tr><tr><td>Output cost per 1M tokens</td><td>$55</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$13.75</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$1.1</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$11</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$55</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$13.75</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$1.1</td></tr></tbody></table>

</details>

<details>

<summary>Black Forest Labs</summary>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>FLUX 1.1 Pro</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>Black Forest Labs</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Cost per image</td><td>$0.044</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>FLUX 1.1 Pro</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>Black Forest Labs</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Cost per image</td><td>$0.044</td></tr></tbody></table>

</details>

<details>

<summary>DeepSeek</summary>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>DeepSeek V4 Flash</td></tr><tr><td>Hosted</td><td>Fireworks AI</td></tr><tr><td>Developer</td><td>DeepSeek</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.14</td></tr><tr><td>Output cost per 1M tokens</td><td>$0.28</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.028</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>DeepSeek V4 Pro</td></tr><tr><td>Hosted</td><td>Fireworks AI</td></tr><tr><td>Developer</td><td>DeepSeek</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.74</td></tr><tr><td>Output cost per 1M tokens</td><td>$3.48</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.145</td></tr></tbody></table>

</details>

<details>

<summary>Google</summary>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Gemini 2.5 Flash Lite</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.1</td></tr><tr><td>Output cost per 1M tokens</td><td>$0.4</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.01</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$0.1</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$0.4</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.01</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Gemini 2.5 Pro</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.25</td></tr><tr><td>Output cost per 1M tokens</td><td>$10</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.13</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$2.5</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$15</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.25</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Gemini 2.5 Flash</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.3</td></tr><tr><td>Output cost per 1M tokens</td><td>$2.5</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.03</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$0.3</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$2.5</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.03</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Imagen 4</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Cost per image</td><td>$0.04</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Imagen 4 Fast</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Cost per image</td><td>$0.02</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Imagen 4 Ultra</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Cost per image</td><td>$0.06</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Gemini 2.5 Pro</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.25</td></tr><tr><td>Output cost per 1M tokens</td><td>$10</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.13</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$2.5</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$15</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.25</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Gemini 2.5 Flash Lite</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.1</td></tr><tr><td>Output cost per 1M tokens</td><td>$0.4</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.01</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$0.1</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$0.4</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.01</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Gemini 2.5 Flash</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.3</td></tr><tr><td>Output cost per 1M tokens</td><td>$2.5</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.03</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$0.3</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$2.5</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.03</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Gemini 3 Flash Preview</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.5</td></tr><tr><td>Output cost per 1M tokens</td><td>$3</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.05</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$0.5</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$3</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.05</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Gemini 2.5 Pro</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.25</td></tr><tr><td>Output cost per 1M tokens</td><td>$10</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.13</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$2.5</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$15</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.25</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Gemini 2.5 Flash</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.3</td></tr><tr><td>Output cost per 1M tokens</td><td>$2.5</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.03</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$0.3</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$2.5</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.03</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Gemini 2.5 Flash Lite</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.1</td></tr><tr><td>Output cost per 1M tokens</td><td>$0.4</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.01</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$0.1</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$0.4</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.01</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Imagen 4</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Cost per image</td><td>$0.04</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Imagen 4 Fast</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Cost per image</td><td>$0.02</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Imagen 4 Ultra</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Cost per image</td><td>$0.06</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Gemini 3.1 Pro Preview</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$2</td></tr><tr><td>Output cost per 1M tokens</td><td>$12</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.2</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$4</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$18</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.4</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Gemini 3.1 Flash Lite</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.25</td></tr><tr><td>Output cost per 1M tokens</td><td>$1.5</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.025</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$0.25</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$1.5</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.025</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Gemini 3.1 Flash Lite</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.275</td></tr><tr><td>Output cost per 1M tokens</td><td>$1.65</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.0275</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$0.275</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$1.65</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.0275</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Gemini 3.5 Flash</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.65</td></tr><tr><td>Output cost per 1M tokens</td><td>$9.9</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.165</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$1.65</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$9.9</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.165</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Gemini 3.5 Flash</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.5</td></tr><tr><td>Output cost per 1M tokens</td><td>$9</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.15</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$1.5</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$9</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.15</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Gemini 3.1 Flash Lite</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.275</td></tr><tr><td>Output cost per 1M tokens</td><td>$1.65</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.0275</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$0.275</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$1.65</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.0275</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Gemini 3.5 Flash</td></tr><tr><td>Hosted</td><td>Agent Platform (Vertex AI)</td></tr><tr><td>Developer</td><td>Google</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>1</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.65</td></tr><tr><td>Output cost per 1M tokens</td><td>$9.9</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.165</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$1.65</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$9.9</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.165</td></tr></tbody></table>

</details>

<details>

<summary>MiniMax</summary>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>MiniMax M2.7</td></tr><tr><td>Hosted</td><td>Fireworks AI</td></tr><tr><td>Developer</td><td>MiniMax</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.3</td></tr><tr><td>Output cost per 1M tokens</td><td>$1.2</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.059</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>MiniMax M3</td></tr><tr><td>Hosted</td><td>Fireworks AI</td></tr><tr><td>Developer</td><td>MiniMax</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.3</td></tr><tr><td>Output cost per 1M tokens</td><td>$1.2</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.059</td></tr></tbody></table>

</details>

<details>

<summary>Mistral AI</summary>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Mistral Medium 3</td></tr><tr><td>Hosted</td><td>Mistral AI</td></tr><tr><td>Developer</td><td>Mistral AI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.4</td></tr><tr><td>Output cost per 1M tokens</td><td>$2</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.04</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Codestral</td></tr><tr><td>Hosted</td><td>Mistral AI</td></tr><tr><td>Developer</td><td>Mistral AI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.3</td></tr><tr><td>Output cost per 1M tokens</td><td>$0.9</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.03</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Mistral Medium 3.1</td></tr><tr><td>Hosted</td><td>Mistral AI</td></tr><tr><td>Developer</td><td>Mistral AI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.4</td></tr><tr><td>Output cost per 1M tokens</td><td>$2</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.04</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Mistral Large 3</td></tr><tr><td>Hosted</td><td>Mistral AI</td></tr><tr><td>Developer</td><td>Mistral AI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.5</td></tr><tr><td>Output cost per 1M tokens</td><td>$1.5</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.05</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Devstral 2</td></tr><tr><td>Hosted</td><td>Mistral AI</td></tr><tr><td>Developer</td><td>Mistral AI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.4</td></tr><tr><td>Output cost per 1M tokens</td><td>$2</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.04</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Mistral Small 4</td></tr><tr><td>Hosted</td><td>Mistral AI</td></tr><tr><td>Developer</td><td>Mistral AI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.15</td></tr><tr><td>Output cost per 1M tokens</td><td>$0.6</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.015</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Mistral Medium 3.5</td></tr><tr><td>Hosted</td><td>Mistral AI</td></tr><tr><td>Developer</td><td>Mistral AI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.5</td></tr><tr><td>Output cost per 1M tokens</td><td>$7.5</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.15</td></tr></tbody></table>

</details>

<details>

<summary>Moonshot AI</summary>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Kimi K2.6</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>Moonshot AI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.95</td></tr><tr><td>Output cost per 1M tokens</td><td>$4</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Kimi K2.6</td></tr><tr><td>Hosted</td><td>Fireworks AI</td></tr><tr><td>Developer</td><td>Moonshot AI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.95</td></tr><tr><td>Output cost per 1M tokens</td><td>$4</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.16</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Kimi K2.7 Code</td></tr><tr><td>Hosted</td><td>Fireworks AI</td></tr><tr><td>Developer</td><td>Moonshot AI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.95</td></tr><tr><td>Output cost per 1M tokens</td><td>$4</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.19</td></tr></tbody></table>

</details>

<details>

<summary>OpenAI</summary>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 4.1</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$2.2</td></tr><tr><td>Output cost per 1M tokens</td><td>$8.8</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.55</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 4o</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$2.75</td></tr><tr><td>Output cost per 1M tokens</td><td>$11</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$1.375</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5 mini</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.28</td></tr><tr><td>Output cost per 1M tokens</td><td>$2.2</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.03</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5 nano</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.06</td></tr><tr><td>Output cost per 1M tokens</td><td>$0.44</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.01</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.38</td></tr><tr><td>Output cost per 1M tokens</td><td>$11</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.14</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Text Embedding 3 Large</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.143</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT Image 1 mini</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$2</td></tr><tr><td>Output cost per 1M tokens</td><td>$8</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.2</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.1</td></tr><tr><td>Hosted</td><td>OpenAI</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>30</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.25</td></tr><tr><td>Output cost per 1M tokens</td><td>$10</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.125</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.1</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.38</td></tr><tr><td>Output cost per 1M tokens</td><td>$11</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.14</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Text to Speech 1</td></tr><tr><td>Hosted</td><td>OpenAI</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>30</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.2</td></tr><tr><td>Hosted</td><td>OpenAI</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>30</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.75</td></tr><tr><td>Output cost per 1M tokens</td><td>$14</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.175</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.2 Pro</td></tr><tr><td>Hosted</td><td>OpenAI</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>30</td></tr><tr><td>Input cost per 1M tokens</td><td>$21</td></tr><tr><td>Output cost per 1M tokens</td><td>$168</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT Image 1.5</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$5</td></tr><tr><td>Output cost per 1M tokens</td><td>$32</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$1.25</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.2</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.75</td></tr><tr><td>Output cost per 1M tokens</td><td>$14</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.18</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Whisper 1</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per audio second</td><td>$0.00012222</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Text to Speech 1</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 4.1</td></tr><tr><td>Hosted</td><td>OpenAI</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>30</td></tr><tr><td>Input cost per 1M tokens</td><td>$2</td></tr><tr><td>Output cost per 1M tokens</td><td>$8</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.5</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Text Embedding 3 Large</td></tr><tr><td>Hosted</td><td>OpenAI</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>30</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.13</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Text Embedding 3 Small</td></tr><tr><td>Hosted</td><td>OpenAI</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>30</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.02</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Whisper 1</td></tr><tr><td>Hosted</td><td>OpenAI</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>30</td></tr><tr><td>Input cost per audio second</td><td>$0.0001</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 4.1 mini</td></tr><tr><td>Hosted</td><td>OpenAI</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>30</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.4</td></tr><tr><td>Output cost per 1M tokens</td><td>$1.6</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.1</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 4.1 nano</td></tr><tr><td>Hosted</td><td>OpenAI</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>30</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.1</td></tr><tr><td>Output cost per 1M tokens</td><td>$0.4</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.025</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT-OSS 20b</td></tr><tr><td>Hosted</td><td>Groq</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.075</td></tr><tr><td>Output cost per 1M tokens</td><td>$0.3</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.037</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5</td></tr><tr><td>Hosted</td><td>OpenAI</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>30</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.25</td></tr><tr><td>Output cost per 1M tokens</td><td>$10</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.125</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5 mini</td></tr><tr><td>Hosted</td><td>OpenAI</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>30</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.25</td></tr><tr><td>Output cost per 1M tokens</td><td>$2</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.025</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5 nano</td></tr><tr><td>Hosted</td><td>OpenAI</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>30</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.05</td></tr><tr><td>Output cost per 1M tokens</td><td>$0.4</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.005</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5 mini</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.28</td></tr><tr><td>Output cost per 1M tokens</td><td>$2.2</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.03</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 4.1</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$2.2</td></tr><tr><td>Output cost per 1M tokens</td><td>$8.8</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.55</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT-OSS 120b</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.15</td></tr><tr><td>Output cost per 1M tokens</td><td>$0.6</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.25</td></tr><tr><td>Output cost per 1M tokens</td><td>$10</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.13</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Text Embedding 3 Large</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.143</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.1</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.38</td></tr><tr><td>Output cost per 1M tokens</td><td>$11</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.14</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5 nano</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.06</td></tr><tr><td>Output cost per 1M tokens</td><td>$0.44</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.01</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 4o</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$2.75</td></tr><tr><td>Output cost per 1M tokens</td><td>$11</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$1.375</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Whisper 1</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per audio second</td><td>$0.00011111</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 4.1 mini</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.44</td></tr><tr><td>Output cost per 1M tokens</td><td>$1.76</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.11</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.3 Codex</td></tr><tr><td>Hosted</td><td>OpenAI</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>30</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.75</td></tr><tr><td>Output cost per 1M tokens</td><td>$14</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.175</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.4</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$2.5</td></tr><tr><td>Output cost per 1M tokens</td><td>$15</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.25</td></tr><tr><td>Long context boundary</td><td>272,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$5</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$22.5</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.5</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.4 nano</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.2</td></tr><tr><td>Output cost per 1M tokens</td><td>$1.25</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.02</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.4 mini</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.75</td></tr><tr><td>Output cost per 1M tokens</td><td>$4.5</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.08</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT-OSS 120b</td></tr><tr><td>Hosted</td><td>nexos.ai</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.8</td></tr><tr><td>Output cost per 1M tokens</td><td>$1.6</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.5</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$5</td></tr><tr><td>Output cost per 1M tokens</td><td>$30</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.5</td></tr><tr><td>Long context boundary</td><td>272,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$10</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$45</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$1</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.5</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Output cost per 1M tokens</td><td>$33</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.55</td></tr><tr><td>Long context boundary</td><td>272,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$11</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$49.5</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$1.1</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT Image 2</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$5</td></tr><tr><td>Output cost per 1M tokens</td><td>$30</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$1.25</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.4</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$2.75</td></tr><tr><td>Output cost per 1M tokens</td><td>$16.5</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.28</td></tr><tr><td>Long context boundary</td><td>272,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$24.75</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.55</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT Instant Latest</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$5</td></tr><tr><td>Output cost per 1M tokens</td><td>$30</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.5</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Text Embedding 3 Small</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.025</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.4</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$2.75</td></tr><tr><td>Output cost per 1M tokens</td><td>$16.5</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.28</td></tr><tr><td>Long context boundary</td><td>272,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$24.75</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.55</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.5</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Output cost per 1M tokens</td><td>$33</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.55</td></tr><tr><td>Long context boundary</td><td>272,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$11</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$49.5</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$1.1</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Text to Speech 1</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.6 Luna</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.1</td></tr><tr><td>Output cost per 1M tokens</td><td>$6.6</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$1.375</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.11</td></tr><tr><td>Long context boundary</td><td>272,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$2.2</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$9.9</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$2.75</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.22</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.6 Terra</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$2.75</td></tr><tr><td>Output cost per 1M tokens</td><td>$16.5</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$3.4375</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.275</td></tr><tr><td>Long context boundary</td><td>272,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$24.75</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$6.875</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.55</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.6 Sol</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Output cost per 1M tokens</td><td>$33</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$6.875</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.55</td></tr><tr><td>Long context boundary</td><td>272,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$11</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$49.5</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$13.75</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$1.1</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.6 Sol</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Output cost per 1M tokens</td><td>$33</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$6.875</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.55</td></tr><tr><td>Long context boundary</td><td>272,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$11</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$49.5</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$13.75</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$1.1</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.6 Terra</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$2.75</td></tr><tr><td>Output cost per 1M tokens</td><td>$16.5</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$3.4375</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.275</td></tr><tr><td>Long context boundary</td><td>272,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$5.5</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$24.75</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$6.875</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.55</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.6 Luna</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.1</td></tr><tr><td>Output cost per 1M tokens</td><td>$6.6</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$1.375</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.11</td></tr><tr><td>Long context boundary</td><td>272,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$2.2</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$9.9</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$2.75</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.22</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.6 Sol</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$5</td></tr><tr><td>Output cost per 1M tokens</td><td>$30</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$6.25</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.5</td></tr><tr><td>Long context boundary</td><td>272,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$10</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$45</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$12.5</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$1</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.6 Terra</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$2.5</td></tr><tr><td>Output cost per 1M tokens</td><td>$15</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$3.125</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.25</td></tr><tr><td>Long context boundary</td><td>272,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$5</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$22.5</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$6.25</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.5</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GPT 5.6 Luna</td></tr><tr><td>Hosted</td><td>Azure</td></tr><tr><td>Developer</td><td>OpenAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$1</td></tr><tr><td>Output cost per 1M tokens</td><td>$6</td></tr><tr><td>Cache creation cost per 1M tokens</td><td>$1.25</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.1</td></tr><tr><td>Long context boundary</td><td>272,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$2</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$9</td></tr><tr><td>Long context cache creation cost per 1M tokens</td><td>$2.5</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.2</td></tr></tbody></table>

</details>

<details>

<summary>SpaceXAI</summary>

{% hint style="info" %}
Please note that under SpaceXAI’s Agreement, while you retain ownership of your input and output, SpaceXAI is granted a license to use your content to provide the services and enforce its policies, including safety, compliance, and moderation. Additionally, SpaceXAI may create and use de-identified data from your use of the services to improve or develop its products, which it owns, and some user content may be retained temporarily for legal or moderation purposes. Although SpaceXAI is contractually restricted from using your content for model training, the scope of de-identified data use and policy enforcement is defined solely by SpaceXAI and may not fully align with conservative data handling expectations.
{% endhint %}

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Grok 4.3</td></tr><tr><td>Hosted</td><td>SpaceXAI</td></tr><tr><td>Developer</td><td>SpaceXAI</td></tr><tr><td>Region</td><td>EU</td></tr><tr><td>Info used for model training</td><td>—</td></tr><tr><td>Data Retention Period (days)</td><td>—</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.25</td></tr><tr><td>Output cost per 1M tokens</td><td>$2.5</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.2</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$2.5</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$5</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.4</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Grok 4.3</td></tr><tr><td>Hosted</td><td>SpaceXAI</td></tr><tr><td>Developer</td><td>SpaceXAI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>—</td></tr><tr><td>Data Retention Period (days)</td><td>—</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.25</td></tr><tr><td>Output cost per 1M tokens</td><td>$2.5</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.2</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$2.5</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$5</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.4</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Grok 4.3</td></tr><tr><td>Hosted</td><td>SpaceXAI</td></tr><tr><td>Developer</td><td>SpaceXAI</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>—</td></tr><tr><td>Data Retention Period (days)</td><td>—</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.25</td></tr><tr><td>Output cost per 1M tokens</td><td>$2.5</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.2</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$2.5</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$5</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.4</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Grok Build 0.1</td></tr><tr><td>Hosted</td><td>SpaceXAI</td></tr><tr><td>Developer</td><td>SpaceXAI</td></tr><tr><td>Region</td><td>US</td></tr><tr><td>Info used for model training</td><td>—</td></tr><tr><td>Data Retention Period (days)</td><td>—</td></tr><tr><td>Input cost per 1M tokens</td><td>$1</td></tr><tr><td>Output cost per 1M tokens</td><td>$2</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.2</td></tr><tr><td>Long context boundary</td><td>200,000</td></tr><tr><td>Long context input cost per 1M tokens</td><td>$2</td></tr><tr><td>Long context output cost per 1M tokens</td><td>$4</td></tr><tr><td>Long context cached input cost per 1M tokens</td><td>$0.4</td></tr></tbody></table>

</details>

<details>

<summary>StepFun</summary>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>Step 3.5 Flash</td></tr><tr><td>Hosted</td><td>DeepInfra</td></tr><tr><td>Developer</td><td>StepFun</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$0.09</td></tr><tr><td>Output cost per 1M tokens</td><td>$0.3</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.02</td></tr></tbody></table>

</details>

<details>

<summary>Zhipu AI</summary>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GLM 5.1</td></tr><tr><td>Hosted</td><td>Fireworks AI</td></tr><tr><td>Developer</td><td>Zhipu AI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.4</td></tr><tr><td>Output cost per 1M tokens</td><td>$4.4</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.26</td></tr></tbody></table>

<table data-header-hidden data-header-sticky data-search="false"><thead><tr><th></th><th></th></tr></thead><tbody><tr><td>Model</td><td>GLM 5.2</td></tr><tr><td>Hosted</td><td>Fireworks AI</td></tr><tr><td>Developer</td><td>Zhipu AI</td></tr><tr><td>Region</td><td>OTHER</td></tr><tr><td>Info used for model training</td><td>No</td></tr><tr><td>Data Retention Period (days)</td><td>0</td></tr><tr><td>Input cost per 1M tokens</td><td>$1.4</td></tr><tr><td>Output cost per 1M tokens</td><td>$4.4</td></tr><tr><td>Cached input cost per 1M tokens</td><td>$0.14</td></tr></tbody></table>

</details>


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.nexos.ai/models/readme.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
