模型与价格
本页展示 Xima AI 当前公开支持的模型和按量价格。模型名称、可用状态和最终扣费以 Xima AI 控制台 与控制台用量明细为准。
价格最近校准时间:2026-08-07,来源为控制台公开 pricing 数据。
API 新接入请使用 Base URL:https://api-long.xima.ai/v1。控制台登录、价格查看和日志排查仍使用 https://console.xima.ai/。
价格口径
- 文本、多模态和 Embedding 模型按每
1M tokens展示输入、输出、缓存读取和缓存创建价格。 -表示当前公开价格中未展示该计费项,或该模型不适用该计费项。- 同一价格项出现多个条件时,表示该模型按条件分档计费,例如
≤200K: $2.00、>200K: $4.00。 - Gemini image 模型的输出价会区分文本输出和图片输出;如果控制台没有展示图片输出价,则图片输出 token 按普通输出价计费。
- 视频模型按秒展示基础价格。Veo 系列还会根据视频秒数、分辨率和是否生成音频折算最终费用。
- 生产对账请以控制台日志和用量明细为准。
企业级与代理级价格
以下表格为公开按量价格。企业级客户、代理级客户或高用量场景,可以单独联系 Xima AI 商讨价格、额度和结算方式。
如有较大需求量,请联系 support@xima.ai。
OpenAI 兼容与 Azure
| 模型 ID | 输入价 | 输出价 | 缓存读取价 | 缓存创建价 | 支持接口 |
|---|---|---|---|---|---|
azure/gpt-5.4 | $2.50/1M | $15.00/1M | $0.25/1M | - | OpenAI |
azure/gpt-5.4-mini | $0.75/1M | $4.50/1M | $0.075/1M | - | OpenAI |
azure/gpt-5.3-chat | $1.75/1M | $14.00/1M | $0.175/1M | - | OpenAI |
azure/gpt-5.3-codex | $1.75/1M | $14.00/1M | $0.18/1M | - | OpenAI |
Claude
Claude 模型同时支持 OpenAI-compatible Chat Completions 和 Anthropic native Messages。高级能力接入请阅读 Claude 高级能力接入说明。
| 模型 ID | 输入价 | 输出价 | 缓存读取价 | 缓存创建价 | 支持接口 |
|---|---|---|---|---|---|
xima/claude-haiku-4-5-20251001 | $1.00/1M | $5.00/1M | $0.10/1M | $1.25/1M | Anthropic, OpenAI |
xima/claude-sonnet-4-6 | $3.00/1M | $15.00/1M | $0.30/1M | $3.75/1M | Anthropic, OpenAI |
xima/claude-sonnet-5 | $2.00/1M | $10.00/1M | $0.20/1M | $2.50/1M | Anthropic, OpenAI |
xima/claude-opus-4-6 | $5.00/1M | $25.00/1M | $0.50/1M | $6.25/1M | Anthropic, OpenAI |
xima/claude-opus-4-7 | $5.00/1M | $25.00/1M | $0.50/1M | $6.25/1M | Anthropic, OpenAI |
xima/claude-opus-4-8 | $5.00/1M | $25.00/1M | $0.50/1M | $6.25/1M | Anthropic, OpenAI |
xima/claude-opus-5 | $5.00/1M | $25.00/1M | $0.50/1M | $6.25/1M | Anthropic, OpenAI |
Gemini
Gemini Pro 的长上下文分档和 Gemini image 的图片输出价格直接写在对应价格项中。模型可用状态和最终扣费以控制台为准。
| 模型 ID | 输入价 | 输出价 | 缓存读取价 | 缓存创建价 | 支持接口 |
|---|---|---|---|---|---|
gemini-2.5-flash | $0.30/1M | $2.50/1M | $0.03/1M | $1.00/1M | Gemini, OpenAI |
xima/gemini-2.5-flash | $0.30/1M | $2.502/1M | $0.03/1M | - | OpenAI |
xima/gemini-2.5-pro | ≤200K: $1.25/1M; >200K: $2.50/1M | ≤200K: $10.00/1M; >200K: $15.00/1M | ≤200K: $0.13/1M; >200K: $0.25/1M | - | OpenAI |
gemini-3-flash-preview | $0.50/1M | $3.00/1M | $0.05/1M | $1.00/1M | Gemini, OpenAI |
xima/gemini-3-flash-preview | $0.50/1M | $3.00/1M | $0.05/1M | - | OpenAI |
gemini-3.1-pro-preview | ≤200K: $2.00/1M; >200K: $4.00/1M | ≤200K: $12.00/1M; >200K: $18.00/1M | ≤200K: $0.20/1M; >200K: $0.40/1M | ≤200K: $2.00/1M; >200K: $4.00/1M | Gemini, OpenAI |
xima/gemini-3.1-pro-preview | ≤200K: $2.00/1M; >200K: $4.00/1M | ≤200K: $12.00/1M; >200K: $18.00/1M | ≤200K: $0.20/1M; >200K: $0.40/1M | - | OpenAI |
gemini-3.5-flash | $1.50/1M | $9.00/1M | $0.15/1M | - | Gemini, OpenAI |
xima/gemini-3.5-flash | $1.50/1M | $9.00/1M | $0.15/1M | - | OpenAI |
xima/gemini-3.5-flash-lite | $0.30/1M | $2.50/1M | $0.03/1M | - | OpenAI |
xima/gemini-3.6-flash | $1.50/1M | $7.50/1M | $0.15/1M | - | OpenAI |
gemini-3.1-flash-image-preview | Text/Image: $0.50/1M | Text/Thinking: $3.00/1M; Image: $60.00/1M | - | - | Gemini, OpenAI |
gemini-3-pro-image-preview | Text/Image: $2.00/1M | Text/Thinking: $12.00/1M; Image: $120.00/1M | - | - | Gemini, OpenAI |
DeepSeek
| 模型 ID | 输入价 | 输出价 | 缓存读取价 | 缓存创建价 | 支持接口 |
|---|---|---|---|---|---|
deepseek-v4-pro | $0.435/1M | $0.87/1M | $0.003625/1M | - | OpenAI |
deepseek-v4-flash | $0.14/1M | $0.28/1M | $0.0028/1M | - | OpenAI |
GLM / Qwen
| 模型 ID | 输入价 | 输出价 | 缓存读取价 | 缓存创建价 | 支持接口 |
|---|---|---|---|---|---|
xima/glm-5.1 | $0.84/1M | $3.36/1M | - | - | OpenAI |
xima/glm-5 | $0.56/1M | $2.52/1M | - | - | OpenAI |
xima/qwen3.6-plus | $0.28/1M | $1.68/1M | - | - | OpenAI |
xima/qwen3.5-plus | $0.11/1M | $0.67/1M | - | - | OpenAI |
xima/qwen3.5-flash | $0.03/1M | $0.28/1M | - | - | OpenAI |
Embedding
| 模型 ID | 输入价 | 输出价 | 缓存读取价 | 缓存创建价 | 支持接口 |
|---|---|---|---|---|---|
azure/text-embedding-3-small | $0.02/1M | - | - | - | Embeddings |
图片生成
| 模型 ID | 输入价 | 输出价 | 图片输入价 | 缓存读取价 | 支持接口 |
|---|---|---|---|---|---|
azure/gpt-image-2 | $5.00/1M | $30.00/1M | $8.00/1M | $1.25/1M | Image generation, Image edit |
视频生成
| 模型 ID | 计费方式 | 基础价格 | 说明 |
|---|---|---|---|
veo-3.1-lite-generate-001 | 按秒计费 | 0.03/秒 | Veo 720p Video-only 基础价,最终费用会按视频秒数、分辨率和 generateAudio 折算 |
veo-3.1-fast-generate-001 | 按秒计费 | 0.08/秒 | Veo 720p Video-only 基础价,最终费用会按视频秒数、分辨率和 generateAudio 折算 |
veo-3.1-generate-001 | 按秒计费 | 0.20/秒 | Veo 720p Video-only 基础价,最终费用会按视频秒数、分辨率和 generateAudio 折算 |
veo-3.0-fast-generate-001 | 按秒计费 | 0.08/秒 | Veo 720p Video-only 基础价,最终费用会按视频秒数、分辨率和 generateAudio 折算 |
veo-3.0-generate-001 | 按秒计费 | 0.20/秒 | Veo 720p Video-only 基础价,最终费用会按视频秒数、分辨率和 generateAudio 折算 |
xima/doubao-seedance-2-0-fast-260128 | 按秒计费 | 0.20/秒 | Seedance 视频生成 |
xima/doubao-seedance-2-0-260128 | 按秒计费 | 0.50/秒 | Seedance 视频生成 |
计费说明
- 文本模型通常按输入、输出、缓存读取和缓存创建分别计费。
- Embedding 模型只按输入 tokens 计费。
- 多模态模型的图片、音频、缓存等价格项可能因模型能力不同而不同,请以控制台展示为准。
- Short / Long 分档模型请按请求总输入 tokens 预估成本,长上下文、多轮对话和大文件分析会更容易进入 Long 档。
- 视频模型按任务结果的秒数、清晰度和音频配置计算,提交任务前建议在业务侧明确时长、分辨率和失败重试策略。
- 企业级、代理级或高用量需求可以联系 support@xima.ai 单独商讨价格。
- 最终扣费以控制台用量明细为准。