Skip to content
Ask

模型与价格

本页展示 Xima AI 当前公开支持的模型和按量价格。模型名称、可用状态和最终扣费以 Xima AI 控制台 与控制台用量明细为准。

价格最近校准时间:2026-08-07,来源为控制台公开 pricing 数据。

API 新接入请使用 Base URL:https://api-long.xima.ai/v1。控制台登录、价格查看和日志排查仍使用 https://console.xima.ai/

价格口径

  • 文本、多模态和 Embedding 模型按每 1M tokens 展示输入、输出、缓存读取和缓存创建价格。
  • - 表示当前公开价格中未展示该计费项,或该模型不适用该计费项。
  • 同一价格项出现多个条件时,表示该模型按条件分档计费,例如 ≤200K: $2.00>200K: $4.00
  • Gemini image 模型的输出价会区分文本输出和图片输出;如果控制台没有展示图片输出价,则图片输出 token 按普通输出价计费。
  • 视频模型按秒展示基础价格。Veo 系列还会根据视频秒数、分辨率和是否生成音频折算最终费用。
  • 生产对账请以控制台日志和用量明细为准。

企业级与代理级价格

以下表格为公开按量价格。企业级客户、代理级客户或高用量场景,可以单独联系 Xima AI 商讨价格、额度和结算方式。

如有较大需求量,请联系 support@xima.ai

OpenAI 兼容与 Azure

模型 ID输入价输出价缓存读取价缓存创建价支持接口
azure/gpt-5.4$2.50/1M$15.00/1M$0.25/1M-OpenAI
azure/gpt-5.4-mini$0.75/1M$4.50/1M$0.075/1M-OpenAI
azure/gpt-5.3-chat$1.75/1M$14.00/1M$0.175/1M-OpenAI
azure/gpt-5.3-codex$1.75/1M$14.00/1M$0.18/1M-OpenAI

Claude

Claude 模型同时支持 OpenAI-compatible Chat Completions 和 Anthropic native Messages。高级能力接入请阅读 Claude 高级能力接入说明

模型 ID输入价输出价缓存读取价缓存创建价支持接口
xima/claude-haiku-4-5-20251001$1.00/1M$5.00/1M$0.10/1M$1.25/1MAnthropic, OpenAI
xima/claude-sonnet-4-6$3.00/1M$15.00/1M$0.30/1M$3.75/1MAnthropic, OpenAI
xima/claude-sonnet-5$2.00/1M$10.00/1M$0.20/1M$2.50/1MAnthropic, OpenAI
xima/claude-opus-4-6$5.00/1M$25.00/1M$0.50/1M$6.25/1MAnthropic, OpenAI
xima/claude-opus-4-7$5.00/1M$25.00/1M$0.50/1M$6.25/1MAnthropic, OpenAI
xima/claude-opus-4-8$5.00/1M$25.00/1M$0.50/1M$6.25/1MAnthropic, OpenAI
xima/claude-opus-5$5.00/1M$25.00/1M$0.50/1M$6.25/1MAnthropic, OpenAI

Gemini

Gemini Pro 的长上下文分档和 Gemini image 的图片输出价格直接写在对应价格项中。模型可用状态和最终扣费以控制台为准。

模型 ID输入价输出价缓存读取价缓存创建价支持接口
gemini-2.5-flash$0.30/1M$2.50/1M$0.03/1M$1.00/1MGemini, OpenAI
xima/gemini-2.5-flash$0.30/1M$2.502/1M$0.03/1M-OpenAI
xima/gemini-2.5-pro≤200K: $1.25/1M; >200K: $2.50/1M≤200K: $10.00/1M; >200K: $15.00/1M≤200K: $0.13/1M; >200K: $0.25/1M-OpenAI
gemini-3-flash-preview$0.50/1M$3.00/1M$0.05/1M$1.00/1MGemini, OpenAI
xima/gemini-3-flash-preview$0.50/1M$3.00/1M$0.05/1M-OpenAI
gemini-3.1-pro-preview≤200K: $2.00/1M; >200K: $4.00/1M≤200K: $12.00/1M; >200K: $18.00/1M≤200K: $0.20/1M; >200K: $0.40/1M≤200K: $2.00/1M; >200K: $4.00/1MGemini, OpenAI
xima/gemini-3.1-pro-preview≤200K: $2.00/1M; >200K: $4.00/1M≤200K: $12.00/1M; >200K: $18.00/1M≤200K: $0.20/1M; >200K: $0.40/1M-OpenAI
gemini-3.5-flash$1.50/1M$9.00/1M$0.15/1M-Gemini, OpenAI
xima/gemini-3.5-flash$1.50/1M$9.00/1M$0.15/1M-OpenAI
xima/gemini-3.5-flash-lite$0.30/1M$2.50/1M$0.03/1M-OpenAI
xima/gemini-3.6-flash$1.50/1M$7.50/1M$0.15/1M-OpenAI
gemini-3.1-flash-image-previewText/Image: $0.50/1MText/Thinking: $3.00/1M; Image: $60.00/1M--Gemini, OpenAI
gemini-3-pro-image-previewText/Image: $2.00/1MText/Thinking: $12.00/1M; Image: $120.00/1M--Gemini, OpenAI

DeepSeek

模型 ID输入价输出价缓存读取价缓存创建价支持接口
deepseek-v4-pro$0.435/1M$0.87/1M$0.003625/1M-OpenAI
deepseek-v4-flash$0.14/1M$0.28/1M$0.0028/1M-OpenAI

GLM / Qwen

模型 ID输入价输出价缓存读取价缓存创建价支持接口
xima/glm-5.1$0.84/1M$3.36/1M--OpenAI
xima/glm-5$0.56/1M$2.52/1M--OpenAI
xima/qwen3.6-plus$0.28/1M$1.68/1M--OpenAI
xima/qwen3.5-plus$0.11/1M$0.67/1M--OpenAI
xima/qwen3.5-flash$0.03/1M$0.28/1M--OpenAI

Embedding

模型 ID输入价输出价缓存读取价缓存创建价支持接口
azure/text-embedding-3-small$0.02/1M---Embeddings

图片生成

模型 ID输入价输出价图片输入价缓存读取价支持接口
azure/gpt-image-2$5.00/1M$30.00/1M$8.00/1M$1.25/1MImage generation, Image edit

视频生成

模型 ID计费方式基础价格说明
veo-3.1-lite-generate-001按秒计费0.03/秒Veo 720p Video-only 基础价,最终费用会按视频秒数、分辨率和 generateAudio 折算
veo-3.1-fast-generate-001按秒计费0.08/秒Veo 720p Video-only 基础价,最终费用会按视频秒数、分辨率和 generateAudio 折算
veo-3.1-generate-001按秒计费0.20/秒Veo 720p Video-only 基础价,最终费用会按视频秒数、分辨率和 generateAudio 折算
veo-3.0-fast-generate-001按秒计费0.08/秒Veo 720p Video-only 基础价,最终费用会按视频秒数、分辨率和 generateAudio 折算
veo-3.0-generate-001按秒计费0.20/秒Veo 720p Video-only 基础价,最终费用会按视频秒数、分辨率和 generateAudio 折算
xima/doubao-seedance-2-0-fast-260128按秒计费0.20/秒Seedance 视频生成
xima/doubao-seedance-2-0-260128按秒计费0.50/秒Seedance 视频生成

计费说明

  • 文本模型通常按输入、输出、缓存读取和缓存创建分别计费。
  • Embedding 模型只按输入 tokens 计费。
  • 多模态模型的图片、音频、缓存等价格项可能因模型能力不同而不同,请以控制台展示为准。
  • Short / Long 分档模型请按请求总输入 tokens 预估成本,长上下文、多轮对话和大文件分析会更容易进入 Long 档。
  • 视频模型按任务结果的秒数、清晰度和音频配置计算,提交任务前建议在业务侧明确时长、分辨率和失败重试策略。
  • 企业级、代理级或高用量需求可以联系 support@xima.ai 单独商讨价格。
  • 最终扣费以控制台用量明细为准。