关键信息

价格

查看 Markdown

所有价格均以美元计。每个模型的详细信息请参阅模型页面

文本 API

每 100 万个 token 的价格
模型上下文窗口短上下文长上下文
输入缓存输入输出输入缓存输入输出
grok-4.7长上下文:≥ 200k 个 token500k$2.00$0.50$6.00$4.00$1.00$12.00
grok-4.6长上下文:≥ 200k 个 token500k$2.00$0.50$6.00$4.00$1.00$12.00
grok-4.5长上下文:≥ 200k 个 token500k$2.00$0.30$6.00$4.00$0.60$12.00
grok-4.3长上下文:≥ 200k 个 token1M$1.25$0.20$2.50$2.50$0.40$5.00
grok-4.20-0309-reasoning长上下文:≥ 200k 个 token1M$1.25$0.20$2.50$2.50$0.40$5.00
grok-4.20-0309-non-reasoning长上下文:≥ 200k 个 token1M$1.25$0.20$2.50$2.50$0.40$5.00
grok-build-0.1长上下文:≥ 200k 个 token256k$1.00$0.20$2.00$2.00$0.40$4.00
grok-4.20-multi-agent-0309长上下文:≥ 200k 个 token1M$1.25$0.20$2.50$2.50$0.40$5.00

当请求的 prompt 达到模型列出的 token 阈值时,请求中的所有 token 均按较高的长上下文费率计费。

Imagine API

图像与视频生成及编辑
模型媒体输入分辨率输出
grok-imagine-image文本、图像 → 图像$0.002 / img1K$0.02 / img
2K$0.02 / img
grok-imagine-image-2.0文本、图像 → 图像$0.002 / img1K$0.04 / img
grok-imagine-image-quality文本、图像 → 图像$0.01 / img1K$0.05 / img
2K$0.07 / img
grok-imagine-video-1.5文本、图像、音频 → 视频$0.01 / img480p$0.08 / sec
720p$0.14 / sec
1080p$0.25 / sec
grok-imagine-video文本、图像、视频 → 视频$0.01 / sec
$0.002 / img
480p$0.05 / sec
720p$0.07 / sec

Voice API

实时语音、TTS 与 STT
模型或模式成本
Speech to Speech (grok-voice-think-fast-2.0)$0.08 / min ($4.80 / hr) 音频
$0.004 / 文本输入
Speech to Text$0.10 / hr (REST), $0.20 / hr (Streaming)
Text to Speech$15.00 / 1M chars

Tools 价格

使用 xAI 提供的服务器端工具的请求,按两个组成部分计价:token 用量服务器端工具调用次数。由于 Agent 会自主决定调用多少工具,成本会随 query 复杂度而变化。

Token 成本

请求所用模型的所有标准 token 类型都会计费:

  • 输入 tokens:你的 query 和对话历史

  • 推理 tokens:Agent 的内部思考和规划

  • Completion tokens:最终响应

  • 图像 tokens:视觉内容分析(如适用)

  • 缓存 prompt tokens:从缓存提供而非重新计算的 prompt tokens

工具调用成本

工具工具名称描述每 1k 次调用成本
Web Search`web_search`搜索互联网并浏览网页$5
X Search`x_search`搜索 X 帖子、用户资料和帖子串$5 / 1k 条帖子,$10 / 1k 个资料
Code Execution`code_execution`, `code_interpreter`†在沙箱环境中运行 Python 代码$5
Image Generation`image_generation`生成和编辑图像Imagine API 费率
File Attachments`attachment_search`搜索附加到消息的文件$10
Collections Search`collections_search`, `file_search`†查询已上传的文档集合(RAG)$2.50
Image Understanding`view_image`分析 Web Search 和 X Search 中找到的图像*按 token 计费
X Video Understanding`view_x_video`分析 X Search 中找到的视频*按 token 计费
Remote MCP Tools由 MCP 服务器设置连接并使用自定义 MCP 工具服务器按 token 计费
Web Search$5 / 1k 次调用

搜索互联网并浏览网页

`web_search`
X Search$5 / 1k 条帖子,$10 / 1k 个资料

搜索 X 帖子、用户资料和帖子串

`x_search`
Code Execution$5 / 1k 次调用

在沙箱环境中运行 Python 代码

`code_execution`, `code_interpreter`†

生成和编辑图像

`image_generation`
File Attachments$10 / 1k 次调用

搜索附加到消息的文件

`attachment_search`
Collections Search$2.50 / 1k 次调用

查询已上传的文档集合(RAG)

`collections_search`, `file_search`†
Image Understanding按 token 计费

分析 Web Search 和 X Search 中找到的图像*

`view_image`
X Video Understanding按 token 计费

分析 X Search 中找到的视频*

`view_x_video`
Remote MCP Tools按 token 计费

连接并使用自定义 MCP 工具服务器

由 MCP 服务器设置

X Search 按获取的条目数而非调用次数计费:搜索或帖子串获取返回的每条帖子(包括上级帖子和引用帖子)均按帖子费率计入;用户搜索返回的每个用户资料均按资料费率计入。

对于 view image 和 view x video 工具,工具调用本身不收费,但处理图像或视频所使用的 image tokens 会收费。

Image Search 是 Web Search 的一部分,按标准 Web Search 费率计费。

Remote MCP tools 的工具调用本身不收费,但使用的所有 tokens 都会收费。

有关 Tools 的更多使用信息,请访问我们的 Tools 指南


Batch API 价格

Batch API 允许你以低于标准价格的折扣异步处理大量请求。折扣幅度因模型而异。Batch 请求会排队并在后台处理,大多数会在 24 小时内完成。

实时 APIBatch API
Token 价格标准费率折扣费率(因模型而异)
响应时间即时(秒)通常在 24 小时内
速率限制适用每分钟限制请求不计入速率限制

Batch 折扣适用于所有 token 类型,包括 input tokens、output tokens、cached tokens 和 reasoning tokens。各模型的 Batch 折扣:

标准费率九折

上面未列出的模型没有 Batch 折扣。

要查看模型使用 Batch 后的价格,请在其详情页切换 “显示 Batch API 价格”。接受 Batch 请求但不提供折扣的模型会显示 N/A。


Priority Processing 价格

Priority Processing 为文本请求提供更高的调度优先级,以降低延迟。Priority 请求按标准费率的 2 倍计费。

标准Priority
Token 价格标准费率标准费率的 2 倍
响应时间标准调度优先级更高调度优先级

2 倍乘数适用于所有 token 类型,包括 input、output、cached 和 reasoning。Prompt caching 折扣会在应用乘数之前计算。

只有响应确认使用了 "service_tier": "priority" 时,才会按 priority 费率计费。如果请求实际由默认 tier 提供服务,则按标准费率计费。


Grok 4.7 Fast 价格(仅限 Cursor 和 Grok Build)

Grok 4.7 Fast 是在更快基础设施上提供的同一 Grok 4.7 模型,按标准 token 费率的两倍计费。它仅通过 CursorGrok Build 提供;公开的 xAI API 不提供此版本,Grok Build 免费层也不包含它。

Prompt tokens输入缓存输入输出
低于 200k$4.00 / 1M$1.00 / 1M$12.00 / 1M
高于 200k$6.00 / 1M$1.50 / 1M$18.00 / 1M

请求的 prompt 超过 200k tokens 时适用长上下文费率。Cursor 通过你的 Cursor 套餐为其快速版本计费。


美国区域端点价格

发送至美国区域端点 https://us.api.x.ai/v1 的请求会在美国境内运行推理;其 token 用量按全球 token 费率的 1.1 倍计费,即上浮 10%。

全球端点美国区域端点
Base URLhttps://api.x.ai/v1https://us.api.x.ai/v1
Token 价格标准费率标准费率的 1.1 倍
模型团队可用的所有模型目前仅限 grok-4.7grok-4.6

对于 grok-4.7,prompt 低于 200k tokens 时,每 1M tokens 的输入 / 缓存输入 / 输出价格为 $2.20 / $0.55 / $6.60,高于该阈值时为 $4.40 / $1.10 / $13.20。1.1 倍系数适用于输入、输出和缓存输入 token,包括长上下文费率。Prompt 缓存折扣在应用系数之前计算。美国境内处理和存储保证的适用范围请参阅区域端点文档


Files 与 Collections 价格

存储在 xAI 平台上的 files 和 collections 按使用的存储量计费。

资源费率
File 存储$0.025 / GiB / day
Collection 存储$0.10  / GiB / day

下载成本

从 files 和 collections 下载数据时,根据传输的数据量按固定费率收费:

资源费率
File 下载$0.20 / GiB downloaded
Collection 下载$0.20 / GiB downloaded

你可以通过 xAI console 查看和管理 filescollections,也可以使用 xAI API


使用规范违规费用

当系统认定你的请求违反使用规范时,我们仍会对请求的生成收费。

对于在 Responses API 生成前被拦截的违规请求,每个请求将收取 $0.05 的使用规范违规费用。


计费与可用性

你的模型访问权限可能因地理位置、账户限制等多种因素而有所不同。

有关账单的收费方式,请访问管理计费了解更多信息。

有关你的团队当前可用模型的最新信息,请访问 xAI Console 上的模型页面


最后更新:2026 年 9 月 21 日