关键信息
价格
所有价格均以美元计。每个模型的详细信息请参阅模型页面。
文本 API
每 100 万个 token 的价格| 模型 | 上下文窗口 | 短上下文 | 长上下文 | ||||
|---|---|---|---|---|---|---|---|
| 输入 | 缓存输入 | 输出 | 输入 | 缓存输入 | 输出 | ||
| grok-4.7长上下文:≥ 200k 个 token | 500k | $2.00 | $0.50 | $6.00 | $4.00 | $1.00 | $12.00 |
| grok-4.6长上下文:≥ 200k 个 token | 500k | $2.00 | $0.50 | $6.00 | $4.00 | $1.00 | $12.00 |
| grok-4.5长上下文:≥ 200k 个 token | 500k | $2.00 | $0.30 | $6.00 | $4.00 | $0.60 | $12.00 |
| grok-4.3长上下文:≥ 200k 个 token | 1M | $1.25 | $0.20 | $2.50 | $2.50 | $0.40 | $5.00 |
| grok-4.20-0309-reasoning长上下文:≥ 200k 个 token | 1M | $1.25 | $0.20 | $2.50 | $2.50 | $0.40 | $5.00 |
| grok-4.20-0309-non-reasoning长上下文:≥ 200k 个 token | 1M | $1.25 | $0.20 | $2.50 | $2.50 | $0.40 | $5.00 |
| grok-build-0.1长上下文:≥ 200k 个 token | 256k | $1.00 | $0.20 | $2.00 | $2.00 | $0.40 | $4.00 |
| grok-4.20-multi-agent-0309长上下文:≥ 200k 个 token | 1M | $1.25 | $0.20 | $2.50 | $2.50 | $0.40 | $5.00 |
当请求的 prompt 达到模型列出的 token 阈值时,请求中的所有 token 均按较高的长上下文费率计费。
Imagine API
图像与视频生成及编辑| 模型 | 媒体输入 | 分辨率 | 输出 |
|---|---|---|---|
| grok-imagine-image文本、图像 → 图像 | $0.002 / img | 1K | $0.02 / img |
| 2K | $0.02 / img | ||
| grok-imagine-image-2.0文本、图像 → 图像 | $0.002 / img | 1K | $0.04 / img |
| grok-imagine-image-quality文本、图像 → 图像 | $0.01 / img | 1K | $0.05 / img |
| 2K | $0.07 / img | ||
| grok-imagine-video-1.5文本、图像、音频 → 视频 | $0.01 / img | 480p | $0.08 / sec |
| 720p | $0.14 / sec | ||
| 1080p | $0.25 / sec | ||
| grok-imagine-video文本、图像、视频 → 视频 | $0.01 / sec $0.002 / img | 480p | $0.05 / sec |
| 720p | $0.07 / sec |
Voice API
实时语音、TTS 与 STT| 模型或模式 | 成本 |
|---|---|
| Speech to Speech (grok-voice-think-fast-2.0) | $0.08 / min ($4.80 / hr) 音频 $0.004 / 文本输入 |
| Speech to Text | $0.10 / hr (REST), $0.20 / hr (Streaming) |
| Text to Speech | $15.00 / 1M chars |
Tools 价格
使用 xAI 提供的服务器端工具的请求,按两个组成部分计价:token 用量和服务器端工具调用次数。由于 Agent 会自主决定调用多少工具,成本会随 query 复杂度而变化。
Token 成本
请求所用模型的所有标准 token 类型都会计费:
输入 tokens:你的 query 和对话历史
推理 tokens:Agent 的内部思考和规划
Completion tokens:最终响应
图像 tokens:视觉内容分析(如适用)
缓存 prompt tokens:从缓存提供而非重新计算的 prompt tokens
工具调用成本
| 工具 | 工具名称 | 描述 | 每 1k 次调用成本 |
|---|---|---|---|
| Web Search | `web_search` | 搜索互联网并浏览网页 | $5 |
| X Search | `x_search` | 搜索 X 帖子、用户资料和帖子串 | $5 / 1k 条帖子,$10 / 1k 个资料 |
| Code Execution | `code_execution`, `code_interpreter`† | 在沙箱环境中运行 Python 代码 | $5 |
| Image Generation | `image_generation` | 生成和编辑图像 | Imagine API 费率 |
| File Attachments | `attachment_search` | 搜索附加到消息的文件 | $10 |
| Collections Search | `collections_search`, `file_search`† | 查询已上传的文档集合(RAG) | $2.50 |
| Image Understanding | `view_image` | 分析 Web Search 和 X Search 中找到的图像* | 按 token 计费 |
| X Video Understanding | `view_x_video` | 分析 X Search 中找到的视频* | 按 token 计费 |
| Remote MCP Tools | 由 MCP 服务器设置 | 连接并使用自定义 MCP 工具服务器 | 按 token 计费 |
X Search 按获取的条目数而非调用次数计费:搜索或帖子串获取返回的每条帖子(包括上级帖子和引用帖子)均按帖子费率计入;用户搜索返回的每个用户资料均按资料费率计入。
对于 view image 和 view x video 工具,工具调用本身不收费,但处理图像或视频所使用的 image tokens 会收费。
Image Search 是 Web Search 的一部分,按标准 Web Search 费率计费。
Remote MCP tools 的工具调用本身不收费,但使用的所有 tokens 都会收费。
有关 Tools 的更多使用信息,请访问我们的 Tools 指南。
Batch API 价格
Batch API 允许你以低于标准价格的折扣异步处理大量请求。折扣幅度因模型而异。Batch 请求会排队并在后台处理,大多数会在 24 小时内完成。
| 实时 API | Batch API | |
|---|---|---|
| Token 价格 | 标准费率 | 折扣费率(因模型而异) |
| 响应时间 | 即时(秒) | 通常在 24 小时内 |
| 速率限制 | 适用每分钟限制 | 请求不计入速率限制 |
Batch 折扣适用于所有 token 类型,包括 input tokens、output tokens、cached tokens 和 reasoning tokens。各模型的 Batch 折扣:
标准费率九折
上面未列出的模型没有 Batch 折扣。
要查看模型使用 Batch 后的价格,请在其详情页切换 “显示 Batch API 价格”。接受 Batch 请求但不提供折扣的模型会显示 N/A。
Priority Processing 价格
Priority Processing 为文本请求提供更高的调度优先级,以降低延迟。Priority 请求按标准费率的 2 倍计费。
| 标准 | Priority | |
|---|---|---|
| Token 价格 | 标准费率 | 标准费率的 2 倍 |
| 响应时间 | 标准调度优先级 | 更高调度优先级 |
2 倍乘数适用于所有 token 类型,包括 input、output、cached 和 reasoning。Prompt caching 折扣会在应用乘数之前计算。
只有响应确认使用了 "service_tier": "priority" 时,才会按 priority 费率计费。如果请求实际由默认 tier 提供服务,则按标准费率计费。
Grok 4.7 Fast 价格(仅限 Cursor 和 Grok Build)
Grok 4.7 Fast 是在更快基础设施上提供的同一 Grok 4.7 模型,按标准 token 费率的两倍计费。它仅通过 Cursor 和 Grok Build 提供;公开的 xAI API 不提供此版本,Grok Build 免费层也不包含它。
| Prompt tokens | 输入 | 缓存输入 | 输出 |
|---|---|---|---|
| 低于 200k | $4.00 / 1M | $1.00 / 1M | $12.00 / 1M |
| 高于 200k | $6.00 / 1M | $1.50 / 1M | $18.00 / 1M |
请求的 prompt 超过 200k tokens 时适用长上下文费率。Cursor 通过你的 Cursor 套餐为其快速版本计费。
美国区域端点价格
发送至美国区域端点 https://us.api.x.ai/v1 的请求会在美国境内运行推理;其 token 用量按全球 token 费率的 1.1 倍计费,即上浮 10%。
| 全球端点 | 美国区域端点 | |
|---|---|---|
| Base URL | https://api.x.ai/v1 | https://us.api.x.ai/v1 |
| Token 价格 | 标准费率 | 标准费率的 1.1 倍 |
| 模型 | 团队可用的所有模型 | 目前仅限 grok-4.7 和 grok-4.6 |
对于 grok-4.7,prompt 低于 200k tokens 时,每 1M tokens 的输入 / 缓存输入 / 输出价格为 $2.20 / $0.55 / $6.60,高于该阈值时为 $4.40 / $1.10 / $13.20。1.1 倍系数适用于输入、输出和缓存输入 token,包括长上下文费率。Prompt 缓存折扣在应用系数之前计算。美国境内处理和存储保证的适用范围请参阅区域端点文档。
Files 与 Collections 价格
存储在 xAI 平台上的 files 和 collections 按使用的存储量计费。
| 资源 | 费率 |
|---|---|
| File 存储 | $0.025 / GiB / day |
| Collection 存储 | $0.10 / GiB / day |
下载成本
从 files 和 collections 下载数据时,根据传输的数据量按固定费率收费:
| 资源 | 费率 |
|---|---|
| File 下载 | $0.20 / GiB downloaded |
| Collection 下载 | $0.20 / GiB downloaded |
你可以通过 xAI console 查看和管理 files 与 collections,也可以使用 xAI API。
使用规范违规费用
当系统认定你的请求违反使用规范时,我们仍会对请求的生成收费。
对于在 Responses API 生成前被拦截的违规请求,每个请求将收取 $0.05 的使用规范违规费用。
计费与可用性
你的模型访问权限可能因地理位置、账户限制等多种因素而有所不同。
有关账单的收费方式,请访问管理计费了解更多信息。
有关你的团队当前可用模型的最新信息,请访问 xAI Console 上的模型页面。
最后更新:2026 年 9 月 21 日