关键信息

价格

所有价格均以美元计。每个模型的详细信息请参阅模型页面

Text API 价格

模型Context输入 / 1M tokens缓存输入 / 1M tokens输出 / 1M tokens
grok-4.5 (< 200k prompt tokens)500k$2.00$0.30$6.00
grok-4.5 (≥ 200k prompt tokens)500k$4.00$0.60$12.00
grok-4.3 (< 200k prompt tokens)1M$1.25$0.20$2.50
grok-4.3 (≥ 200k prompt tokens)1M$2.50$0.40$5.00
grok-4.20-0309-reasoning (< 200k prompt tokens)1M$1.25$0.20$2.50
grok-4.20-0309-reasoning (≥ 200k prompt tokens)1M$2.50$0.40$5.00
grok-4.20-0309-non-reasoning (< 200k prompt tokens)1M$1.25$0.20$2.50
grok-4.20-0309-non-reasoning (≥ 200k prompt tokens)1M$2.50$0.40$5.00
grok-build-0.1 (< 200k prompt tokens)256k$1.00$0.20$2.00
grok-build-0.1 (≥ 200k prompt tokens)256k$2.00$0.40$4.00
grok-4.20-multi-agent-0309 (< 200k prompt tokens)1M$1.25$0.20$2.50
grok-4.20-multi-agent-0309 (≥ 200k prompt tokens)1M$2.50$0.40$5.00

价格按每 1M tokens 显示。列出两行的模型使用长上下文价格:当请求的 prompt 达到所列 token threshold 时,请求中的所有 tokens 均按较高费率计费。

Imagine 价格

模型成本
grok-imagine-image$0.02 / image
grok-imagine-image-quality$0.05 / image
grok-imagine-video-1.5$0.080 / sec
grok-imagine-video$0.050 / sec

Voice 价格

模式成本
Speech to Speech (grok-voice-think-fast-1.0)$0.05 / min ($3.00 / hr) audio
$0.004 / text input
Speech to Speech (grok-voice-think-fast-2.0)$0.08 / min ($4.80 / hr) audio
$0.004 / text input
Speech to Text$0.10 / hr (REST), $0.20 / hr (Streaming)
Text to Speech$15.00 / 1M chars

Tools 价格

使用 xAI 提供的服务器端工具的请求,按两个组成部分计价:token 用量服务器端工具调用次数。由于 Agent 会自主决定调用多少工具,成本会随 query 复杂度而变化。

Token 成本

请求所用模型的所有标准 token 类型都会计费:

  • 输入 tokens:你的 query 和对话历史

  • 推理 tokens:Agent 的内部思考和规划

  • Completion tokens:最终响应

  • 图像 tokens:视觉内容分析(如适用)

  • 缓存 prompt tokens:从缓存提供而非重新计算的 prompt tokens

工具调用成本

工具工具名称描述每 1k 次调用成本
Web Searchweb_search搜索互联网并浏览网页$5
X Searchx_search搜索 X 帖子、用户资料和 thread$5
Code Executioncode_execution, code_interpreter在 sandbox 环境中运行 Python 代码$5
Image Generationimage_generation生成和编辑图像Imagine API 费率
File Attachmentsattachment_search搜索附加到消息的文件$10
Collections Searchcollections_search, file_search查询已上传的文档 collection(RAG)$2.50
Image Understandingview_image分析 Web Search 和 X Search 中找到的图像*按 token 计费
X Video Understandingview_x_video分析 X Search 中找到的视频*按 token 计费
Remote MCP Tools由 MCP server 设置连接并使用自定义 MCP tool server按 token 计费
† 所有工具名称均可用于 Responses API。在 gRPC API(Python xAI SDK)中,不支持 code_interpreterfile_search
* 仅适用于搜索工具找到的图像和视频,不适用于直接在消息中传递的图像。

对于 view image 和 view x video 工具,工具调用本身不收费,但处理图像或视频所使用的 image tokens 会收费。

Image Search 是 Web Search 的一部分,按标准 Web Search 费率计费。

Remote MCP tools 的工具调用本身不收费,但使用的所有 tokens 都会收费。

有关 Tools 的更多使用信息,请访问我们的 Tools 指南

Batch API 价格

Batch API 允许你以低于标准价格的折扣异步处理大量请求。折扣幅度因模型而异。Batch 请求会排队并在后台处理,大多数会在 24 小时内完成。

实时 APIBatch API
Token 价格标准费率折扣费率(因模型而异)
响应时间即时(秒)通常在 24 小时内
速率限制适用每分钟限制请求不计入速率限制

Batch 折扣适用于所有 token 类型,包括 input tokens、output tokens、cached tokens 和 reasoning tokens。各模型的 Batch 折扣:

标准费率九折

  • grok-4.3

  • grok-4.20-0309-reasoning

  • grok-4.20-0309-non-reasoning

  • grok-4.20-multi-agent-0309

上面未列出的模型没有 Batch 折扣。

要查看模型使用 Batch 后的价格,请在其详情页切换 “显示 Batch API 价格”

Priority Processing 价格

Priority Processing 为文本请求提供更高的调度优先级,以降低延迟。Priority 请求按标准费率的 2 倍计费。

标准Priority
Token 价格标准费率标准费率的 2 倍
响应时间标准调度优先级更高调度优先级

2 倍乘数适用于所有 token 类型,包括 input、output、cached 和 reasoning。Prompt caching 折扣会在应用乘数之前计算。

只有响应确认使用了 "service_tier": "priority" 时,才会按 priority 费率计费。如果请求实际由默认 tier 提供服务,则按标准费率计费。

Files 与 Collections 价格

存储在 xAI 平台上的 files 和 collections 按使用的存储量计费。

资源费率
File 存储$0.025 / GiB / day
Collection 存储$0.10  / GiB / day

下载成本

从 files 和 collections 下载数据时,根据传输的数据量按固定费率收费:

资源费率
File 下载$0.20 / GiB downloaded
Collection 下载$0.20 / GiB downloaded

你可以通过 xAI console 查看和管理 filescollections,也可以使用 xAI API

使用规范违规费用

当系统认定你的请求违反使用规范时,我们仍会对请求的生成收费。

对于在 Responses API 生成前被拦截的违规请求,每个请求将收取 $0.05 的使用规范违规费用。

计费与可用性

你的模型访问权限可能因地理位置、账户限制等多种因素而有所不同。

有关账单的收费方式,请访问管理计费了解更多信息。

有关你的团队当前可用模型的最新信息,请访问 xAI Console 上的模型页面