关键信息

模型

文本 API 定价

模型上下文输入 / 100 万 tokens缓存输入 / 100 万 tokens输出 / 100 万 tokens
grok-4.5(< 20 万 prompt tokens)50 万$2.00$0.30$6.00
grok-4.5(≥ 20 万 prompt tokens)50 万$4.00$0.60$12.00
grok-4.3(< 20 万 prompt tokens)100 万$1.25$0.20$2.50
grok-4.3(≥ 20 万 prompt tokens)100 万$2.50$0.40$5.00
grok-4.20-0309-reasoning(< 20 万 prompt tokens)100 万$1.25$0.20$2.50
grok-4.20-0309-reasoning(≥ 20 万 prompt tokens)100 万$2.50$0.40$5.00
grok-4.20-0309-non-reasoning(< 20 万 prompt tokens)100 万$1.25$0.20$2.50
grok-4.20-0309-non-reasoning(≥ 20 万 prompt tokens)100 万$2.50$0.40$5.00
grok-build-0.1(< 20 万 prompt tokens)25.6 万$1.00$0.20$2.00
grok-build-0.1(≥ 20 万 prompt tokens)25.6 万$2.00$0.40$4.00
grok-4.20-multi-agent-0309(< 20 万 prompt tokens)100 万$1.25$0.20$2.50
grok-4.20-multi-agent-0309(≥ 20 万 prompt tokens)100 万$2.50$0.40$5.00

价格按每百万 tokens 计。以两行显示的模型使用长上下文定价:当请求的 prompt 达到所列 token 阈值时,整个请求的所有 token 都按更高费率计费。

Imagine 定价

模型价格
grok-imagine-image-quality$0.05 / image
grok-imagine-image$0.02 / image
grok-imagine-video-1.5$0.080 / 秒
grok-imagine-video$0.050 / 秒

语音定价

模式价格
Speech to Speech(grok-voice-think-fast-1.0)$0.05 / 分钟($3.00 / 小时)音频
$0.004 / 文本输入
Speech to Speech(grok-voice-think-fast-2.0)$0.08 / 分钟($4.80 / 小时)音频
$0.004 / 文本输入
Speech to Text$0.10 / 小时(REST),$0.20 / 小时(Streaming)
Text to Speech$15.00 / 100 万字符

我应该选择哪个模型?

具体选择取决于你的使用场景。音频、图像和视频能力有专门的模型与 API;对于包括代码在内的其他任务,请使用 Grok 4.5。它是我们构建过的最智能、最快速的模型。

代码:Grok 4.5

对话:Grok 4.5

图像:Grok Imagine API

视频:Grok Imagine API

语音:Grok Voice API

关于模型的补充信息

  • 未启用搜索工具时无法访问实时事件

    • Grok 对训练数据之外的当前事件或数据没有知识。

    • 若要在请求中加入实时数据,请启用服务器端搜索工具(Web Search / X Search)。请参阅 Web SearchX Search

  • Chat 模型

    • 没有角色顺序限制:可以混合 systemuserassistant 角色,并以任意顺序组织对话上下文。

    • logprobstop_logprobs 不受模型 grok-4.20 及更新版本支持;如果设置了这些字段,会被静默忽略。

  • 图像输入模型

    • 最大图像大小:20MiB

    • 最大图像数量:无限制

    • 支持的图像文件类型:jpg/jpegpng

    • 接受任意图像/文本输入顺序(例如文本 prompt 可以先于图像 prompt)

模型别名

部分模型提供别名,帮助用户自动迁移到同一模型的下一个版本。一般而言:

  • <modelname> 会别名到最新稳定版本。

  • <modelname>-latest 会别名到最新版本,适合希望使用最新功能的用户。

  • <modelname>-<date> 会直接指向某个具体模型版本。它不会更新,适合要求一致性的工作流。

对大多数用户,别名形式的 <modelname><modelname>-latest 更推荐,因为它们会自动获得最新功能。