高级 API 用法

区域端点

查看 Markdown

https://api.x.ai 是全球端点。SpaceXAI 可能为满足容量或可靠性需要而跨区域路由请求,因此不保证处理位置。

如需 API 请求处理和模型推理均在美国进行,请使用美国区域端点 https://us.api.x.ai/v1。所有团队均可使用,现有 API 密钥在两个端点上都有效。


使用美国端点

将客户端指向 https://us.api.x.ai/v1;Python SDK(xai_sdk)使用不带协议和路径的主机名 us.api.x.ai

import { createXai } from '@ai-sdk/xai';
import { generateText } from 'ai';

const xai = createXai({
  apiKey: process.env.XAI_API_KEY,
  baseURL: 'https://us.api.x.ai/v1',
});

const { text } = await generateText({
  model: xai.responses('grok-4.7'),
  prompt: 'Explain latency versus throughput in two sentences.',
});

console.log(text);

模型可用性

grok-4.7grok-4.6 是美国端点目前仅有的可用模型;控制台中的模型页面GET https://us.api.x.ai/v1/models 始终显示当前列表。请求列表之外的模型(包括 grok-latest)会返回 404 Not Found

JSON

{
  "code": "not-found",
  "error": "The model grok-4-1-fast-reasoning does not exist or your team <team_id> does not have access to it. If you believe this is a mistake, please contact support and quote your team ID and the model name."
}

如果请求一个全球端点可用的模型时返回此错误,请先确认客户端调用的是预期端点,再排查模型访问权限。美国端点不提供图像生成、视频生成或语音 API;请使用全球端点访问这些 API。


价格

美国端点的 token 用量费用比全球端点高 10%。加价适用于输入、输出和缓存输入 token(包括长上下文费率),prompt 缓存折扣仍然适用。当前每 token 费率可从模型页面进入各模型详情页查看,也可在价格页面查看。


保证范围

调用 https://us.api.x.ai/v1 时,SpaceXAI 保证以下操作在美国境内完成:

  • SpaceXAI API 服务器处理请求。

  • 运行所请求模型的推理。

  • 对请求和响应进行安全审核。

  • 存储 SpaceXAI 保留的请求元数据、prompt 输入和模型输出。安全 FAQ说明了保留的内容和期限。

美国端点不提供图像生成、视频生成或语音 API。FilesCollections以及服务器端工具(例如网页搜索X 搜索代码执行)仍可在美国端点使用,但不在美国区域保证范围内,可能在美国以外处理数据。如果你的要求也涵盖这些功能,请在调用美国端点时避免使用它们,或联系 support@x.ai讨论配置。

保证也不涵盖你自己的用户或基础设施与端点之间的网络路径。


FAQ

美国端点是否支持工具、文件和结构化输出?

支持。美国端点请求接受与全球端点相同的参数,包括 function calling、服务器端工具、文件附件和结构化输出。但服务器端工具和文件不在美国区域保证范围内;请参阅保证范围

prompt 缓存能否跨端点复用?

不保证跨端点命中 prompt 缓存。请将每段对话保持在同一端点,并设置 prompt_cache_key,以便将其请求路由到一起。

Zero Data Retention 是否适用于美国端点?

是的。Zero Data Retention 是团队级设置,因此适用于团队发出的所有请求,与所用端点无关。


最后更新:2026 年 9 月 21 日