高级 API 用法
区域端点
https://api.x.ai 是全球端点。SpaceXAI 可能为满足容量或可靠性需要而跨区域路由请求,因此不保证处理位置。
如需 API 请求处理和模型推理均在美国进行,请使用美国区域端点 https://us.api.x.ai/v1。所有团队均可使用,现有 API 密钥在两个端点上都有效。
使用美国端点
将客户端指向 https://us.api.x.ai/v1;Python SDK(xai_sdk)使用不带协议和路径的主机名 us.api.x.ai。
import { createXai } from '@ai-sdk/xai';
import { generateText } from 'ai';
const xai = createXai({
apiKey: process.env.XAI_API_KEY,
baseURL: 'https://us.api.x.ai/v1',
});
const { text } = await generateText({
model: xai.responses('grok-4.7'),
prompt: 'Explain latency versus throughput in two sentences.',
});
console.log(text);模型可用性
grok-4.7 和 grok-4.6 是美国端点目前仅有的可用模型;控制台中的模型页面 和 GET https://us.api.x.ai/v1/models 始终显示当前列表。请求列表之外的模型(包括 grok-latest)会返回 404 Not Found:
{
"code": "not-found",
"error": "The model grok-4-1-fast-reasoning does not exist or your team <team_id> does not have access to it. If you believe this is a mistake, please contact support and quote your team ID and the model name."
}如果请求一个全球端点可用的模型时返回此错误,请先确认客户端调用的是预期端点,再排查模型访问权限。美国端点不提供图像生成、视频生成或语音 API;请使用全球端点访问这些 API。
价格
美国端点的 token 用量费用比全球端点高 10%。加价适用于输入、输出和缓存输入 token(包括长上下文费率),prompt 缓存折扣仍然适用。当前每 token 费率可从模型页面进入各模型详情页查看,也可在价格页面查看。
保证范围
调用 https://us.api.x.ai/v1 时,SpaceXAI 保证以下操作在美国境内完成:
SpaceXAI API 服务器处理请求。
运行所请求模型的推理。
对请求和响应进行安全审核。
存储 SpaceXAI 保留的请求元数据、prompt 输入和模型输出。安全 FAQ说明了保留的内容和期限。
美国端点不提供图像生成、视频生成或语音 API。Files、Collections以及服务器端工具(例如网页搜索、X 搜索和代码执行)仍可在美国端点使用,但不在美国区域保证范围内,可能在美国以外处理数据。如果你的要求也涵盖这些功能,请在调用美国端点时避免使用它们,或联系 support@x.ai讨论配置。
保证也不涵盖你自己的用户或基础设施与端点之间的网络路径。
FAQ
美国端点是否支持工具、文件和结构化输出?
支持。美国端点请求接受与全球端点相同的参数,包括 function calling、服务器端工具、文件附件和结构化输出。但服务器端工具和文件不在美国区域保证范围内;请参阅保证范围。
prompt 缓存能否跨端点复用?
不保证跨端点命中 prompt 缓存。请将每段对话保持在同一端点,并设置 prompt_cache_key,以便将其请求路由到一起。
Zero Data Retention 是否适用于美国端点?
是的。Zero Data Retention 是团队级设置,因此适用于团队发出的所有请求,与所用端点无关。
最后更新:2026 年 9 月 21 日