高级 API 用法

Prompt 缓存

查看 Markdown

当连续请求的起始消息相同时,xAI API 会自动缓存这些消息。下一次请求中,开头完全匹配的消息会直接由缓存提供:

  • 更快的首个 token 响应时间 — 模型无需重新计算已缓存的消息

  • 更低的成本 — 缓存 token 按较低费率计费


本节内容


最后更新:2026 年 3 月 16 日