模型能力
视频扩展
提供源视频和描述后续内容的文本提示词,即可扩展现有视频。结果是一段从输入视频最后一帧无缝衔接并继续生成内容的单一视频。
源视频可以是公开 URL、Base64 编码的数据 URI,或来自 file_id 的 Files API。有关如何使用 Imagine → Files API Integration 作为输入,请参阅 file_id 输入。
该 duration参数控制仅扩展部分 的长度,而不是总输出长度。例如,如果输入视频为 10 秒,并将 duration设为 5,则返回的视频长度为 15 秒(10 秒原视频 + 5 秒扩展)。
import os
import xai_sdk
client = xai_sdk.Client(api_key=os.getenv("XAI_API_KEY"))
response = client.video.extend(
prompt="The shot pans to an over the shoulder perspective. Calm controlled scene.",
model="grok-imagine-video",
video_url="<VIDEO_URL>",
duration=10,
)
print(response.url)视频编辑使用 /v1/videos/edits 端点,以及 Python SDK 中的 client.video.generate(video_url=...)。在 AI SDK 中,将 providerOptions.xai.mode设置为"edit-video"或"extend-video",并传入 providerOptions.xai.videoUrl。两个流程都使用相同的异步轮询模式,AI SDK 会在 providerMetadata.xai.videoUrl 中返回由 xAI 托管的输出 URL。
相关内容
视频生成:根据文本提示词生成视频
视频编辑:编辑现有视频
图像转视频:让静态图像动起来
API 参考:完整的 endpoint 文档
Imagine API 主页:展示 Imagine API 的实际效果
最后更新:2026 年 7 月 30 日