模型能力
Image-to-Video
提供源图像和可选 prompt,将静态图像转换为视频。模型会根据你的指令让图像内容动起来。在grok-imagine-video-1.5上,image-to-video 原生支持 1080p。
可以通过以下方式提供源图像:
指向图像的公开 URL(指向图像)
指向图像的base64 编码的 data URI(例如
data:image/jpeg;base64,...)指向图像的
file_id来自Files API,详情请参阅Imagine → Files API Integration
下方 demo 展示了实际效果;按住即可让静态图像动起来:

import os
import xai_sdk
client = xai_sdk.Client(api_key=os.getenv("XAI_API_KEY"))
response = client.video.generate(
prompt="Generate a slow and serene time-lapse",
model="grok-imagine-video-1.5",
image_url="https://docs.x.ai/assets/api-examples/video/milkyway-still.png",
duration=12,
)
print(response.url)在 Vercel AI SDK 中,prompt参数接受一个包含image和textfield 的 object,用于 image-to-video generation。imagefield 可以是 URL string、base64 编码的 string、Uint8Array、ArrayBuffer或Buffer。
相关内容
Video Generation,根据文本 prompt 生成视频
Reference-to-Video,使用参考图像引导视频生成
Videos API,视频生成 endpoints
Video Editing,编辑现有视频
API Reference,完整的 endpoint 文档
Imagine API Landing Page,查看 Imagine API 的实际效果