模型能力

Image-to-Video

提供源图像和可选 prompt,将静态图像转换为视频。模型会根据你的指令让图像内容动起来。在grok-imagine-video-1.5上,image-to-video 原生支持 1080p。

可以通过以下方式提供源图像:

下方 demo 展示了实际效果;按住即可让静态图像动起来:

Time-lapse按住播放
import os
import xai_sdk

client = xai_sdk.Client(api_key=os.getenv("XAI_API_KEY"))

response = client.video.generate(
    prompt="Generate a slow and serene time-lapse",
    model="grok-imagine-video-1.5",
    image_url="https://docs.x.ai/assets/api-examples/video/milkyway-still.png",
    duration=12,
)

print(response.url)

在 Vercel AI SDK 中,prompt参数接受一个包含imagetextfield 的 object,用于 image-to-video generation。imagefield 可以是 URL string、base64 编码的 string、Uint8ArrayArrayBufferBuffer