模型能力
图像编辑
提供源图像和 prompt,即可编辑现有图像。模型会理解图像内容并应用你要求的更改。
使用 xAI SDK 时,仍使用相同的 sample() 方法,只需添加 image_url 参数:
import base64
import xai_sdk
client = xai_sdk.Client()
# Load image from file and encode as base64
with open("photo.png", "rb") as f:
image_data = base64.b64encode(f.read()).decode("utf-8")
response = client.image.sample(
prompt="Render this as a pencil sketch with detailed shading",
model="grok-imagine-image-2.0",
image_url=f"data:image/png;base64,{image_data}",
)
print(response.url)你可以通过以下方式提供源图像:
一个 公开 URL(指向图像)
一个 Base64 编码的数据 URI(例如
data:image/jpeg;base64,...)一个
file_id,来自 Files API,详见 Imagine → Files API 集成
多轮编辑
将每次输出作为下一次编辑的输入,即可串联多次编辑。这支持迭代优化:从基础图像开始,逐步添加细节、调整风格或进行修正。



import xai_sdk
client = xai_sdk.Client()
response = client.image.sample(
prompt="A modern living room with large windows overlooking the city",
model="grok-imagine-image-2.0",
)
print(response.url)风格迁移
该 grok-imagine-image-2.0 模型支持丰富的视觉风格,从超写实摄影到动漫、油画和铅笔素描。你可以在 prompt 中描述所需的审美风格,以转换现有图像。






import xai_sdk
client = xai_sdk.Client()
response = client.image.sample(
prompt="Render this image as an oil painting in the style of impressionism",
model="grok-imagine-image-2.0",
image_url="https://docs.x.ai/assets/api-examples/images/style-realistic.png",
)
print(response.url)相关内容
图像生成:根据文本提示词生成图像
多图编辑:使用多张源图像进行编辑
API 参考:完整的端点文档
Imagine API 主页:展示 Imagine API 的实际效果
最后更新:2026 年 8 月 13 日