
每个镜头都锁定身份
上传一张照片——或最多七张——Grok Imagine 会把它们当作身份锚点:同样的面孔、身形与轮廓贯穿每一个镜头。走红网络的“同一位女演员演绎九种电影类型”混剪正是由这套引擎驱动,用来保持你的产品或角色前后一致同样得心应手。
用 xAI 的 Grok Imagine 1.5 把照片变成鲜活场景:上传最多 7 张参考图实现身份锁定的动态效果,以全平台最低的每秒价格获得 1-15 秒有声短片。
Generated here on 15 August 2026, first take. The source photo and reference clip are themselves outputs from models on this site — no stock footage.
The woman breathes gently and blinks, a few strands of hair drift in the light, subtle head turn toward camera, natural micro-expressions, the window light steady behind her.
Rain continues to fall on the wet cobblestones, steam drifting up from the grate, the sodium lamp flickering faintly, a slow push-in down the alley.
在同一工作区中将 Grok Imagine 1.5 与其他视频模型对比——一键即可切换。
xAI 的图生视频模型能将你的照片动画化为 1-15 秒的有声短片,凭借最多 7 张参考图让同一人物在每个镜头中都清晰可辨,且每秒成本低于平台上任何其他视频模型。

上传一张照片——或最多七张——Grok Imagine 会把它们当作身份锚点:同样的面孔、身形与轮廓贯穿每一个镜头。走红网络的“同一位女演员演绎九种电影类型”混剪正是由这套引擎驱动,用来保持你的产品或角色前后一致同样得心应手。

每秒定价低于我们托管的任何其他模型——低到你可以放开手脚自由迭代、测试梗图格式、批量产出社交短片,而无需时刻盯着余额。每次生成前都会显示确切的积分消耗,生成失败自动退还积分。

短片自带生成音频——环境音、音效,以及写进提示词的台词——一次生成,就能得到可直接发布到竖屏或宽屏信息流的成品。

时长可在 1 到 15 秒之间任选,分辨率支持 480p 或 720p,画幅可选 auto、1:1、16:9、9:16、3:2 或 2:3——auto 会直接沿用照片的取景。短片渲染约一分钟即可完成,让高频创意测试真正可行。
从空白提示词框到一段成片,只要三步。
打开模型选择器,选择 Grok Imagine 1.5。在你花掉任何积分之前,面板就会显示它的积分费用、分辨率选项与时长上限。
写清主体、动作,以及镜头怎么运动。想让片子从某张图开始,就附上首帧。
下载成片、延长它,或送去进一步编辑。提示词、模型与设置都会一同保存在你的历史记录里。
一个账户,打通图像与视频生成全流程。
用免费额度的每日积分运行 Grok Imagine 1.5,或升级以获得高级模型、更快生成与 4K 输出。
按年计费 · $240/year
按年计费 · $300/year
Grok Imagine 1.5 是 xAI 的图生视频模型。你上传 1-7 张照片并描述想要的动态,它会返回一段 1-15 秒的有声短片,并让照片中的人物或主体全程清晰可辨。
不能——Grok Imagine 1.5 始终需要至少一张图像作为起点。如果你想要纯文生视频,请使用 Seedance 2.0 Fast 或 Wan 2.7;也可以先生成一张静态图像,再到这里将它动画化。
按所选分辨率(480p 或 720p)的输出每秒计费——是平台上所有视频模型中最低的每秒费率。确切费用会在生成前显示,生成失败自动退还积分。
上传最多 7 张参考图,并在提示词中提及它们(例如 "Reference Image 1 as identity lock",即“将参考图 1 作为身份锁定”)。模型会让该主体的面孔与轮廓在短片的每个镜头中保持一致。
可以——短片包含生成的声音。你可以把台词和声音提示直接写进提示词。
视频生成失败时积分自动退还。
生成前后的活儿都有一键工具——修饰、换风格、直接分享。
Enabled upstream content-safety filtering for all Grok Imagine generations.
Grok Imagine 1.5 integrated for image-to-video generation.