
或上传你的照片
点击上传拖入图片或点击
JPG · PNG · WebP
一个人、正面朝向镜头、嘴巴可见。也可以跳过,直接在下方选一个预设表演者。
预览
AI 说唱视频生成器 是什么?
AI 说唱视频生成器 可将照片变成短 AI 视频,内置场景模板,注重隐私处理,并适合直接分享。

为什么选择 AI 说唱视频生成器?
面向普通用户设计,不需要剪辑经验。
口型跟着你的词走
表演者唱的是你给的人声:嘴型跟着音节、点头和手势踩在节拍上,而不是随波形切换的泛泛画面。
你的脸,或一个角色
上传照片,成片保留你的脸、发型和衣着;不想出镜就选预设角色:街头、动漫、录音棚、华丽风、镀铬机器人或猫咪吉祥物。
歌词 → 歌曲 → 视频,一个站搞定
用免费的说唱歌词生成器写词,用 AI 说唱生成器做成歌,再一键把歌送到这里。不用在几个 App 之间导来导去。
AI 说唱视频生成器 可以用来做什么?
适合真实生活场景,生成后即可分享。
TikTok、Reels 和 Shorts
15 秒、竖屏、自带声音,正好是短视频的形状。选歌里的 hook,生成后直接发。

独立音乐人
不用拍摄就有单曲的表演画面:你的照片、你的人声、和歌匹配的场景。再配一张专辑封面生成器做的封面。

给朋友和群聊做的说唱视频
一首 diss 室友的曲子、一段用朋友声音的生日说唱、一只吐词的猫咪吉祥物——整晚被反复播放的那条视频。

3个简单步骤使用 AI 说唱视频生成器
上传照片,选择场景,下载可分享的视频。

🎵步骤 1:添加 15 秒人声
从 AI 说唱生成器最近做的歌里选一首,或上传 MP3/WAV。拖动 15 秒窗口,选到你想表演的主歌或 hook。

🧑🎤步骤 2:选表演者和场景
上传一张要表演的人的清晰照片,或从 8 个预设角色里选一个。再选场景:夜晚街头、录音棚、天台、动漫、Lo-Fi 卧室或豪车。

✨步骤 3:生成并下载
点击生成,通常两到四分钟就能拿到一条混好人声的 15 秒竖屏 MP4。可以直接下载,也可以换个场景再来一条。
AI 说唱视频生成器 – 把你的歌变成说唱视频
选 15 秒人声(来自 AI 说唱生成器做的歌,或自己上传),选谁来表演(你的照片或预设角色)和一个场景,就能得到一条 9:16 竖屏短片:表演者对着口型唱你的词,音频直接混入成片。525 积分起,失败自动退回。
关于 AI 说唱视频生成器 的常见问题
你提供三样东西:15 秒人声、一位表演者(上传的照片或预设角色)和一个场景。视频模型让表演者在你选的场景里唱出这段人声——嘴型、头部和手势都踩在节拍上——并把音频混入成片。结果是一条 15 秒的竖屏 MP4。
要么来自你用 AI 说唱生成器做的歌(会出现在「我最近的歌曲」里,那个页面上的「做成说唱视频」按钮会自动把歌带过来),要么来自你上传的 MP3/WAV。只会用到你选中的 15 秒片段,所以可以挑 hook 或最喜欢的一段主歌。
可以。上传一张清晰照片——正面朝向镜头、嘴巴可见——成片会保留你的脸、发型、肤色和衣着。只用你自己或已同意出镜的人的照片。
嘴部动作由视频模型根据人声生成,节奏和大多数音节都会贴合,但不保证每个字逐帧对上。快速密集的 flow 比清晰的 hook 更难。如果某一条不理想,用同样的输入或换个场景再生成一条。
15 秒 480p 是 525 积分,720p 是 1,125。点击生成时先冻结,视频完成才扣;失败会自动放回。下载无水印。
当前版本是 15 秒,这是模型能接受的参考人声长度。更长的多场景说唱 MV 在计划中;现在可以给歌的不同段落各做一条 15 秒。
视频本身可以自由下载和发布。如果人声来自 AI 说唱生成器,这些 AI 生成歌曲的商业发行授权条款仍在敲定中,目前请按个人和社交媒体用途使用。你自己拥有的人声,授权由你决定。
是。你的照片、音频和成片只对你的账号可见,不会用于训练。你可以随时在历史记录里删除。


