AI 生成完整 MV:口型同步、歌词分镜与画幅选择的实操指南
歌做完只是半成品,社交平台要的是视频。Create Video 的音乐视频(Music Video)功能可以从一首歌直接生成整支 AI 渲染的 MV:角色、背景、视觉风格都可配置,还支持角色口型与歌词同步。
四个功能入口
- 左侧栏 Create Video;
- 歌曲更多菜单里的"视频/Download Video"选项;
- 歌曲列表中每首歌的视频按钮;
- 歌曲详情页的视频入口。

配置三要素
- MV 角色:选择出镜形象,可以用自己创建的歌手角色,让"固定歌手"贯穿 MV;
- 背景:从预设背景库挑选,或上传自定义背景;
- 视觉风格:吸血鬼、复古房间、赛博朋克、暗黑写实、水彩千禧风等多种风格模板可选。
它聪明在哪里
- 歌词感知分镜:AI 读取歌词生成与叙事、意象相关的画面,而不是随机图拼凑;
- 口型同步:角色嘴型与歌曲人声对齐,无需真人拍摄或后期对轨;
- 自动字幕:歌词字幕自动匹配画面;
- 多画幅输出:支持 16:9、9:16、3:4、4:3,横屏长视频、竖屏短视频、方形贴片都能适配。
成本与限制(重要)
- 按秒计费:MV 生成消耗金币,标准为每秒 40 金币——生成前先估算时长成本,见金币发放与有效期规则;
- 片段长度:选取的歌曲片段最短 10 秒、最长 90 秒;
- 全 AI 渲染:目前不支持手动时间线剪辑,镜头时序由系统按歌词时间线分配;
- 口型有前提:口型同步取决于角色图片,务必使用正脸清晰的形象,详见分镜模式怎么用。
成品保存在工作台(Workspace),可直接下载或分享。预算有限或只要歌词展示,可以改用零金币的模板方案,见歌词视频零金币做法。