教程

AI 说唱视频用什么照片最好:实用指南

2026年9月21日 · 阅读约 8 分钟 · 作者:RapDuo 团队

AI 说唱视频效果好的时候,大家夸的是节拍或歌词;效果怪异的时候,原因几乎总是照片。模型必须去猜脸怎么动、嘴巴怎么发每个音节、词与词之间头会怎么摆,而只有静态图片提供足够清晰的信息,它才猜得准。这篇指南会讲清楚:什么样的照片好用,什么会悄悄毁掉效果,以及怎样挽救一张不太理想的照片。

简短版结论

  • 清晰、光线好的正面肖像,胜过好看但被遮挡的照片。
  • 整张脸要清楚可见,包括双眼和嘴巴。
  • 每张照片只放一个人。双人组合请用两张单独的照片。
  • 自然放松的表情,比夸张的表情效果更好。
  • 只使用同意出镜的成年人的照片。

模型需要看到什么

清晰、无遮挡的脸

模型要让眼睛、眉毛、脸颊、下颌和嘴唇动起来。只要其中有被遮住的部分,它就只能凭空编造。墨镜、捂住嘴的手、围巾、挡在嘴前的麦克风,或者帽檐投在眼睛上的阴影,都会导致靠猜。靠猜出来的结果往往像橡胶一样僵硬,或者慢慢飘成另一张脸。

均匀、柔和的光线

来自正前方或略偏一侧的柔光最理想,比如阴天的窗边光。半张脸上的强烈阴影会吞掉细节。逆光照片,也就是人物在明亮窗户前呈剪影的那种,很难做动画。红色夜店灯那样的极端色光,会扰乱肤色,让结果看起来不自然。

清晰度与分辨率

现在的手机照片完全够用,但必须对焦准确。被摄者移动造成的动态模糊,以及聊天软件的重度压缩,都会损失细节。可以的话,请用原图,而不是在好几个聊天里转发过的照片。

适度的头部角度

正对镜头,或者转向不超过约 30 度,口型同步效果最好。明显的侧脸只露出半张嘴,会限制嘴部动作的可信度。大幅仰头或低头也会让五官比例变形。

中性或轻微带表情的脸

微微一笑或平静的神情是最好的起点,因为它可以向任何方向变化。张大嘴的大笑,或者紧闭双眼的鬼脸,本身已经是表情的极限,动画就没有自然的发挥空间了。

取景与构图

  • 头肩照是最佳选择。脸要占据画面相当大的一部分。远景里的小脸会丢失细节。
  • 头部周围留一点空间。裁得太紧、切掉发顶或下巴,会让模型更难把头放进场景里。
  • 背景保持简单。杂乱的背景影响不大,因为舞台会替换掉它,但紧贴脸部的杂物,比如一盆植物遮住了脸颊,可能造成瑕疵。
  • 避免重度滤镜。磨皮或改变五官的美颜滤镜,让脸动起来后可能显得诡异。原始、自然的图片效果最好。

双人组合怎么选两张照片

双人组合是最受欢迎的形式,而搭配的重要性超出大多数人的想象。

  1. 画质要匹配。如果一张是清晰的肖像,另一张是颗粒粗糙的夜景,差距会很明显。尽量选清晰度和光线相近的两张。
  2. 制造性格反差。一个放松的人搭一个严肃的人,或者一高一矮,会给视频带来喜剧效果。
  3. 构图略作变化。两张一模一样的裁切会显得重复。距离或角度略有不同就很好。
  4. 避免衣服和颜色撞款。如果两位表演者都穿着白衬衫、靠着浅色墙面,他们会糊在一起。

常见问题与应对办法

唯一的照片戴着墨镜或口罩

尽量找一张别的。如果真的没有替代品,结果也许仍能靠喜剧效果过关,但要做好心理准备:眼神不够生动,被遮住的部位周围动画也不可预测。

照片偏暗或颗粒很粗

上传前,先在手机自带的编辑器里稍微调亮,但不要加重度滤镜。略微提高曝光,提亮阴影。不要把锐化拉得太高,那会制造出假的边缘。

人物在画面里太小

裁剪成头肩照。裁剪并不能补上拍摄时没捕捉到的细节,所以如果原图分辨率很低,请另找更好的来源。

照片是合影

把其中一个人裁出来。请确保你保留脸部的每个人都已经同意。

视频里的脸一直在变

这叫做“身份漂移”。角度特殊、表情夸张、输入质量很差时更容易发生。试试更正面、光线更均匀的照片,并缩短视频时长。片段越短,模型“跑偏”的时间就越少。

眼镜引起奇怪的反光

普通的透明眼镜通常没问题。镜框很粗、反光很强的眼镜可能造成瑕疵。请选镜片没有反射强光的照片。

绝对不能使用的照片

  • 任何未满 18 岁的人。RapDuo 仅限成年人使用。任何情况下都不要上传儿童或青少年的照片。
  • 没有同意的人。朋友、同事和家人都应该先点头。拿不准的话,先给他们看看。
  • 陌生人,或从社交媒体上扒下来的照片。有人在网上发了照片,不代表他同意被做成视频。
  • 名人和公众人物。使用真实公众人物的肖像会引发严重的法律和伦理问题,而且我们的可接受使用政策禁止冒充他人。
  • 私密或露骨的图片。绝对不允许。

隐私:你的照片会怎么处理

上传的照片只用于制作你的视频。根据我们的隐私政策,源照片会在任务完成后 24 小时内删除;生成的视频保留 30 天后删除,你也可以更早自行删除。我们不会用你的照片训练 AI 模型。

上传前的快速自查清单

  1. 整张脸是否可见,包括双眼和嘴巴?
  2. 照片是否清晰、光线是否均匀?
  3. 画面里是否只有一个人?
  4. 头部角度是否接近正对镜头?
  5. 这个人知情并且同意吗?
  6. 这个人是成年人吗?

如果六个问题的答案都是“是”,你就可以开始了。前往生成器,上传照片,用 Google 账号登录即可做出你的第一个(带水印、仅可在线观看的)视频。想了解接下来的步骤,请阅读如何制作 AI 说唱视频;想找歌词灵感,可以看看30 个 AI 说唱视频创意主题。

做你自己的 AI 说唱视频

上传两张照片,选个舞台,用 Google 账号登录即得 3 积分,做你的第一条带水印的试看视频。

做我的第一个视频

相关指南