AI 说唱生成器到底做什么
AI 说唱生成器会根据一个主题生成一首原创说唱:歌词、演唱它的声音,以及底下的节拍。大多数工具只做到音频。RapDuo 更进一步,把表演也呈现出来。你提供脸,我们把它们放到电影感舞台上,让嘴型动起来,与人声完全对上。
背后有四个环节。歌词写手把你的主题写成押韵、有节奏的 verse。人声模型用自然的说唱节奏演绎出来。节拍按速度匹配生成。最后视频模型让你的照片动起来,套上舞台的画面风格,并把口型和音频对齐。这些你都不用碰,只要说出你想要什么。
怎么写出好歌词的主题
影响质量最大的杠杆就是主题。模糊的主题会得到泛泛的歌词,具体的主题才会写出像是专门为你写的句子。写清楚谁在说唱、他们是什么关系,再加一两个生动的细节。你不用自己写押韵,通常不写效果反而更好。
- 差的写法:“一首关于我朋友的说唱”。好的写法:“小诺,我室友,养了十四盆植物,每盆都有名字”。
- 给个情绪:自豪、搞笑、感动,或三者混合。
- 提一个地点或物件,让押韵有东西可抓。
- 控制在两句话以内。太长的段落会被压缩,具体细节就丢了。
选择舞台
舞台就是表演者所处的世界。“录音棚”是有情绪的霓虹录音室氛围,是精致、认真风格的最佳默认选择。“酒店大堂”温暖、偏琥珀色,最适合原生态的一条过即兴说唱。“奢华大厅”是大理石与金色,适合庆祝和炫耀。“街头 Cypher”是夜晚街区,适合兄弟围圈的氛围。每一个都是原创的插画式环境,不是对任何真实地点或作品的复制。
想要口型同步干净,照片这样选
- 面朝前方,眼睛看镜头,嘴巴放松或微微带笑。
- 光线均匀:柔和的自然光比刺眼的顶灯好。
- 不要墨镜、重度滤镜,也不要用手挡住嘴。
- 每张照片一张清晰的脸。用一张共用合照的话,确保两个人都靠近镜头。
- JPG、PNG 或 WebP,最大 8 MB。分辨率高有帮助,但清晰度比尺寸更重要。
语言、等级与时长
说唱语言可以从英语、西班牙语、葡萄牙语、法语、意大利语和中文中选。登录后还可以选等级:Lite 是适合社交平台短片的高效默认选项,Pro、Ultra 和 Ultra Plus 则提供更清晰的细节、更高分辨率和更长的最大时长,适合想要更精致成品的人。时长用滑块调节,确认之前会实时显示积分总数。
一个实用的流程是:先做一个 5 秒的 Lite 480p(注册赠送的积分就够),确认照片和主题没问题,也方便分享。只有需要更大屏幕或更长时间时,再升级到更高等级。
版权、安全与原创性
输出内容是原创的。我们不使用受版权保护的歌曲、艺人的声音或名人的肖像。你只应上传同意出镜的人的照片,也不要用这个工具去欺骗、骚扰或冒充他人。如果你公开分享短片,请标注为 AI 生成,让观众知道自己在看什么。


