一段录好的生日祝福
对着手机用说唱的方式喊十秒“生日快乐”,再把你和寿星放进录音棚,让你们来表演。
你的声音,他们的录音棚
可以,Hotel Lobby 音轨能换成你自己的音频。上传两张照片,再加 2 到 15 秒的歌、语音备忘录或录好的生日祝福,橙色录音棚里的说唱者就会对着你的文件对口型,搭档在旁边助兴。用你的音频不额外加钱。
Hotel Lobby Video (hotel-lobby-video.com) 支持用你自己的歌做 Hotel Lobby AI 视频。在“配乐和动作”里选“自选歌曲”(本页已经帮你选好),上传 MP3、WAV、M4A、AAC 或 OGG 文件,拖到你想要的段落;主唱会在 Wan 3.0 上对着这一段对口型。480p 下 12 秒 6 积分,和用默认音轨完全一样。
最近更新:
背后的原理
每条 Hotel Lobby AI 视频由三样输入决定。两张照片决定录音棚里站的是谁;一段参考编舞决定场景、构图和动作;一条参考音轨决定主唱对着什么张嘴,你不改的话,这条音轨就是 Hotel Lobby。
上传自己的音频,只会替换最后这一样。录音棚、镜头和搭档的动作都不变,只是主唱改为对着吊麦唱出或念出你的内容。浏览器会从你拖到的起点开始,把文件剪成和视频一样长(最多 15 秒)。
想的话,还可以再配一段你自己的参考视频:视频负责动作,你的音频负责对口型。不管上传什么,都请确认你有权使用。
从一个字开始,别从静音或长长的前奏开始,挑人声响亮清楚的一段。副歌或者一句梗,放在 10 到 12 秒里通常效果最好。说话的语音和说唱一样好用。
从上传到下载
每人一张清晰照片。左边的照片是要对着你的音频张嘴的主唱,右边的是负责反应的搭档。
“配乐和动作”里已经选好“自选歌曲”,直接上传就行。录音比视频长的话,拖动滑块到你想要的部分。
不管选哪种声音,标准 12 秒视频都是 6 积分。看一遍,存下 MP4;万一渲染失败,积分会自己退回。
上传什么好
对着手机用说唱的方式喊十秒“生日快乐”,再把你和寿星放进录音棚,让你们来表演。
准备发歌?用副歌当音频,用乐队两位成员的照片,预告片就搭上了潮流的顺风车。
就是大家都爱引用的那一条,用 COLORS 现场的架势演出来。短一点、吐字清楚的片段同步得最好。
为朋友写一段词,随便配个伴奏录下来,让主唱在录音棚里唱给大家听。
| 能做 | 不能做 |
|---|---|
| 让主唱表演你的歌、说唱或语音备忘录 | 让两个人一起唱你上传的音频(改用 AI 说唱并勾选 Both rap) |
| 最多用 15 秒,正好是一条普通 TikTok 或 Reels 的长度 | 把整首歌做成完整的 MV |
| 跟着你录音里的歌词和节奏走 | 克隆名人的声音,或保证和你的文件一模一样 |
| 在 Wan 3.0 上运行,可以在 Hotel Lobby 录音棚里,也可以配你自己的视频 | 帮你清理嘈杂的音频;人声清楚时同步最好 |
更想要一段别人替你写好的词?AI 说唱视频生成器会用 Seedance 模型,按你的主题创作一段原创说唱。
别处做的
这些视频来自其他创作者和其他工具,展示的是这种形式,不代表 Hotel Lobby Video 会为你做出同样的效果。每条都标明并链接到了作者。
能。用手机浏览器打开本页,加两张照片,再从文件或语音备忘录里选音频。iPhone 录的 M4A 会在浏览器里自动转换。
MP3、WAV、M4A(大多数手机语音备忘录就是这个格式)、AAC 或 OGG。MP3 原样上传,其他格式会先在浏览器里转换。视频会从你设的滑块位置开始,用其中 2 到 15 秒。
不会,音频不收费。价格只由模型、时长和清晰度决定:Wan 3.0、480p 下,5、8、10、12 或 15 秒分别是 3、4、5、6 或 7 积分。
在这里没有。每条视频都要用积分支付,用你的歌和用默认音轨一个价:12 秒 6 积分。积分包 10 积分 $9.99 起,渲染失败自动退款。
不能。你上传的音频只由主唱对口型,搭档负责反应和跳舞。想要两个声音轮流唱,可以在 Seedance 模型上用 AI 说唱并勾选 Both rap;或者做两条视频、把照片对调,再拼到一起,做法见两个人,一首歌。
左边的主唱对着吊麦唱出你的音频。右边的搭档像原版那样,跟着节拍指指点点、做反应、跳舞。
只有在你拥有这份录音版权时才可以。想用正版歌曲发帖,请在发布时从 TikTok、Reels 或 CapCut 自带的音乐库里添加。
可以。在“视频”里选一个 Seedance 模型,把声音设成 AI 说唱,输入最多 120 个字符的主题。模型会写一段原创歌词和伴奏;这时它会忽略你上传的音频,并且被要求不得照搬现有歌曲。
没关系。多长的文件都能上传,但只会用其中 2 到 15 秒。浏览器会把文件剪到你选的那一段,上传也更快。
用人声清楚、背景噪音少的录音,并让选段从一个字开始,而不是从静音开始。说唱和说话都能对得很好。