直接看内容

用 AI 做狗狗说唱视频:照片、步骤和翻车对策

想让狗狗说唱,就打开宠物说唱视频页面,放一张你家狗的照片,再放一张它搭档的照片(你或另一只宠物),舞台保持 Hotel Lobby,点生成。Wan 3.0 会把它们俩放进橙色录音棚,你的狗用后腿站在吊麦前,跟着 Hotel Lobby 音轨说唱。12 秒、480p 是 6 积分,一般约 5 到 15 分钟。

最关键的决定是照片:一张清晰、正面、只有一只动物的照片,比任何设置都管用。下面依次讲:什么样的宠物照片好,每一步怎么做,生成器会怎么处理照片,声音选哪种,以及常见的意外怎么解决。猫的做法一模一样。

最近更新:

开始之前要准备什么

  • 一张狗狗的照片:画面里只有一只动物,脸朝镜头,最好拍到全身。
  • 一张搭档的照片:你、朋友或另一只宠物,每张照片一个主体。
  • 手机或电脑上的浏览器就行,不用下载 App。
  • 积分:12 秒、480p 要 6 积分。最小的积分包是 10 积分 $9.99。

狗爪握麦

开始做狗狗说唱视频

已为“宠物 + 搭档”准备好:左边照片说唱,右边照片助威。生成前就能看到要花多少积分。

1

毛孩子和它的搭档

一张照片放一只宠物或一个人。左侧说唱,右侧捧场。

2

舞台

3

画面和声音

本条:6 积分。预计大概 5 到 15 分钟完成;没做成的话积分原数退还。 价格说明

一步步做狗狗说唱视频

  1. 打开宠物说唱视频页面,那里的生成器已经按“宠物 + 搭档”设置好了。
  2. 想让狗当说唱者,就把它的照片放左边;想让它当助威搭档,就放右边。
  3. 把搭档的照片放进另一个位置。
  4. 舞台保持 Hotel Lobby,模型保持 Wan 3.0。选时长(5、8、10、12 或 15 秒)和画面比例:默认 16:9,发抖音、TikTok 和 Reels 选 9:16。
  5. 在「视频和声音」里选声音:Hotel Lobby 音轨、「你的歌」,或者 Seedance 模型上的 AI 说唱。
  6. 点生成。第一次要用 Google 登录;扣费之前,按钮上会显示积分。
  7. 做好后下载 MP4,「我的视频」里也会留一份。

为什么你的狗会在录音棚里站起来

渲染之前,生成器会把每张照片重画成一张全身影棚照:还是同一只动物或同一个人,在纯色背景前直立站着。狗之所以用后腿站着,就是因为这一步。接着视频模型用这两张影棚照,照搬录音棚里的整套动作。你只会看到自己上传的原图;影棚照只用于渲染,7 天后和你的照片一起删除。

下面的图用 AI 生成的图片演示这个过程:一张生成的柯基照片,以及成片中的一帧。

给宠物选哪种声音

声音播放的内容模型
Hotel Lobby 音轨潮流原版的那段词,主唱的嘴跟着它动Wan 3.0
「你的歌」或任意录音你选中的那段音频;主唱对口型Wan 3.0
AI 说唱围绕你的主题现写的说唱,比如“华夫才是这张沙发的老大”Seedance

录下来的一声狗叫或猫叫,也能当作「你的歌」上传(MP3、WAV 或 M4A)。把橙色框拖到想用的部分,2 到 15 秒。动物的声音没什么节奏感,口型会比配人声时松散一些。

一条狗狗说唱视频示例

X
暹罗猫和黑猫轮流开唱,把这个热潮带火的猫咪版@ogfeitoza 发布于 X
X
两只吉娃娃 Chewy 和 Rocky 站起来对唱@chewychihuahua_ 发布于 X

设置:Wan 3.0,10 秒,Hotel Lobby 音轨,一位女士和一只柯基,两张都是 AI 生成的图片。柯基全程直立,跟完了整套动作,转身也没落下。这只是一次渲染,不代表每只宠物都会是这个效果。

狗狗说唱视频看着不对劲时

问题试试这样
脸不像你家狗用清晰、正面、白天拍的照片;侧脸和光线暗的照片会丢掉脸部特征。
多出一只动物或一个人把照片裁到只剩一只动物。
狗和人一样高正常现象:大小不会按比例保留,这本来就是笑点之一。
指东西时前爪变成了手这套动作里有手势,模型会照搬。再渲染一次,或者留着当笑料。
狗的嘴几乎不动把狗放在左边主唱的位置,再选音轨里人声清楚的一段。

渲染失败会自动退回积分。已经做好但你不满意的视频不退款,每次重新尝试都要另付积分。

让你的狗说唱

问答

有免费让狗狗说唱的办法吗?

没有。每条视频在生成时消耗积分:12 秒、480p 是 6 积分。最小的积分包是 10 积分 $9.99,渲染失败会退回。

猫也能这样说唱吗?

能。猫走的是同样的步骤,重画影棚照那一步也会让它站起来。效果取决于照片,所以第一次渲染就当是试试看。

我和我的狗能一起出现在视频里吗?

能。一个位置放你的照片,另一个放狗的。左边的位置说唱,右边的位置助威。

我家狗的照片是侧面的,能用吗?

也许能,但侧面照常常会丢掉脸部特征。光线好的正面照最像本尊。

狗狗说唱视频要渲染多久?

Wan 3.0 一般约 5 到 15 分钟。做好的视频保存在「我的视频」里。

Hotel Lobby Video 为独立运营的工具,跟 Quavo、Takeoff、Migos、Quality Control Music、Motown 以及 COLORS 都没有任何合作或从属关系。