Prompts Hotel Lobby AI : notre prompt exact et 5 à copier
En ligne, presque chaque prompt Hotel Lobby AI est une supposition. Pas ceux-ci : ce sont les prompts que notre générateur utilise pour les vidéos Hotel Lobby. Le premier sert à notre modèle par défaut, Wan 3.0, qui garde la piste Hotel Lobby ; le second est la version Seedance, qui écrit un rap original. Copie-les, adapte-les à ton outil, ou passe-t’en et laisse le générateur faire le travail. Plus bas, cinq prompts pour les outils qui ne prennent que deux photos : un couple, deux meilleurs amis, un grand-parent et son petit-enfant, des personnages illustrés et des animaux.
Actualisé le
Le prompt Hotel Lobby AI complet
Voici la version pour deux photos, quel que soit le format : le ratio est transmis au modèle comme réglage, pas dans le texte. Avant le rendu, chaque photo est redessinée en portrait de studio en pied de la même personne ou du même animal (GPT Image 2), et le modèle reçoit quatre pièces jointes dans cet ordre : l’Image 1 est le portrait de gauche, l’Image 2 celui de droite, la Vidéo 1 le clip de référence Hotel Lobby sans son et l’Audio 1 la piste Hotel Lobby, coupée à la même durée.
Suis la Vidéo 1 du début à la fin : copie son cadrage, son rythme et chaque mouvement, geste, tour de tête, expression et forme de bouche, ainsi que le fond orange uni et le micro argenté suspendu au plafond entre les deux artistes. Garde le cadrage de la Vidéo 1 : pas de zoom avant, pas de zoom arrière, pas de panoramique. N’ajoute aucun mouvement ni élément de décor absent de la Vidéo 1.
Utilise l’Audio 1 comme musique de fond de toute la vidéo, tel quel : c’est tout le son de la vidéo. N’écris pas de nouvelles paroles, ne le rechante pas, n’ajoute ni autre musique ni autres voix.
L’artiste de gauche est le sujet de l’Image 1 ; l’artiste de droite est le sujet de l’Image 2. Ils remplacent complètement les deux personnes de la Vidéo 1 : visage, coiffure ou pelage, silhouette et vêtements viennent des photos, rien des personnes de la Vidéo 1. Aucun des deux ne porte de gants (sauf s’il en porte déjà sur la photo) : les personnes montrent leurs propres mains, les animaux gardent leurs propres pattes. Ignore le fond des photos.
L’artiste de gauche rappe au micro la voix de l’Audio 1, les lèvres parfaitement synchronisées sur l’Audio 1. Celui de droite suit les mouvements de la personne de droite dans la Vidéo 1 : il réagit et fait des gestes en rythme, et ne mime que de courts ad-libs.
L’orange remplit tout le cadre, sans zones noires ni coins sombres. Pas d’écran partagé, pas de personnes en trop, pas de sous-titres ni de texte à l’écran. Les visages restent les mêmes du début à la fin.La version rap IA (Seedance)
Sur Seedance, le son est toujours un rap IA : le modèle écrit lui-même une nouvelle chanson. Dans la cabine Hotel Lobby, il entend la piste de Hotel Lobby pendant qu’il écrit : le clip de référence part sans son, la piste part à part comme audio de référence 1, et le prompt demande une nouvelle prod qui suit son rythme, avec de nouvelles paroles et sans sa mélodie ni ses voix. Les pièces jointes sont nommées en toutes lettres (« image de référence 1 »). Celui-ci est écrit pour le thème d’exemple qu’il contient. Le prompt demande de rapper dans la langue du thème : un thème écrit en français donne un rap en français.
Utilise la vidéo de référence 1 pour toute la performance : copie son cadrage, son rythme et chaque mouvement, geste, tour de tête, expression du visage et mouvement de bouche, le fond orange uni et l’unique micro argenté suspendu entre les artistes. Garde le cadrage de la vidéo de référence 1 : pas de zoom avant, pas de zoom arrière, pas de panoramique. N’ajoute aucun mouvement ni élément de décor absent de la vidéo de référence 1.
Artiste de gauche : la personne de l’image de référence 1. Artiste de droite : la personne de l’image de référence 2. Ils remplacent complètement les deux personnes de la vidéo de référence 1 : visage, cheveux, corps et vêtements viennent des photos, rien des personnes de la vidéo de référence 1. Si une photo ne montre aucun vêtement d’une personne (juste le visage ou les épaules nues), habille-la de vêtements simples du quotidien qui lui vont, comme un t-shirt uni et un jean ; jamais le costume, la cape, le manteau, les ceintures, les gants ou le bandeau sur les yeux des personnes de la vidéo de référence 1. Les animaux restent tels quels, sans vêtements. Ignore le fond des photos.
Bande-son : un morceau original de trap sombre d’Atlanta fait pour cette vidéo, qui suit l’audio de référence 1 pour le beat et le rythme : même tempo, même groove, même motif de batterie et même rebond, calés sur les mouvements de la vidéo de référence 1. Fais une nouvelle prod dans ce style avec de nouvelles paroles ; ne reprends ni les paroles, ni la mélodie, ni les voix de l’audio de référence 1. Épuré mais percutant : une 808 lourde et granuleuse qui glisse entre les notes, une caisse claire doublée d’un clap perçant avec des hi-hats secs, et une seule boucle de mélodie inquiétante aux accents orientaux. Ambiance sombre, menaçante et sûre d’elle. Le rap est un flow en triolets rapide et rebondissant qui file au-dessus du beat lent. Mix : la voix bien claire au-dessus, la prod juste derrière presque au même niveau, forte et percutante, jamais faible et sans jamais s’arrêter entre deux phrases. L’artiste de gauche rappe dans le micro suspendu un couplet original et propre sur : « les 30 ans de Maya et ses créneaux catastrophiques ». Rappe dans la langue de ce thème. Voix rap claire, lèvres synchronisées sur chaque mot, hochements de tête naturels et bouche expressive. L’artiste de droite est le pote qui ambiance : il pointe le rappeur du doigt, réagit, sourit et ajoute de courts ad-libs sur le beat. N’utilise ni chanson existante, ni paroles existantes, ni la voix d’un artiste réel.
9:16. L’orange remplit tout le cadre d’un bord à l’autre, sans zones noires ou sombres. Pas d’écran partagé, pas de personnes en trop, pas de sous-titres ni de texte à l’écran. Les visages restent les mêmes du début à la fin.Le rôle de chaque partie
- Les mouvements. Le premier paragraphe confie tout à la Vidéo 1 : son cadrage, son timing et chaque mouvement, geste, tour de tête, expression et forme de bouche, le fond orange uni et l’unique micro argenté suspendu entre les deux. Il garde la caméra immobile (ni zoom avant, ni recul, ni panoramique) et exclut tout ce que le clip ne contient pas.
- Le son. L’Audio 1 est toute la bande-son et reste telle quelle : pas de nouvelles paroles, pas de voix rechantée, aucune autre musique ni voix.
- Les identités. Chaque image est liée à un côté, et les deux sujets remplacent complètement les deux personnes du clip : visage, cheveux ou pelage, corps et vêtements viennent des images, le fond est ignoré. Le prompt dit « le sujet de l’Image 1 », pas homme ou femme, donc il convient à une personne comme à un animal et ne contredit jamais la photo. Il exclut aussi les gants : les deux danseurs de notre clip de référence en portent, et le modèle les recopiait sur les mains et les pattes.
- Les rôles. La personne de gauche rappe la voix de l’Audio 1, les lèvres synchronisées ; celle de droite copie le pote qui ambiance dans le clip, réagit et fait des gestes sur le beat, avec seulement de courts ad-libs.
- Les garde-fous. L’orange d’un bord à l’autre sans coins noirs ni sombres, pas d’écran partagé, personne en plus, pas de sous-titres, des visages identiques du début à la fin. Ces consignes évitent les ratés les plus fréquents.
L’utiliser dans un autre outil vidéo IA
- Il faut un modèle qui accepte des images de référence, une vidéo de référence et une piste audio de référence, et qui garde la piste. Wan 3.0 le fait ; ByteDance Seedance 2.x accepte les trois, mais a écrit une nouvelle musique dans nos tests.
- Nomme les pièces jointes comme ton outil l’attend. Ici, elles sont numérotées dans l’ordre d’envoi (Image 1, Image 2, Vidéo 1, Audio 1) ; certains outils veulent @Image1 ou leurs propres balises. Garde l’ordre : la photo de gauche d’abord, celle de droite ensuite.
- Garde des mots neutres pour les deux personnes. « Le sujet de l’Image 1 » va à n’importe qui sur l’image, personne ou animal ; notre générateur ne change que la disposition des photos (deux photos ou une des deux) et, avec ton propre clip, les mouvements.
- Le format n’est pas dans le texte : choisis 9:16, 16:9 ou 1:1 dans les réglages de l’outil.
- Sans clip de référence, décris la cabine et les mouvements avec des mots au lieu de renvoyer à la Vidéo 1. Des outils comme Dreamina publient leurs propres prompts en texte seul pour ça. Nous n’avons testé que les versions ci-dessus.
Prompts Hotel Lobby AI pour deux photos, sans clip de référence
Beaucoup d’outils vidéo IA acceptent des photos de référence, mais pas de clip de référence. Ces cinq prompts décrivent donc la cabine et les mouvements avec des mots, pour que tu puisses les coller dans un outil image-vers-vidéo qui accepte deux photos. Ils gardent les règles qui font marcher le format : une photo par côté, un seul micro suspendu, une personne qui mène pendant que l’autre réagit, et une caméra qui ne bouge jamais. Nous les avons écrits pour ce guide et ne les avons pas testés ; chaque outil lit les prompts un peu différemment, donc prévois un ou deux essais de plus. Les prompts restent en anglais, car les outils vidéo IA suivent bien les consignes en anglais ; tu peux les traduire si ton outil préfère le français.
Prompt Hotel Lobby AI pour un couple
Create a 12-second vertical 9:16 video from two reference photos. The person in image 1 stands on the LEFT and the person in image 2 on the RIGHT, both full body, each keeping their own face, hair, clothes and height. They are a couple performing a rap duet in a plain, evenly lit orange studio: orange wall and floor, nothing else in the room. One silver condenser microphone hangs from the ceiling on a thin cable, centered between them. The left performer raps into the microphone with confident hand gestures; the right performer laughs, points and dances on the beat, then leans in for the last line. One continuous shot from a fixed camera at chest height: no cuts, zooms or pans. No other people, no captions, no logos.Pour deux meilleurs amis
Create a 12-second vertical 9:16 video from two reference photos of two adult best friends. Image 1 is on the LEFT, image 2 on the RIGHT, both full body, keeping each face, hairstyle, outfit and body shape exactly. Setting: a plain orange studio with a seamless orange wall and floor and one silver microphone hanging from the ceiling between them. For the first half the left friend raps into the microphone while the right friend nods, grins and hypes with big gestures; for the second half they swap, and the left friend reacts. Their moves stay independent, never mirrored. Fixed camera, one continuous take, soft even light, both bodies and feet visible. No extra people, props, text or logos.Pour un grand-parent et son petit-enfant
Create a 12-second vertical 9:16 video from two reference photos. Image 1 is an older adult on the LEFT and image 2 is their adult grandchild on the RIGHT, both full body, each keeping their own face, hair, clothes and height. They perform a rap duet in a plain orange studio with one silver microphone hanging from the ceiling between them. The grandparent raps into the microphone with slow, deliberate, confident gestures; the grandchild looks amazed, laughs and dances on the beat, then joins in for the last line. Natural, comfortable movement for both. One fixed, continuous shot with even studio light: no cuts, zooms or pans, no other people, no captions.Pour des personnages d’anime ou de dessin animé
Utilise des personnages que tu as dessinés ou dont tu as les droits ; les personnages connus appartiennent à quelqu’un d’autre.
Create a 12-second vertical 9:16 video from two reference images of original illustrated characters. The character in image 1 stands on the LEFT and the character in image 2 on the RIGHT, full body, each keeping its art style, colors, proportions and outfit exactly; render both in that same style. They perform a rap duet in a plain orange studio with one silver microphone hanging from the ceiling between them. The left character raps into the microphone with expressive hand gestures; the right character reacts, points and dances on the beat. One fixed camera, one continuous take, no cuts, zooms or pans. No extra characters, no text, no logos.Prompt Hotel Lobby AI pour animaux
Des chats et des chiens ont fait partie des premiers clips Hotel Lobby viraux, créés avec d’autres outils (à voir ici). Utilise une photo nette par animal, le corps entier visible.
Create a 12-second vertical 9:16 video from two reference photos of pets. The animal in image 1 stands upright on its hind legs on the LEFT and the animal in image 2 on the RIGHT, each keeping its breed, face, eye color, fur pattern, size and collar. They are in a plain orange studio with one silver microphone hanging from the ceiling between them. The left animal moves its mouth to the beat and gestures with its front paws as if rapping into the microphone; the right animal bobs its head, looks at the camera and dances on the beat. Natural anatomy: four legs and one tail each, both fully visible from ears to paws. One fixed, continuous shot. No people, no extra animals, no text.Sur notre générateur, tu n’as besoin d’aucun de ces prompts, ni pour des personnes ni pour des animaux : le prompt est intégré, et la page de vidéo de rap pour animaux le prépare pour ton animal et son duo. Nous avons testé un chien à côté d’une personne ; les chats et deux animaux ensemble ne sont pas encore testés.
Problèmes fréquents et solutions
| Problème | Cause probable | Solution |
|---|---|---|
| Les visages dérivent ou ressemblent à quelqu’un d’autre | Profil, lunettes de soleil ou visage trop petit sur la photo | Utilise des photos de face, bien éclairées, cadrées à la taille |
| Les deux personnes changent de côté | Le prompt ne lie pas chaque photo à un côté | Nomme la personne de gauche et celle de droite avec leur image |
| Une troisième personne apparaît | Le modèle copie des gens de la référence ou du fond d’une photo | Garde « pas de personnes en trop » et « ignore le fond des photos » |
| Du texte apparaît à l’écran | Le modèle ajoute des sous-titres | Garde « pas de sous-titres ni de texte à l’écran » |
| Les lèvres ne suivent pas l’audio | Pas d’audio joint, ou l’audio commence sur un silence | Joins la piste et fais-la commencer sur un mot |
| Des bords noirs autour de l’orange | Le prompt demande un mouvement de caméra que le clip n’a pas | Garde le cadrage du clip et demande de l’orange d’un bord à l’autre |
| Une nouvelle musique à la place de la piste | Le modèle écrit sa propre bande-son (Seedance 2.x l’a fait dans nos tests) | Utilise un modèle qui garde la piste de référence, comme Wan 3.0 |
Ou passe-toi du prompt
Sur Hotel Lobby Video, ce prompt, le clip de référence et la piste de référence sont intégrés. Tu ajoutes deux photos et tu lances la création. Une vidéo de 12 s avec Wan 3.0 en 480p coûte 6 crédits.
Questions fréquentes
Quel est le meilleur prompt pour la trend Hotel Lobby AI ?
Un prompt qui fixe la cabine, le micro suspendu unique, le côté de chaque photo et ce que fait chaque personne. Celui ci-dessus est celui que notre générateur utilise pour chaque vidéo.
Avec quel modèle IA ce prompt fonctionne-t-il ?
Nous utilisons le premier avec Wan 3.0, qui garde la piste de référence, et la version rap IA avec Seedance 2.x, qui écrit sa propre musique. Les deux acceptent des images de référence, une vidéo de référence et une piste audio de référence. Les autres modèles ont leur propre syntaxe de mention et n’acceptent pas forcément les trois.
Existe-t-il un prompt Hotel Lobby AI pour les animaux ?
Oui, le prompt pour animaux ci-dessus, pour les outils qui acceptent deux photos : une photo par animal, chacune liée à un côté, debout avec une anatomie naturelle. Sur Hotel Lobby Video, aucun prompt n’est nécessaire : la [page de vidéo de rap pour animaux](/dog-and-cat-rap-video) est déjà prête pour ton animal et son duo. Nous avons testé un chien à côté d’une personne ; les chats et deux animaux ensemble ne sont pas encore testés.
Puis-je coller ces prompts dans Dreamina, Kling ou un autre outil ?
Les cinq prompts à deux photos sont écrits pour les outils image-vers-vidéo qui acceptent deux photos de référence. Nomme les photos comme ton outil le fait et garde la gauche et la droite fixes. Nous ne les avons pas testés dans d’autres outils.
Faut-il un prompt pour faire une vidéo Hotel Lobby AI ?
Pas avec un générateur à deux photos. Sur Hotel Lobby Video, le prompt est intégré ; tu ajoutes seulement les photos.
Références
Ensuite, à lire
Comment faire la trend Hotel Lobby : 3 méthodes pas à pas
Trois méthodes pour faire la trend Hotel Lobby avec l’IA (générateur à deux photos, prompt dans un modèle vidéo IA, template de montage), avec les étapes, les prix, les options gratuites et nos conseils
Meilleurs générateurs de vidéos Hotel Lobby IA (oct. 2026)
Un comparatif daté des outils de la trend Hotel Lobby (Hotel Lobby Video, Rap Duo AI, LightX, Dreamina, Media.io, Summrs, Fuzana, Kapwing), d’après leurs propres pages
Quelles photos pour Hotel Lobby IA ? Ce qui marche le mieux
Une checklist des photos pour Hotel Lobby IA : quoi choisir, ce que le portrait redessiné fait à ta photo, deux photos ou une seule, et ce que de meilleures photos ne règlent pas
Hotel Lobby Video est un service indépendant, qui n’a aucun lien avec Quavo, Takeoff, Migos, Quality Control Music, Motown ni COLORS.
