Comment faire la vidéo Hotel Lobby AI
Il y a trois façons de la faire. Elles diffèrent par le coût et l'effort, et surtout par la fidélité aux gestes d'origine. Commencez par les photos, puis choisissez une méthode.
Mis à jour le 25 septembre 2026
Avant de commencer : les deux photos qui marchent
Chaque méthode part des photos, et ce sont elles qui décident l'essentiel du résultat. Choisissez-les bien une fois et vous pourrez les réutiliser pour les trois méthodes.
- Une personne par photo. Recadrez les photos de groupe pour ne garder que la personne voulue.
- Face à l'objectif. Un visage de face, les deux yeux visibles, s'échange bien mieux qu'un profil ou une tête penchée.
- À mi-corps ou en pied. La tenue passe dans la vidéo, alors incluez-la.
- Une bonne lumière, homogène. Pas de filtres marqués, de lunettes de soleil ni de mains devant le visage.
- Un original net. Utilisez la photo elle-même, pas une capture d'écran floue.
Décidez dès maintenant qui se place à gauche et qui à droite. Dans la performance originale, les deux côtés n'ont pas les mêmes gestes : ce choix change qui fait quoi.
Méthode 1 – Générateur en un clic (mêmes gestes, son d'origine)
C'est la seule méthode qui garde la chorégraphie d'origine. Le générateur part de la vraie performance et remplace les deux artistes par les personnes de vos photos : chaque geste, chaque demi-tour et chaque temps tombent au bon endroit.
1Importez deux photos
Descendez jusqu'au générateur en haut de la page d'accueil et ajoutez une photo pour la place de gauche et une pour celle de droite. Une personne par photo. Utilisez le bouton d'inversion si vous les voulez dans l'autre sens.

2Vérifiez l'aperçu
Cliquez sur Générer l'aperçu. En une minute environ, vous obtenez une image des deux personnes dans la cabine orange. Si un visage ne va pas, réessayez ou changez de photo avant de dépenser des crédits pour la vidéo.

3Recevez votre vidéo
Cliquez sur C'est bon, créer la vidéo. Le clip de 15 secondes prend environ 7 minutes et s'enregistre dans Mes vidéos, vous pouvez donc quitter la page. Téléchargez le MP4 et publiez-le.

- Durée
- Environ 1 minute pour l'aperçu, 7 pour la vidéo
- Résultat
- MP4 16:9, 15 secondes, son d'origine
- Coût
- 150 crédits par vidéo, aperçu inclus
- Filigrane
- Aucun
Méthode 2 – Modèle CapCut (gratuit, mais c'est un échange de visages)
CapCut propose des modèles Hotel Lobby créés par des utilisateurs. Ils sont gratuits et rapides, mais un modèle est une vidéo toute faite où votre photo est collée sur les visages : les corps, les gestes et le timing appartiennent à la personne qui a créé le modèle.
- Ouvrez CapCut (appli mobile ou version ordinateur) et allez dans Modèles.
- Recherchez hotel lobby et ouvrez un modèle dont l'aperçu montre la cabine orange.
- Touchez Utiliser le modèle et ajoutez vos photos dans l'ordre demandé par le modèle.
- Regardez le résultat, puis exportez et partagez.
Le hic
- Les gestes ne correspondent pas à l'original. Vous obtenez le clip du créateur du modèle avec de nouveaux visages par-dessus.
- Les exports gratuits peuvent porter un filigrane ou un écran de fin CapCut.
- La durée, les coupes et le cadrage sont fixés par le modèle : impossible de l'allonger ou d'en changer le rythme.
- Les modèles vont et viennent. Si l'un disparaît, relancez une recherche.
Méthode 3 – Écrire votre propre prompt (Kling, Veo, Sora)
Si vous préférez le faire vous-même, n'importe quel modèle vidéo actuel peut s'approcher de ce rendu. Kling, Veo et Sora acceptent tous un prompt texte et une image de départ facultative. Partir d'une photo de vos deux personnes (image-to-video) garde des visages bien plus fidèles que le texte seul.
Partez de ce prompt et adaptez les personnes et les tenues :
Vertical 9:16 video. A seamless matte-orange studio booth: curved backdrop and floor in the same flat orange, soft even light, no visible edges or corners. A single black microphone hangs from the ceiling on a thin cable, centered between the two performers. Two people stand side by side, facing the camera. They take turns performing a rap verse straight to the lens: pointing at the camera, gesturing with their hands, stepping and turning on the beat, while the other one nods along. Locked-off camera at chest height, full bodies in frame, no zoom, no cuts. No captions, no subtitles, no text, no logos.
Des variantes pour couples, animaux, enfants et vidéos en solo, ainsi qu'un prompt négatif et des réglages, se trouvent sur la page des prompts Hotel Lobby AI.
Attendez-vous à du hasard. Le même prompt donne des gestes différents à chaque fois, et aucun modèle ne reproduit la chorégraphie d'origine à partir du seul texte. Prévoyez plusieurs essais et gardez le meilleur.
Problèmes fréquents
- Le visage ne ressemble pas à la personne
- Prenez une photo plus nette, de face, avec une lumière homogène, et recadrez pour que le visage soit plus grand dans l'image. Retirez les lunettes de soleil et les filtres marqués.
- Les personnes ne sont pas du bon côté
- Dans le générateur, inversez les photos de gauche et de droite. Dans un prompt, décrivez chaque personne par sa position, par exemple "on the left, a woman in a red jacket".
- Le fond n'est pas orange
- Cela arrive avec les prompts et certains modèles. Placez "seamless matte-orange studio booth" au début du prompt et ajoutez "background color other than orange" au prompt négatif.
- Les lèvres ou le son sont décalés
- Les modèles et les vidéos issues de prompts ne sont pas calés sur la chanson. Alignez le début dans votre éditeur, ou ajoutez le son dans TikTok et décalez-le. Le générateur garde le timing d'origine.
Quelle méthode choisir ?
| Comparatif | Générateur en un clic | Modèle CapCut | Votre propre prompt |
|---|---|---|---|
| Coût | Payant, par vidéo | Gratuit | Offres gratuites, puis crédits payants |
| Durée | Environ 8 minutes | Environ 10 minutes | Variable, plusieurs essais |
| Gestes | Identiques à l'original | Ceux du créateur du modèle | Aléatoires, rarement proches |
| Filigrane | Aucun | Possible sur les exports gratuits | Selon l'outil |
| Son | Piste d'origine | Le son du modèle | À ajouter vous-même |
En bref : si vous voulez que ça ressemble au vrai, utilisez le générateur. Si vous voulez du gratuit et du rapide et que des gestes différents ne vous gênent pas, prenez un modèle CapCut. Si vous aimez bricoler, écrivez un prompt.
FAQ du tutoriel
Combien de temps faut-il pour faire une vidéo Hotel Lobby AI ?
Avec le générateur de ce site, environ 8 minutes : une minute environ pour l'aperçu et 7 pour la vidéo. Un modèle CapCut prend une dizaine de minutes, export compris. Écrire votre propre prompt prend plus de temps, car il faut en général plusieurs essais.
Puis-je faire la vidéo Hotel Lobby AI gratuitement ?
Oui, avec un modèle CapCut ou l'offre gratuite d'un modèle vidéo, mais aucun des deux ne reprend les gestes d'origine. Le générateur d'ici fonctionne avec des crédits : les nouveaux comptes en reçoivent assez pour deux aperçus, et une vidéo coûte 150 crédits, aperçu inclus.
Pourquoi ma vidéo ne suit-elle pas les gestes d'origine ?
Les modèles CapCut et les prompts texte n'utilisent pas la performance originale : les gestes sont ceux du créateur du modèle ou sont inventés par l'IA. Seul un outil qui part de la performance originale garde la chorégraphie.
Quelles photos utiliser ?
Une personne par photo, face à l'objectif, avec une bonne lumière, à mi-corps ou en pied pour que la tenue passe dans la vidéo. Recadrez d'abord les photos de groupe.
Prêt à mettre vos proches dans la cabine ?
Importez deux photos, vérifiez l'aperçu et recevez un MP4 de 15 secondes avec le son d'origine.