Guides vidéo IA 12 min de lecture

Comment nous avons créé un influenceur IA, de A à Z

Un influenceur IA, on l’imagine souvent né d’un prompt malin entre deux gorgées de café. Le nôtre s’appelle Mila : une rédactrice mode fictive, une vidéo de 1 minute 37, 8 h 34 de travail et une facture de $85.45.

Le film final — 1 minute 37, un personnage IA, toute la production de A à Z.

Le bouton « rends-moi ça incroyable » n’existe pas

Commençons par ranger le fantasme brillant, avec douceur, comme on étouffe un coussin trop enthousiaste. Non, il n’existe pas de bouton magique qui transforme un prompt en film terminé. S’il existe, il ne nous a pas invités à la réunion.

Ce que vous venez de voir dure 1 minute 37. Il a demandé 8 h 34 de travail et coûté $85.45. Cela inclut le personnage, les tenues, les scènes, les plans studio, la voix, le lip sync et le montage — autrement dit l’endroit précis où l’optimisme vient se faire remettre à sa place.

Ce guide déroule tout le processus : les prompts associés aux plans, les ratés, les corrections et la facture. Chaque étape a sa manière bien à elle de dérailler. C’est pénible, oui. C’est aussi le vrai métier.

Voici Mila

Mila est un personnage inventé, pas une vraie personne. Elle a 27 ans, mesure environ 178 cm, porte des cheveux blond champagne sous les épaules avec une raie au milieu, des yeux en amande gris-bleu, un visage ovale légèrement en cœur, des sourcils blonds fournis et un petit grain de beauté sous l’œil droit.

Nous voulions une présence intelligente, calme, observatrice et contemporaine. Pas le cliché d’influenceuse virtuelle trop lisse, celui qui finit toujours par ressembler au même visage poli, mieux éclairé qu’un hall d’hôtel et avec moins de personnalité.

Son histoire tient en une ligne : Mila est une rédactrice mode venue de 2030, elle compose ses propres looks et les publie. Les détails distinctifs comptent énormément. Un joli visage générique est difficile à contrôler d’un plan à l’autre ; des sourcils, des taches de rousseur ou un grain de beauté donnent au modèle, et à vous, des points d’ancrage pour vérifier que c’est toujours elle.

Étape 1 — la planche de référence

Un portrait ne suffit pas à créer un personnage. Une planche de référence, oui. Nous avons généré six angles : un portrait de base, une rotation à 30°, un profil à 90°, un plan mi-cuisse, un plein pied et un plein pied à 30°.

L’astuce est simple : dès qu’une bonne image existe, on la réinjecte comme référence. Ensuite, on donne au modèle une consigne courte pour conserver le visage et l’anatomie. Cela fonctionne mieux que d’empiler des prompts de plus en plus longs, jusqu’à ressembler à un portrait-robot rédigé par quelqu’un qui a une migraine.

Nous sommes aussi restés volontairement dans le même moteur autant que possible. Cela limite la dérive d’identité et permet de comprendre où ce moteur casse, plutôt que d’accuser cinq outils en même temps comme un parent épuisé sur l’autoroute.

Portrait de base
Portrait de base
Rotation 30°
Rotation 30°
Profil 90°
Profil 90°
Plan mi-cuisse
Plan mi-cuisse
Plein pied
Plein pied
Plein pied, 30°
Plein pied, 30°

La planche de référence de Mila — tous les plans suivants partent de là.

Les cinq prompts de la planche

Les prompts sont affichés avec chaque image, accompagnés de notes pour expliquer leur rôle. Ce qu’il faut retenir, c’est la méthode : répéter la même description physique, nommer uniquement ce qui change, puis ajouter les images validées comme références au fur et à mesure.

Rotation 30°

Chaque prompt répète la même description du visage et ajoute un seul nouvel angle. Le portrait importé fait le gros du travail ; les mots indiquent surtout où regarder.

Rotation 30°
Afficher le prompt

Use the uploaded portrait of Mila as the primary identity reference. Create a RAW photorealistic studio portrait of the same real-looking adult woman. Keep her exact face: fair skin with natural texture, oval heart-shaped face, defined cheekbones, soft refined jawline, large expressive grey-blue almond eyes, straight narrow nose, natural medium lips, distinctive full blonde eyebrows with a soft lifted arch, and a small beauty mark below her right eye. Champagne-blonde hair below the shoulders, centre part, soft waves. Head-and-shoulders view, face turned 30 degrees to her left, eyes looking into the camera, head upright and level. Calm, intelligent, slightly reserved expression, closed lips. Minimal makeup, graphite-grey crew-neck top, no jewellery. Light-grey seamless studio background, soft frontal light, 85mm lens look, realistic colour, unretouched human photo. No illustration, CGI, doll face, glamour filter, text or watermark.

Profil 90°

Le vrai profil est l’angle le plus dur à garder fidèle. Mentionner précisément les sourcils et le grain de beauté aide à maintenir l’identité.

Profil 90°
Afficher le prompt

Use the uploaded portrait of Mila as the primary identity reference. Create a RAW photorealistic studio image of the same real-looking adult woman. She is tall and slender, with fair skin, natural texture, visible pores, an oval heart-shaped face, defined cheekbones, a soft refined jawline, large expressive grey-blue almond eyes, a straight narrow nose, natural medium lips, and a small beauty mark below her right eye. Her eyebrows are distinctive: light blonde, full, textured, elegant, with a soft lifted arch. Her hair is champagne blonde, below the shoulders, centre part, soft waves. Show a strict 90-degree right-facing side profile, head level, calm neutral expression, closed lips, hair tucked behind the visible ear. Graphite-grey crew-neck top, no jewellery. Light-grey seamless studio background, soft diffused light, true human photo. No cartoon, CGI, doll face, beauty filter, text or watermark.

Plan mi-cuisse

« Ne pas redessiner, réinterpréter, embellir ni remplacer son visage » sonne comme une rengaine. C’est exactement ce qui empêche la dérive.

Plan mi-cuisse
Afficher le prompt

Use the uploaded portrait as the only identity reference. Create a RAW photorealistic studio photo of the exact same woman, framed from head to mid-thigh. Do not redesign, reinterpret, beautify or replace her face. Preserve her identity exactly: same facial geometry, proportions, eyes, eyebrows, nose, lips, jawline, skin tone, hairline, hairstyle and beauty mark. She is a clearly adult woman, tall and slim, with a defined waist and balanced feminine curves. She faces the camera in a relaxed neutral pose, arms slightly away from her torso. She wears a fitted graphite-grey bodysuit. Light-grey seamless background, soft even light, 50mm lens, realistic skin texture, true human photography. Keep the face sharp, detailed and clearly recognizable. No new face, face variation, cartoon, CGI, doll-like skin, distorted anatomy, text or watermark.

Plein pied

Cette fois, on injecte DEUX références : le portrait et le plan mi-cuisse validé. Plus vous réutilisez d’angles approuvés, plus le personnage devient stable.

Plein pied
Afficher le prompt

Use the uploaded portrait and approved mid-thigh image as identity references. Create a RAW photorealistic full-body studio photo of the exact same woman. Do not redesign or replace her face. Preserve her identity exactly: same facial geometry, proportions, eyes, eyebrows, nose, lips, jawline, skin tone, hairline, hairstyle and beauty mark. She is a clearly adult woman, about 178 cm tall, with a slim elegant figure, defined waist, softly rounded hips, balanced feminine curves and long legs, suitable for dress fittings. She stands front-facing in a relaxed neutral pose, arms naturally at her sides, full body visible from head to bare feet. Fitted graphite-grey bodysuit, matte black leggings. Light-grey studio background, soft even light, 50mm lens, true human photo. No new face, face variation, cartoon, CGI, doll-like skin, distorted anatomy, cropped feet, text or watermark.

Plein pied, 30°

À ce stade, le prompt peut être court. Mila existe déjà ; vous lui demandez simplement un nouveau rendez-vous photo.

Plein pied, 30°
Afficher le prompt

Using the uploaded portrait as the face reference, create a photorealistic full-body studio photo of the exact same woman. Tall, slim figure with a defined waist and natural feminine curves. Body turned 30 degrees, head toward the camera, relaxed pose, full body and feet visible. Preserve her face and hair exactly. Simple fitted grey outfit, soft studio light, plain grey background, no cartoon, CGI or distorted anatomy.

Les cinq prompts qui ont transformé un portrait en vraie planche de référence.

Étape 2 — construire le vestiaire

Une fois le look choisi, nous avons demandé au modèle image d’isoler chaque pièce et accessoire en packshot propre : robe, sac, chaussures, lunettes de soleil, boucles d’oreilles et bracelet.

Cette étape vaut largement le détour. Quand un élément existe comme image de référence indépendante, vous pouvez le réutiliser dans n’importe quelle scène avec beaucoup plus de chances qu’il reste identique. C’est la logique d’un vrai lookbook, sans le portant qui bloque toujours la porte.

Robe
Robe
Sac
Sac
Chaussures
Chaussures
Lunettes de soleil
Lunettes de soleil
Boucles d’oreilles
Boucles d’oreilles
Bracelet
Bracelet

Chaque pièce isolée en packshot pour pouvoir être réutilisée de façon cohérente.

Étape 3 — lui donner la parole

Pour le plan parlé, notre stack était honnête et un peu bricolé. Nous avons généré un clip à partir d’une image fixe, créé la voix dans ElevenLabs, puis fait le lip sync dans Sync.so.

Aujourd’hui, la voix et le lip sync ne sont pas encore intégrés à Vynzo. Kling 2.6 peut déjà gérer le lip sync nativement dans Vynzo, et GPT Image 2 arrive bientôt sur la plateforme.

Le conseil pratique compte plus que la liste d’outils : démarrez chaque prise de lip sync depuis un clip source différent, avec d’autres gestes et expressions. Réutiliser le même clip donne vite une impression mécanique, comme si Mila était coincée dans une boucle de service client très polie.

Le passage parlé — l’expression et le geste pèsent plus que les mots.

Afficher le prompt

Use the uploaded reference image as the exact identity of the character. Preserve her face, hairstyle, skin tone, proportions, clothing and accessories. Do not redesign or stylize her. Medium close-up, eye-level camera. She looks into the lens and speaks naturally: "[DIALOGUE]". Precise lip sync. Expressions follow the speech: subtle eyebrow movement, realistic blinking, small smiles, brief pauses and natural breathing. She uses restrained hand gestures, small head nods and slight posture shifts. Movements are smooth, relaxed and conversational, never theatrical or repetitive. Keep hands anatomically correct. Negative prompt: identity drift, facial warping, frozen expressions, excessive blinking, random gestures, distorted hands, lip-sync errors, flicker, camera shake, cuts or background changes.

Étape 4 — la séquence à la maison

Sur le papier, la séquence à la maison est simple : Mila présente un produit par clip. Le workflow se répète : générer une image fixe depuis la planche de référence, l’animer, relancer, puis garder la meilleure prise.

Chaque clip reprenait la même consigne : préserver l’identité et garder des mouvements naturels, subtils. Les vraies leçons sont dans les notes sous les vidéos, parce que la première version est souvent celle où le modèle vous présente très aimablement un nouveau problème.

Le tour de robe

Un tour complet est le test de vérité pour un personnage : le modèle doit rester lui-même sur 360°. Celui-ci a fonctionné, mais regardez à quel point le prompt passe son temps à interdire des choses plutôt qu’à en demander.

Afficher le prompt

Use the provided frame as a strict reference. Vertical 9:16, full-body, static camera. Keep the same woman, identity, face, body proportions, hairstyle, dress, bare feet, room, lighting and framing unchanged throughout. She starts already facing the camera, looking directly into the lens with a soft natural smile. From this exact starting pose, she gently holds the sides of the dress with both hands and makes one smooth natural full turn around herself at normal real-time speed, with small realistic steps. The movement should feel elegant and physically natural, with subtle fabric motion and slight hair movement. After the turn, she finishes facing the camera again. No slow motion, no strange grimaces, no exaggerated expressions, no face distortion, no identity drift, no hand glitches, no extra fingers, no foot deformation, no added heels or footwear, no camera movement, no flicker

Le sac

Notre raté préféré : le modèle faisait passer le sac À TRAVERS son propre bras, comme un fantôme. Après beaucoup de relances, nous n’en avons gardé qu’un extrait. Le contact main-objet reste l’un des grands points faibles des modèles vidéo.

Afficher le prompt

A woman naturally presents a light-colored leather handbag in a minimalist room. She gently turns her upper body slightly toward the camera, carefully lifts the bag by its handle, and brings it a little closer to the lens to showcase its shape, leather texture, stitching, and hardware. She then subtly adjusts her grip and slowly rotates the handbag to reveal its side profile. Her expression remains calm and confident, with a soft, natural smile. Her hair and clothing move slightly with her body. The camera performs a slow, smooth push-in while keeping the handbag as the main focal point. Realistic premium fashion commercial, soft natural daylight, elegant and controlled movement, high detail, stable composition, smooth natural motion

Le selfie lunettes

Demander un téléphone invisible et un léger tremblement volontaire de caméra, c’est ce qui donne l’impression d’un vrai selfie. Les branches des lunettes disparaissaient pendant la rotation : seule solution, relancer en nommant exactement ce détail.

Afficher le prompt

Create a photorealistic vertical 9:16 front-camera selfie video from the reference image. Preserve her identity, hair, sunglasses, mint athletic outfit, room, lighting, and framing. The phone is in her hand but never visible, so the camera should have subtle natural handheld motion throughout: tiny shakes, micro-sways, and slight distance shifts. She looks at the screen, slowly turns her head to one side and freezes, holding still for a moment to show the sunglasses. Then she slowly turns her head to the other side and freezes again. After that, she gently brings the camera closer to her face for a close-up of the sunglasses and holds it there briefly. Add natural blinking, breathing, tiny facial movements, and slight hair motion. No speaking, cuts, sudden motion, warped features, or background changes.

Les chaussures sorties de la boîte

Premier plan / dernier plan. La règle que personne ne vous dit : la position de caméra doit être la même dans les DEUX images, sinon les objets glissent dans la coupe.

Afficher le prompt

Use the first frame as the starting pose and the last frame as the ending pose. In the same bright minimalist room, the woman sits on the sofa and smoothly transitions from reaching toward the open shoebox on the floor to lifting one iridescent heel out of the box and examining it in her hands. At the start, both shoes are clearly inside the shoebox among the tissue paper. During the action, she leans forward, reaches into the box, takes only one shoe by the ankle strap, lifts it up, and supports it with her other hand while looking at it with soft curiosity and a subtle pleased smile. By the end, one shoe is in her hands and the second shoe remains inside the box. Maintain consistent appearance, outfit, room layout, shoebox position, and shoe design. Soft daylight, static camera, realistic motion

Gros plan chaussure

Deuxième tentative. À la première, la main a tranquillement tourné sur 360 degrés. Un poignet, lui, n’a pas reçu cette mise à jour.

Afficher le prompt

A cinematic product showcase of a futuristic silver iridescent high-heel sandal being elegantly held in one hand inside a bright, minimalist living room. The camera performs a slow, smooth push-in combined with a subtle left-to-right arc, creating gentle parallax between the shoe and the softly blurred background. The hand naturally rotates the shoe a few degrees to reveal the shimmering holographic panels, metallic finish, sculptural transparent heel, and ankle strap. Soft daylight from the window creates realistic reflections and rainbow highlights that glide across the surface as the camera moves. The background remains calm and out of focus, emphasizing the product. Premium luxury fashion commercial aesthetic, ultra-realistic materials, clean composition, shallow depth of field, stabilized camera, natural motion only, no abrupt movements, no object deformation, no flickering, no warping, no extra fingers or artifacts.

La séquence à la maison — un produit par clip.

L’astuce premier plan / dernier plan

Pour toute action avec un début et une fin clairs — sortir une chaussure d’une boîte, par exemple — donnez au modèle l’image de départ et l’image d’arrivée. Il doit savoir d’où part le mouvement et où il doit atterrir.

Le détail que beaucoup oublient, c’est la caméra. Les deux images doivent avoir exactement la même position de caméra. Sinon, les objets glissent et se déforment, parce que le modèle essaie de déplacer la caméra et l’objet en même temps. C’est comme ça que des chaussures deviennent possédées.

Premier plan
Premier plan
Dernier plan
Dernier plan

Premier plan et dernier plan — même caméra, sinon les objets glissent.

Étape 5 — studio et podium

Pour la séquence studio, nous avons habillé Mila avec le look complet, avec puis sans lunettes de soleil, avant d’ajouter le maquillage. C’est un moment où l’identité demande encore plus d’attention, car le maquillage modifie un visage. Il peut masquer les petites marques et imperfections qui rendent le personnage reconnaissable.

Les plans coulisses du shooting se sont assemblés rapidement et paraissaient crédibles : flashs de studio, ventilateur, photographe hors champ. Le plan podium est celui qui vend tout le film, parce qu’il réunit la tenue, le personnage et le mouvement dans un moment lisible.

Nano Banana 2 ne gardait pas toujours les accessoires parfaitement identiques. GPT Image 2 s’en est mieux sorti : on importe l’accessoire, puis on l’édite dans l’image. Simple, pas magique — un thème qui commence à revenir.

Le podium

Le plan qui doit tout vendre. Chaque élément est nommé explicitement — robe, lunettes, boucles d’oreilles, bracelet, talons, sac — parce que ce que vous ne nommez pas, le modèle peut tranquillement le redessiner.

Afficher le prompt

The same blonde model from the reference walks confidently down a luxury fashion runway with a professional catwalk stride, maintaining the exact same face, hairstyle, white dress, sunglasses, earrings, bracelet, heels, and cream handbag. She reaches the end of the runway, gracefully stops, and performs three elegant high-fashion poses, subtly shifting her weight, rotating her body, lifting her chin, and naturally presenting the handbag. Camera flashes illuminate her as photographers capture every pose. She executes a smooth runway pivot, then confidently walks back. The dress flows naturally, the handbag swings realistically, and every movement is poised and refined. Cinematic fashion film, glossy runway, soft spotlights, shallow depth of field, ultra-realistic, 9:16, 10 seconds, 4K, 24 fps, preserve the exact appearance from the reference, no outfit or face changes.

La séquence studio — le look complet, puis le défilé.

Photos studio

Les images studio montrent le look complet assemblé à partir des packshots, puis photographié dans un décor de studio. C’est là que le travail sur les produits commence enfin à payer son loyer.

Look complet
Look complet
Assise
Assise

Photos studio — le look complet, construit à partir des packshots.

Tout ce qui a cassé

C’est la partie que beaucoup d’articles passent sous silence, sans doute parce qu’elle est moins glamour que la vidéo finale et ressemble davantage à un aveu de valise explosée en public. Mais les échecs ne sont pas des cas rares. Ils font partie du travail.

Prévoyez des relances comme un photographe prévoit des prises. La découverte la plus utile : Seedance génère souvent au ralenti, et un negative prompt n’a pas réglé le problème. Nous avons donc accéléré ces clips de 35–40% au montage.

Le sac passait à travers son bras

Pourquoi c’est important
Le contact main-objet est encore l’un des points les plus faibles des modèles vidéo
Ce qui a vraiment marché
Beaucoup de relances ; nous n’avons gardé qu’une partie de la prise

Les branches des lunettes disparaissaient pendant la rotation

Pourquoi c’est important
Les petits détails rigides s’évaporent quand la tête tourne
Ce qui a vraiment marché
Relancer en nommant précisément ce détail

La main faisait une rotation complète à 360°

Pourquoi c’est important
L’anatomie n’est pas garantie si vous ne la surveillez pas
Ce qui a vraiment marché
Une relance

Tout sortait au ralenti

Pourquoi c’est important
Seedance étire une action courte pour remplir le clip
Ce qui a vraiment marché
Un negative prompt n’a PAS aidé — accélérer le clip de 35–40% au montage

La scène du crayon de maquillage

Pourquoi c’est important
Certaines actions ne passent tout simplement pas, quelle que soit la formulation
Ce qui a vraiment marché
Coupée

Une cambrure étrange à la fin

Pourquoi c’est important
Les dernières images sont souvent celles où les poses se cassent
Ce qui a vraiment marché
Raccourcie au montage

Les accessoires changeaient d’un plan à l’autre

Pourquoi c’est important
Les modèles image dérivent sur les petits objets
Ce qui a vraiment marché
Nano Banana 2 a peiné ; GPT Image 2 a tenu — importer l’accessoire, puis éditer

Testez les quatre moteurs sur votre propre photo — dans un seul studio.

Ouvrir le studio

Combien ça a coûté

La production complète a coûté $85.45 et demandé 8 h 34 pour 1 minute 37 de vidéo finalisée. La facture se répartit ainsi : $55.45 pour la génération image et vidéo, $19 pour le lip sync et $11 pour la voix.

Alors, un ai influencer est-il économique ? Comparé à un vrai shooting avec mannequin, photographe, studio et lieu, oui. Mais ce n’est ni gratuit, ni instantané. Et nous ne sommes pas blogueurs mode : c’est une démonstration de ce que les outils permettent aujourd’hui. Avec plus de prises et un meilleur montage, le résultat irait encore plus loin.

Seedance 2.0 Pro · Nano Banana 2 · GPT Image 2

Ce que ça couvre
Toutes les images et tous les clips vidéo
Coût
$55.45

Sync.so

Ce que ça couvre
Lip sync (environ 20% seulement de la réserve utilisée)
Coût
$19.00

ElevenLabs

Ce que ça couvre
Voix off
Coût
$11.00

Total

Ce que ça couvre
1 minute 37 de vidéo finalisée
Coût
$85.45

Temps

Ce que ça couvre
Montage inclus
Coût
8 h 34 min

Testez les quatre moteurs sur votre propre photo — dans un seul studio.

Ouvrir le studio

Ce qu’on vous dirait avant de commencer

D’abord : il n’y a pas de bouton magique, et il n’y en aura probablement jamais. Désolé. Les robots ont appris la lumière et les tissus, mais ils ont encore besoin d’une personne avec du goût, de la patience et la capacité de relancer le même plan sans le prendre personnellement.

Ensuite : sans script clair et intéressant, vous produirez du bruit coûteux. Un beau personnage qui traverse de beaux plans, ce n’est pas une histoire ; c’est un écran de veille avec des factures.

Enfin : le personnage est le produit. Investissez donc dans la planche de référence avant tout le reste. Puis prévoyez des relances et du montage, parce que c’est là que le ralenti, les fins ratées et les plans impossibles se réparent.

Questions fréquentes

Comment créer un influenceur IA ?

Créez d’abord un personnage original, construisez une planche de référence, puis générez les tenues, les scènes, la voix, le lip sync et le montage. Pour Mila, nous avons commencé par six angles avant de produire le moindre clip final. C’est la base si vous cherchez à créer un influenceur IA crédible.

Les influenceurs IA peuvent-ils gagner de l’argent ?

Nous n’avons pas monétisé Mila : c’était une démonstration. Le format sert déjà pour du contenu de marque, des lookbooks et des publicités, mais nous n’allons pas inventer des chiffres de revenus.

Combien coûte une vidéo d’influenceur IA ?

Celle-ci a coûté $85.45 et demandé 8 h 34 min pour 1 min 37 s de vidéo. Dans le détail : $55.45 pour la génération image et vidéo, $19 pour le lip sync et $11 pour la voix.

Comment garder le même visage sur tous les plans ?

Utilisez une planche de référence à six angles et réinjectez les images validées comme références. Nous avons aussi demandé au modèle de préserver le visage et l’anatomie, plutôt que d’allonger les prompts à l’infini.

Quels outils IA faut-il pour créer un AI influencer ?

Nous avons utilisé Nano Banana 2, GPT Image 2, Seedance 2.0 Pro, Sync.so et ElevenLabs. Kling 2.6 peut faire du lip sync dans Vynzo, et GPT Image 2 arrive bientôt. Pour ceux qui cherchent un ai influencer generator, un ai influencer studio ou même à make influencer ai, le principe reste le même : références solides, relances et montage.

Est-ce légal de créer un influenceur IA ?

Créer un personnage original ne pose pas de problème ; utiliser l’apparence d’une vraie personne sans son accord, si. Mila est fictive, ce qui reste la manière la plus sûre de construire ce type de projet, que ce soit pour un influenceur IA Instagram ou une influenceuse virtuelle Instagram.

Continuer à explorer

Donnez vie à vos photos

Essayez Kling, Seedance, Veo et WAN sur votre propre photo — tout au même endroit.

Créer votre personnage