Loqman × Jul, un clip promo vertical entièrement fabriqué avec l’IA
Deux rappeurs, un micro, un fond orange : rien n’a été filmé.
Le projet en bref
- Le besoin
- Donner à un couplet écrit pour le concours de Jul un clip vertical propre, sans tournage ni budget de production.
- Ma contribution
- Écriture du découpage, génération des images et des plans par IA, synchronisation des lèvres sur la voix, montage sur la grille rythmique et contrôles mesurés, en douze versions relues avec l’artiste.
Ce qui a été réalisé
- Bible et découpage en 15 plans
- Images et vidéos générées
- Synchronisation labiale
- Montage 9:16 avec titre et carton IA
Vidéo offerte et remise à l’artiste, qui la publie sur ses canaux. Tout le visible est généré par IA, carton de fin compris ; aucun chiffre de vues ni de votes n’est revendiqué.

- Nature
- Clip promo vertical (9:16) généré par IA · une vidéo offerte, pas une prestation vendue
- Période
- Octobre 2026
- Client
- LoqmanArtiste rap, un ami · concours « 2e couplet » lancé par Jul
Le point de départ
Fin septembre 2026, Jul publie un morceau inachevé et invite ses auditeurs à écrire le deuxième couplet. Loqman, un ami rappeur, écrit le sien et bricole une première vidéo avec un outil de génération grand public : image horizontale sur un écran de téléphone, filigrane, personnages qui changent de visage en cours de plan. Il m’a demandé de lui refaire quelque chose de propre. C’est une vidéo offerte : il n’y a eu ni devis ni paiement, et cette fiche ne la présente pas comme une prestation.
L’approche
Travailler comme sur un vrai tournage, sans caméra. Une bible de production fixe le décor (un studio au fond orange, un seul micro suspendu), les deux personnages et leurs tenues, puis découpe le morceau en quinze plans alignés sur la grille rythmique : chaque coupe tombe sur un temps. Pour chaque plan, une image fixe est d’abord générée et validée, puis animée en vidéo. Les plans chantés passent ensuite par un modèle de synchronisation labiale piloté par la voix isolée du morceau, afin que la bouche suive réellement les paroles. Chaque version du montage a été écoutée par l’artiste, et ses retours ont guidé douze versions successives.
La solution
- Un montage vertical de 62 secondes, à 24 images par seconde, avec un titre à l’entrée et un carton de fin qui invite à voter et précise que la vidéo est réalisée avec l’IA.
- Quinze plans écrits à l’avance : plan large, gros plans, passation du micro, plongée zénithale, retour à deux pour le dernier couplet.
- La voix du morceau séparée de l’instrumental, puis découpée plan par plan pour piloter le mouvement des lèvres.
- Un recadrage automatique autour du bon visage quand les deux artistes partagent le cadre, puis une recomposition dans l’image d’origine : le modèle n’anime que la bonne personne.
- Des contrôles mesurés plutôt que ressentis : nombre d’images du montage, coupes vérifiées sur la grille, ouverture de la bouche comparée à l’enveloppe de la voix sur chaque plan.
- Toutes les prises conservées : chaque plan garde ses variantes de secours, et le montage se recompose depuis une seule liste de décisions.
Preuves
Chaque chiffre porte sa source. Aucun résultat commercial n’est revendiqué.
15
Plans du montage, chacun écrit et généré séparément
SourceListe de décisions du montage, état du 7 octobre 2026
13
Plans passés par une synchronisation labiale pilotée par la voix
SourceListe de décisions du montage, état du 7 octobre 2026
12
Versions du montage écoutées par l’artiste
SourceJournal de production du projet, 6 et 7 octobre 2026
1 488
Images du montage final (62 secondes à 24 images par seconde)
SourceContrôle automatique du fichier exporté, 7 octobre 2026
Ce que cette pièce est, et n’est pas
Tout ce qui est visible est généré : les deux personnages sont des représentations créées par IA, y compris celle de Jul, à qui le clip rend hommage dans le cadre de son concours ; Jul et son équipe n’ont ni commandé ni validé cette vidéo. Le seul élément d’origine est le morceau, propriété de ses auteurs. La vidéo est publiée par l’artiste sur ses propres canaux ; aucun chiffre de vues, de votes ou de résultat au concours n’est revendiqué ici. Les visuels de cette fiche sont des images extraites du montage, pas des photos.
Détails techniques
Les technologies utilisées pour cette réalisation. Les fonctions et leurs limites sont détaillées dans le récit.
- Python
- FFmpeg
- Kling 3.0 Pro
- Seedance 2.5
- Sync Lipsync 2 Pro
- MediaPipe
- Demucs
- OpenCV
Savoir-faire mobilisé
Galerie

Cinq des quinze plans, dans l’ordre du montage. Images générées par IA. 
L’entrée du titre, tenue sur le plan de Jul. Image générée par IA. 
La passation du micro, à la fin du couplet de Jul. Image générée par IA. 
Le dernier couplet, bouche calée sur la voix. Image générée par IA. 
Le carton de fin et sa mention IA.
Un besoin similaire ?
Parlons de votre contexte et de ce que vous aimeriez simplifier.