Outils IA pour les réalisateurs et cinéastes
Mis à jour le 2026-10-11
Génération vidéo
Plateforme de modèles et de vidéo IA proposant Gen-4.5 pour la création, une API développeur et des recherches sur les modèles du monde interactifs GWM-1.
- Le site officiel présente Gen-4.5 en mettant en avant la qualité du mouvement, le respect des consignes et la fidélité visuelle.
- Runway décrit GWM-1 comme un modèle général du monde permettant d’interagir avec des environnements et de développer des processus de simulation.
- Runway Dev a ajouté WAN 3.0 le 26 août 2026, avec des vidéos allant jusqu’à 30 secondes et un son natif à partir de texte ou d’une image de départ. [docs.dev.runwayml.com]
Modèle de génération vidéo de Google DeepMind, actuellement Veo 3.1, produisant des séquences cinématographiques avec son natif : dialogues, effets sonores et ambiances.
- Veo 3.1 génère le son nativement, notamment les effets sonores, bruits d’ambiance et dialogues.
- Propose la cohérence des personnages par images de référence, le contrôle des mouvements de caméra (zoom, panoramique, travelling), l’extension de scènes et des sorties jusqu’en 1080p/4K.
- Disponible via l’application Gemini, Google Flow, Google AI Studio et Google Vids.
Outil de création audiovisuelle IA de Google Labs pour les créatifs, reposant sur les modèles vidéo Veo et combinant génération vidéo et image. Sa disponibilité varie selon les régions.
- Google présente Flow comme un outil dédié à la création audiovisuelle avec l’IA donnant accès à Veo 3.1. [deepmind.google]
Plateforme de génération vidéo IA de Kuaishou. Kling 3.0 accepte des entrées multimodales, produit des séquences allant jusqu’à 15 secondes et génère du son natif dans plusieurs langues.
- Kuaishou a annoncé la série Kling 3.0 le 5 février 2026, avec des vidéos allant jusqu’à 15 secondes et un son natif multilingue. L’annonce attribue les sorties 2K et 4K aux modèles Image 3.0. [ir.kuaishou.com]
- Kuaishou a également annoncé Kling O1, présenté comme un modèle vidéo multimodal unifié. [ir.kuaishou.com]
Espace de création IA de Luma construit autour des modèles vidéo Ray. Il réunit génération d’images, de vidéos et de son sur un canevas infini, création de storyboards et animation d’images avec mouvements de caméra.
- Utilise les modèles vidéo Ray3 et le modèle image Uni-1 de Luma, tout en proposant des modèles tiers tels que Veo 3.1 et Kling.
Plateforme de création IA pour la vidéo, l’image et le son, avec des applications de transfert de mouvement, d’extension vidéo, de retouche d’image, de parole et d’effets sonores.
- Le catalogue comprend Pika 2.5 parmi d’autres modèles vidéo. La navigation du produit propose aussi des fonctions pour l’image et le son.
- Les applications vidéo comprennent le transfert de mouvement et l’extension de séquences ; les applications image et audio comprennent la retouche, la parole et les effets sonores.
Plateforme créative de MiniMax avec des interfaces de création vidéo, image et audio, ainsi que des préréglages cinématographiques comme CineScope.
- L’interface officielle propose des outils vidéo, image et audio, avec CineScope parmi les préréglages cinématographiques.
Famille de modèles et plateforme de génération vidéo d’Alibaba. La documentation publique des modèles Wan décrit la génération de vidéo à partir de texte et d’images.
- Le dépôt officiel Wan2.2 documente des modèles texte vers vidéo, image vers vidéo et hybrides texte/image vers vidéo. [github.com]
Plateforme de création IA réunissant image, vidéo, audio, création cinématographique et effets visuels, avec des accès API et MCP.
- Le site officiel présente des outils image, vidéo et audio, ainsi que les espaces Cinema Studio, Effects et Ads Studio.
- La navigation du produit fournit des accès aux intégrations API et MCP.
Plateforme de création vidéo IA pour les équipes publicitaires et marketing à la performance. Elle transforme des scénarios ou créations existantes en nouvelles vidéos et en variantes de produits, personnages ou voix.
- Le site officiel décrit la génération vidéo à partir d’un brief ou scénario et le remplacement de produits dans des créations vidéo existantes.
- Il décrit aussi le remplacement des personnages ou voix et la localisation de vidéos existantes avec adaptation de la synchronisation labiale.
Suite IA de création et de montage vidéo avec écriture de scénarios, storyboard, génération vidéo et timeline multipiste pour la création audiovisuelle et d’autres usages vidéo.
- Le site officiel décrit l’écriture de scénarios, le storyboard plan par plan et un éditeur sur timeline pilotable par des instructions de montage en langage naturel.
- La plateforme propose la génération vidéo aux côtés d’outils image, voix et musique ; l’accès aux modèles et fonctions dépend de l’offre choisie.
Espace créatif à l’usage réunissant génération vidéo, image et audio, avec des outils de cohérence des personnages, changement d’angle de caméra, augmentation de résolution et suppression d’arrière-plan.
- La navigation officielle propose la génération vidéo, image et audio, ainsi que des outils de cohérence, d’angle de caméra, de résolution et de suppression d’arrière-plan.
- La page des tarifs indique qu’il n’y a pas d’abonnement et que le prix exact d’une génération est confirmé dans l’application. Les exemples de coût ne sont pas des prix fixes pour les générations futures.
Storyboard et prévisualisation
Suite web de création audiovisuelle IA transformant les scénarios en découpage de scènes, storyboards et séquences vidéo, avec profils de personnages persistants, contrôle de la caméra et éditeur sur timeline.
- Lancée par Lightricks en février 2024 comme un studio de création audiovisuelle IA pour visualiser les récits du scénario à l’écran. [techcrunch.com]
- Comprend un générateur de storyboards IA qui découpe un scénario collé en scènes et en images plan par plan. [ltx.io]
Plateforme collaborative de storyboard pour les équipes vidéo et animation, avec génération d’images IA, animatiques minutées avec son et processus de relecture et de validation par les clients.
- La génération d’images IA produit des variantes de vignettes de storyboard à partir de descriptions de scènes.
- Transforme les storyboards en animatiques minutées avec son et suit les versions, commentaires et validations.
Cadre de recherche pour la génération de séries courtes guidée par la géométrie, transformant une intrigue globale et un contexte local en plans vidéo multi-plans ancrés dans des références et en séquences générées.
- DramaDirector sépare chaque plan en conditions visuelles statiques et narratives dynamiques, et récupère des références de profondeur et de pose dans des séries courtes réelles pour guider la première image et la synthèse image vers vidéo.
- L’article présente DramaBoard, un banc d’essai construit à partir de 35 séries en prise de vues réelles, 2 800 épisodes et 81 000 plans, avec storyboards structurés et protocoles d’évaluation multidimensionnels.
Scénario et préproduction
Plateforme IA de préproduction automatisant le dépouillement des scénarios (distribution, accessoires, décors, VFX, costumes), les plans de travail et les budgets. Son AI Production Agent signale les risques de production.
- Le dépouillement automatique identifie distribution, accessoires, décors, VFX et costumes, et génère des tableaux de scènes, plans de travail et modèles de budget.
- Son AI Production Agent analyse les scénarios pour détecter les risques de production et optimiser les journées de tournage.
Partenaire d’écriture IA pour romanciers et scénaristes, avec Story Bible pour passer du plan au brouillon, des fonctions de réécriture, développement et description, et des extensions dont la conversion en scénario.
- Story Bible accompagne les auteurs du concept au plan, à la préparation des chapitres et à la rédaction dans leur propre style.
Plateforme de scénario et de préproduction avec éditeurs aux standards du secteur, séquenciers, analyse et dépouillement, listes de plans, planification et budgets, ainsi que coécriture en temps réel.
- Propose des éditeurs de scénario multiformats, des outils de développement narratif — séquenciers, storyboards et analyse — ainsi qu’un dépouillement scène par scène.
Montage et postproduction
Éditeur vidéo et podcast fondé sur le texte : modifier la transcription modifie la vidéo. Il inclut l’assistant de montage IA Underlord, le nettoyage audio Studio Sound, la suppression des mots de remplissage et la traduction.
- Le montage repose sur le texte : modifier la transcription met automatiquement la vidéo à jour.
- Underlord est un assistant de montage IA agentique capable d’écrire ou de réviser des scénarios, d’appliquer des mises en page et transitions et d’exécuter des demandes de montage.
Éditeur professionnel avec IA générative Firefly : Generative Extend ajoute des images et de l’ambiance sonore en 4K, Media Intelligence permet une recherche sémantique des rushes, et les sous-titres sont traduits automatiquement.
- Generative Extend, basé sur Adobe Firefly, prolonge les séquences en 4K (jusqu’à environ 2 secondes de vidéo et 10 secondes de son) et leur associe des Content Credentials. [helpx.adobe.com]
- La version d’avril 2025 a rendu Generative Extend généralement disponible et ajouté la recherche sémantique Media Intelligence et la traduction automatique des sous-titres. [news.adobe.com]
Suite intégrée de montage, étalonnage, VFX et postproduction audio. Le DaVinci Neural Engine anime des outils IA tels que Magic Mask, Voice Isolation, la reconnaissance faciale, le recadrage intelligent et IntelliSearch.
- DaVinci Resolve 21 comprend les outils IA Neural Engine : Magic Mask, Voice Isolation, reconnaissance faciale, recadrage intelligent, IntelliSearch et CineFocus.
- Une version gratuite est disponible ; DaVinci Resolve Studio (295 $, paiement unique) ajoute le Neural Engine et des fonctions avancées.
Éditeur vidéo en ligne et sur ordinateur avec accès gratuit et fonctions payantes : sous-titres IA, suppression d’arrière-plan, synthèse vocale, réduction du bruit et génération vidéo.
- Propose des sous-titres automatiques multilingues, la suppression d’arrière-plan vidéo et image, la synthèse vocale et un générateur de vidéo IA.
Outil de découpage assisté par IA transformant de longues vidéos en extraits verticaux courts, avec détection des moments clés, recadrage, sous-titres et éditeur visuel pour vérifier le résultat.
- Le site officiel décrit la détection IA des moments clés, le recadrage vertical modifiable, le découpage précis et la transcription automatique avec sous-titres stylisés.
- L’offre gratuite actuelle couvre deux vidéos longues au total, et non deux par mois. Le site annonce un démarrage sans carte bancaire et des offres payantes mensuelles.
Espace de transcription vidéo et audio pour explorer les rushes, relire les entretiens et préparer les sous-titres, avec transcriptions horodatées modifiables et exports en documents ou sous-titres.
- Accepte les liens vidéo publics pris en charge et les médias importés, avec transcriptions horodatées modifiables et exports TXT, SRT, VTT, CSV, JSON et DOCX. Les liens privés ou de réseau local ne sont pas acceptés.
- La page des tarifs décrit des crédits de transcription à l’usage sans abonnement obligatoire ; la modification et les exports ne consomment pas de crédits supplémentaires.
Voix, doublage et musique
Plateforme audio IA avec synthèse vocale, clonage de voix, doublage, effets sonores et génération musicale, ainsi que transcription et API développeur.
- ElevenCreative couvre la parole, la musique, les effets sonores, le clonage de voix, le doublage et des processus créatifs liés à la vidéo.
- La transcription prend en charge la distinction des locuteurs et les horodatages, en complément des API pour la parole et la musique.
Service professionnel de clonage de voix et de synthèse vocale utilisé au cinéma et à la télévision, avec clonage sur mesure supervisé par des ingénieurs, API de synthèse vocale en temps réel et catalogue de voix IA.
- Parmi ses contributions figurent la recréation de la voix du jeune Luke Skywalker dans The Mandalorian et l’adaptation d’accent d’Adrien Brody et Felicity Jones dans The Brutalist.
- Également utilisé dans Emilia Pérez (amélioration du chant) et Cyberpunk 2077: Phantom Liberty (préservation de la voix d’un acteur décédé).
Plateforme musicale IA produisant des chansons originales complètes (voix, paroles et production) à partir de consignes textuelles, avec séparation des pistes, import audio et station de travail web.
- Génère des chansons originales complètes dans différents genres à partir d’une consigne textuelle ; les droits commerciaux sont inclus dans les offres payantes.
Assistant de composition musicale IA générant des morceaux originaux dans plus de 250 styles, avec import MIDI/audio comme influence et modèles de style personnalisés. Les licences vont jusqu’à la pleine propriété des droits d’auteur.
- Génère de la musique dans plus de 250 styles avec édition et export multiformat, notamment pour les usages MIDI.
- AIVA indique que son offre Pro donne la propriété des droits d’auteur sur les compositions générées. L’usage commercial reste soumis aux conditions actuelles de l’offre et de sa licence.
Concept art et recherche visuelle
Service de génération et de retouche d’images pour le concept art et la recherche visuelle. V8.2 est la version par défaut documentée, avec personnalisation et Edit Model ; les fonctions de référence varient selon la version choisie.
- V8.2 est devenue la version par défaut le 24 juillet 2026. Elle comprend Edit Model, qui remplace les processus Omni Reference, Character Reference et Retexture. [docs.midjourney.com]
- V7 est sortie le 3 avril 2025 avec Draft Mode et Omni Reference, selon la documentation officielle des versions.
Suite créative IA pour le concept art et la recherche visuelle : génération d’images en temps réel, vidéo via des modèles intégrés, objets 3D à partir de texte ou d’images, augmentation de résolution et ajustement LoRA de styles personnalisés.
- Le rendu en temps réel transforme des formes simples en images photoréalistes ; l’ajustement LoRA peut utiliser les données de l’utilisateur.
- Intègre des modèles vidéo tiers dont Veo 3, Kling et Runway.
- Propose la génération d’objets 3D à partir de texte ou d’images.
Archives
Fiche archivée — service arrêté. Sora 2 d’OpenAI générait des vidéos avec son à partir de texte ou d’images. Les modèles Sora 2 et l’API Videos ont été arrêtés le 24 septembre 2026 et ne sont plus disponibles ; OpenAI indique qu’aucune API ne les remplace à l’identique.
- OpenAI a arrêté les modèles Sora 2 et l’API Videos le 24 septembre 2026. L’entreprise indique qu’aucune API ne les remplace à l’identique. [developers.openai.com]
- Avant cet arrêt, Sora 2 générait des séquences détaillées avec son synchronisé à partir de texte ou d’images, notamment en portrait 720 × 1280 et en paysage 1280 × 720.