Herramientas de IA para directores y cineastas
Actualizado el 2026-10-11
Generación de vídeo
Plataforma de vídeo y modelos de IA con Gen-4.5 para trabajo creativo, una API para desarrolladores e investigación en modelos del mundo interactivos GWM-1.
- La web oficial presenta Gen-4.5 destacando la calidad del movimiento, el seguimiento de instrucciones y la fidelidad visual.
- Runway describe GWM-1 como un modelo general del mundo para interactuar con entornos y desarrollar flujos de simulación.
- Runway Dev incorporó WAN 3.0 el 26 de agosto de 2026, con vídeos de hasta 30 segundos y audio nativo a partir de texto o una imagen inicial. [docs.dev.runwayml.com]
Modelo de generación de vídeo de Google DeepMind, actualmente Veo 3.1, que crea clips cinematográficos con audio nativo: diálogos, efectos y sonido ambiente.
- Veo 3.1 genera audio nativo, incluidos efectos de sonido, ruido ambiente y diálogos.
- Ofrece coherencia de personajes mediante imágenes de referencia, controles de cámara (zoom, panorámica y travelling), extensión de escenas y salida de hasta 1080p/4K.
- Está disponible en la aplicación Gemini, Google Flow, Google AI Studio y Google Vids.
Herramienta de cine con IA de Google Labs para creadores, basada en los modelos Veo y con generación de vídeo e imágenes. Su disponibilidad depende de la región.
- Google presenta Flow como una herramienta específica de cine con IA que ofrece acceso a Veo 3.1. [deepmind.google]
Plataforma de generación de vídeo con IA de Kuaishou. Kling 3.0 admite entradas multimodales, clips de hasta 15 segundos y audio nativo en varios idiomas.
- Kuaishou anunció la serie Kling 3.0 el 5 de febrero de 2026, con generación de vídeo de hasta 15 segundos y audio nativo multilingüe; el anuncio atribuye las salidas 2K y 4K a los modelos Image 3.0. [ir.kuaishou.com]
- Kuaishou también anunció Kling O1, descrito como un modelo unificado de vídeo multimodal. [ir.kuaishou.com]
Espacio creativo con IA de Luma basado en sus modelos de vídeo Ray. Combina generación de imágenes, vídeo y audio en un lienzo infinito, con desarrollo de storyboards y animación de imágenes con movimiento de cámara.
- Utiliza los modelos de vídeo Ray3 de Luma y el modelo de imágenes Uni-1, y también aloja modelos externos como Veo 3.1 y Kling.
Plataforma creativa de IA para generar vídeo, imágenes y audio, con aplicaciones de transferencia de movimiento, extensión de vídeo, edición de imágenes, voz y efectos de sonido.
- El catálogo incluye Pika 2.5 junto a otros modelos de vídeo; la navegación también presenta flujos de imágenes y audio.
- Las aplicaciones de vídeo incluyen transferencia de movimiento y extensión de vídeo; las de imagen y audio incluyen edición, voz y efectos de sonido.
Plataforma creativa de MiniMax con herramientas de vídeo, imágenes y audio, y ajustes cinematográficos como CineScope.
- La interfaz oficial muestra herramientas de creación de vídeo, imágenes y audio, con CineScope entre sus ajustes cinematográficos.
Familia de modelos y plataforma de generación de vídeo de Alibaba. Su documentación pública abarca la generación de texto a vídeo y de imagen a vídeo.
- El repositorio oficial Wan2.2 documenta modelos de texto a vídeo, imagen a vídeo y generación híbrida a partir de texto e imagen. [github.com]
Plataforma creativa con IA para imágenes, vídeo, audio, cine y efectos visuales, con acceso mediante API y MCP.
- La web oficial enumera herramientas de imagen, vídeo y audio, con espacios como Cinema Studio, Effects y Ads Studio.
- La navegación del producto ofrece puntos de acceso para integraciones mediante API y MCP.
Plataforma de vídeo con IA para equipos de publicidad y marketing de resultados. Convierte guiones o piezas existentes en nuevos vídeos y variantes de productos, personajes o voces.
- La web oficial describe la generación de vídeo a partir de briefs o guiones y la sustitución de productos en piezas existentes.
- También describe la sustitución de personajes o voces y la adaptación de vídeos a otros idiomas con sincronización labial ajustada.
Suite de creación y edición de vídeo con IA que incluye escritura de guion, storyboards, generación de vídeo y edición multipista en línea de tiempo para cine y otros usos audiovisuales.
- La web oficial describe escritura de guion, storyboards plano a plano y una línea de tiempo controlable mediante instrucciones de edición en lenguaje natural.
- La plataforma ofrece generación de vídeo y herramientas de imagen, voz y música; el acceso a modelos y funciones depende del plan.
Espacio creativo de pago por uso que combina generación de vídeo, imágenes y audio con herramientas de coherencia de personajes, cambio de ángulo de cámara, aumento de resolución y eliminación de fondos.
- La navegación oficial ofrece generación de vídeo, imágenes y audio, además de herramientas de coherencia, ángulo de cámara, resolución y eliminación de fondos.
- La página de precios indica que no hay suscripción y que el usuario confirma el coste exacto en la aplicación. Los ejemplos no fijan el precio de generaciones futuras.
Storyboard y previsualización
Suite web de cine con IA que transforma guiones en desgloses de escenas, storyboards y secuencias de vídeo, con perfiles persistentes de personajes, controles de dirección de cámara y edición en línea de tiempo.
- Lightricks la lanzó en febrero de 2024 como un estudio de cine con IA para visualizar historias del guion a la pantalla. [techcrunch.com]
- Incluye un generador de storyboards con IA que divide un guion pegado en escenas y representaciones plano a plano. [ltx.io]
Plataforma colaborativa de storyboards para equipos de vídeo y animación, con generación de imágenes por IA, animáticas con tiempos y audio, y revisión y aprobación por clientes.
- Incluye generación de imágenes por IA que crea variantes de viñetas a partir de descripciones de escenas.
- Convierte storyboards en animáticas con tiempos y audio, y registra versiones, comentarios y aprobaciones.
Marco de investigación para generar dramas cortos con orientación geométrica. Transforma la trama global y el contexto local en planes y resultados de vídeo de múltiples planos con anclaje visual.
- DramaDirector separa cada plano en condiciones visuales estáticas y narrativas dinámicas; recupera referencias de profundidad y pose de dramas cortos reales para guiar el fotograma inicial y la síntesis de imagen a vídeo.
- El artículo presenta DramaBoard, un banco de pruebas con 35 dramas de imagen real, 2.800 episodios y 81.000 planos, con storyboards estructurados y protocolos de evaluación multidimensional.
Guion y preproducción
Plataforma de preproducción con IA que desglosa guiones (reparto, atrezo, localizaciones, efectos visuales y vestuario), genera planes de rodaje y presupuestos, e incluye un AI Production Agent que detecta riesgos de producción.
- El desglose automático con IA identifica reparto, atrezo, localizaciones, efectos visuales y vestuario, y genera tableros de planificación, calendarios y plantillas de presupuesto.
- Su AI Production Agent analiza guiones para detectar riesgos de producción y optimizar las jornadas de rodaje.
Asistente de escritura con IA para novelistas y guionistas. Incluye Story Bible para pasar del esquema al borrador, herramientas de reescritura, ampliación y descripción, y complementos como la conversión a guion cinematográfico.
- Story Bible guía del concepto al esquema, la planificación de capítulos y la generación de borradores en el estilo del autor.
Plataforma de guion y preproducción con editores de formato profesional, mapas de hitos narrativos, análisis de guion, desgloses de escenas, listas de planos, planificación, presupuestos y escritura colaborativa en tiempo real.
- Ofrece editores de guion multiformato, herramientas narrativas como mapas de hitos, storyboards y análisis de guion, además de desgloses escena a escena.
Montaje y posproducción
Editor de vídeo y pódcast basado en texto: al editar la transcripción se edita el vídeo. Incluye el coeditor autónomo de IA Underlord, limpieza de audio Studio Sound, eliminación de muletillas y traducción.
- Su flujo principal es la edición basada en texto: modificar la transcripción actualiza automáticamente el vídeo.
- Underlord es un coeditor autónomo de IA que puede escribir o revisar guiones, aplicar diseños y transiciones y ejecutar solicitudes de edición.
Editor profesional con IA generativa de Firefly: Generative Extend añade fotogramas y sonido ambiente a clips en 4K, Media Intelligence permite buscar material por significado y los subtítulos se traducen automáticamente.
- Generative Extend, basado en Adobe Firefly, amplía clips en 4K (hasta unos 2 segundos de vídeo y 10 segundos de audio) y los marca con Content Credentials. [helpx.adobe.com]
- La versión de abril de 2025 hizo disponible Generative Extend e incorporó búsqueda semántica Media Intelligence y traducción automática de subtítulos. [news.adobe.com]
Suite integral de montaje, color, efectos visuales y audio para posproducción. DaVinci Neural Engine ofrece IA para Magic Mask, Voice Isolation, reconocimiento facial, reencuadre inteligente e IntelliSearch.
- DaVinci Resolve 21 incluye herramientas de IA Neural Engine: Magic Mask, Voice Isolation, reconocimiento facial, reencuadre inteligente, IntelliSearch y CineFocus.
- Hay una versión gratuita; DaVinci Resolve Studio (295 dólares, pago único) añade Neural Engine y funciones avanzadas.
Editor de vídeo web y de escritorio con acceso gratuito y funciones de pago, como subtítulos con IA, eliminación de fondos, texto a voz, reducción de ruido y generación de vídeo.
- Ofrece subtítulos automáticos con IA en varios idiomas, eliminación de fondos de vídeo e imagen, texto a voz y un generador de vídeo con IA.
Herramienta de recorte asistida por IA que transforma vídeos largos en clips verticales, con detección de momentos, reencuadre, subtítulos y un editor visual para revisar el montaje final.
- La web oficial describe detección de momentos con IA, reencuadre vertical editable, recorte preciso y transcripción automática con subtítulos estilizados.
- El plan gratuito actual cubre dos vídeos largos en total, no dos al mes. La web ofrece empezar sin tarjeta de crédito y planes de pago mensuales.
Espacio de transcripción de vídeo y audio para investigar material, revisar entrevistas y preparar subtítulos, con transcripciones editables y marcas de tiempo, y exportación a documentos o subtítulos.
- Acepta enlaces públicos de vídeo compatibles y archivos subidos; ofrece transcripciones editables con marcas de tiempo y exportación a TXT, SRT, VTT, CSV, JSON y DOCX. No acepta enlaces privados ni de redes locales.
- La página de precios describe créditos de transcripción de pago por uso sin suscripción obligatoria; la edición y las exportaciones no consumen créditos adicionales.
Voz, doblaje y música
Plataforma de audio con IA para texto a voz, clonación de voz, doblaje, efectos y música, con transcripción y API para desarrolladores.
- ElevenCreative abarca voz, música, efectos de sonido, clonación de voz, doblaje y flujos creativos relacionados con vídeo.
- Su servicio de transcripción incluye identificación de hablantes y marcas de tiempo, junto a API de voz y música.
Servicio empresarial de clonación de voz y síntesis de habla para cine y televisión, con clonación personalizada supervisada por ingenieros, API de texto a voz en tiempo real y un catálogo de voces de IA.
- Sus trabajos incluyen recrear la voz del joven Luke Skywalker en The Mandalorian y mejorar el acento de Adrien Brody y Felicity Jones en The Brutalist.
- También se utilizó en Emilia Pérez (mejora del canto) y Cyberpunk 2077: Phantom Liberty (conservación de la voz de un actor fallecido).
Plataforma de música con IA que crea canciones originales completas (voz, letra y producción) a partir de texto, con separación de pistas, carga de audio y una estación de edición web.
- Genera canciones originales completas de distintos géneros a partir de una instrucción de texto; los derechos comerciales se incluyen en los planes de pago.
Asistente de composición musical con IA que genera temas originales en más de 250 estilos, admite audio o MIDI como influencia y modelos de estilo personalizados, con licencias que pueden incluir la propiedad completa de los derechos de autor.
- Genera música en más de 250 estilos, con edición y exportación multiformato, incluidos flujos MIDI.
- AIVA afirma que su plan Pro concede la propiedad de los derechos de autor de las composiciones generadas. El uso comercial sigue sujeto al plan y las condiciones de licencia vigentes.
Arte conceptual y desarrollo visual
Servicio de generación y edición de imágenes para arte conceptual y desarrollo visual. V8.2 es la versión predeterminada documentada, con personalización y Edit Model; las funciones de referencia dependen de la versión elegida.
- V8.2 pasó a ser la versión predeterminada de Midjourney el 24 de julio de 2026; incluye Edit Model, que sustituye los flujos Omni Reference, Character Reference y Retexture. [docs.midjourney.com]
- Según la documentación oficial, V7 se lanzó el 3 de abril de 2025 e incorporó Draft Mode y Omni Reference.
Suite creativa de IA para arte conceptual y desarrollo visual: imágenes en tiempo real, vídeo mediante modelos integrados, objetos 3D a partir de texto o imágenes, aumento de resolución y ajuste LoRA para estilos personalizados.
- El renderizado en tiempo real convierte formas simples en imágenes fotorrealistas; admite ajuste LoRA con datos del usuario.
- Integra modelos de vídeo externos, como Veo 3, Kling y Runway.
- Ofrece generación de objetos 3D a partir de texto y de imágenes.
Entradas históricas
Entrada histórica: servicio retirado. Sora 2 de OpenAI generaba vídeo y audio a partir de texto o imágenes, pero sus modelos y la Videos API cerraron el 24 de septiembre de 2026 y ya no están disponibles. OpenAI indica que no existe una API de sustitución equivalente.
- OpenAI cerró los modelos Sora 2 y la Videos API el 24 de septiembre de 2026; afirma que no existe una API de sustitución equivalente. [developers.openai.com]
- Antes del cierre, Sora 2 generaba clips detallados con audio sincronizado a partir de lenguaje natural o imágenes, con salidas verticales de 720x1280 y horizontales de 1280x720.