KI-Werkzeuge für Regie und Filmschaffende
Aktualisiert am 2026-10-11
Videogenerierung
KI-Plattform für Video und Modelle mit Gen-4.5 für kreative Arbeit, einer Entwickler-API und Forschung zu interaktiven GWM-1-Weltmodellen.
- Die offizielle Website beschreibt Gen-4.5 anhand von Bewegungsqualität, Prompt-Treue und visueller Genauigkeit.
- Runway beschreibt GWM-1 als allgemeines Weltmodell für die Interaktion mit Umgebungen und die Entwicklung von Simulationsabläufen.
- Runway Dev ergänzte am 26. August 2026 WAN 3.0: bis zu 30 Sekunden Video mit nativem Ton aus Text oder einem Startbild. [docs.dev.runwayml.com]
Videogenerierungsmodell von Google DeepMind (derzeit Veo 3.1) für filmische Clips mit nativem Ton, einschließlich Dialog, Geräuschen und Atmosphäre.
- Veo 3.1 erzeugt Ton nativ, darunter Geräusche, Umgebungsgeräusche und Dialog.
- Bietet Figurenkonsistenz über Referenzbilder, Kamerasteuerung (Zoom, Schwenk, Fahrt), Szenenverlängerung und Ausgabe bis 1080p/4K.
- Verfügbar über die Gemini-App, Google Flow, Google AI Studio und Google Vids.
KI-Filmwerkzeug von Google Labs für Kreative, mit Veo-Videomodellen sowie Video- und Bildgenerierung. Die regionale Verfügbarkeit ist eingeschränkt.
- Google beschreibt Flow als spezielles KI-Filmwerkzeug mit Zugang zu Veo 3.1. [deepmind.google]
KI-Videoplattform von Kuaishou. Kling 3.0 unterstützt multimodale Eingaben, Clips bis 15 Sekunden und nativen Ton in mehreren Sprachen.
- Kuaishou kündigte die Kling-3.0-Reihe am 5. Februar 2026 mit Videos bis 15 Sekunden und nativem mehrsprachigem Ton an. Die angekündigten 2K- und 4K-Ausgaben beziehen sich auf die Image-3.0-Modelle. [ir.kuaishou.com]
- Kuaishou kündigte außerdem Kling O1 als einheitliches multimodales Videomodell an. [ir.kuaishou.com]
Kreativer KI-Arbeitsbereich von Luma auf Basis der Ray-Videomodelle. Verbindet Bild-, Video- und Audiogenerierung auf einer unbegrenzten Arbeitsfläche, Storyboardentwicklung und Bildanimation mit Kamerabewegung.
- Nutzt Lumas eigene Ray3-Videomodelle und das Uni-1-Bildmodell sowie Modelle anderer Anbieter wie Veo 3.1 und Kling.
Kreative KI-Plattform für Video, Bild und Ton, mit Anwendungen für Bewegungsübertragung, Videoverlängerung, Bildbearbeitung, Sprache und Geräusche.
- Der Modellkatalog enthält Pika 2.5 und weitere Videomodelle. Die Produktnavigation führt auch Bild- und Audioabläufe auf.
- Videoanwendungen umfassen Bewegungsübertragung und Verlängerung; Bild- und Audioanwendungen umfassen Bearbeitung, Sprache und Geräusche.
Kreativplattform von MiniMax für Video, Bild und Ton mit filmischen Vorlagen wie CineScope.
- Die offizielle Oberfläche nennt Video-, Bild- und Audiowerkzeuge und führt CineScope unter den filmischen Vorlagen auf.
Videomodellfamilie und Plattform von Alibaba. Öffentliche Wan-Dokumentation beschreibt Text-zu-Video- und Bild-zu-Video-Generierung.
- Das offizielle Wan2.2-Repository dokumentiert Text-zu-Video, Bild-zu-Video und hybride Text/Bild-zu-Video-Modelle. [github.com]
Kreative KI-Plattform mit Bild-, Video-, Audio-, Film- und Effektabläufen sowie API- und MCP-Zugängen.
- Die offizielle Website führt Bild-, Video- und Audiowerkzeuge sowie Arbeitsbereiche wie Cinema Studio, Effects und Ads Studio auf.
- Die Produktnavigation bietet Zugänge für API- und MCP-Integrationen.
KI-Videoplattform für Werbe- und Performance-Teams. Verwandelt Drehbücher oder bestehende Werbemittel in neue Videos und Varianten von Produkten, Figuren oder Stimmen.
- Die offizielle Website beschreibt Videoerstellung aus Briefings oder Drehbüchern und den Austausch von Produkten in bestehenden Werbevideos.
- Sie beschreibt außerdem Figuren- und Stimmenaustausch sowie die Lokalisierung vorhandener Videos mit angepasster Lippensynchronität.
KI-Suite für Videoerstellung und Schnitt mit Drehbuchschreiben, Storyboards, Videogenerierung und Mehrspur-Zeitachseneditor für Film- und andere Videoabläufe.
- Die offizielle Website beschreibt Drehbuchschreiben, einstellungsweise Storyboards und einen Zeitachseneditor, der sich mit natürlichsprachigen Schnittanweisungen steuern lässt.
- Die Plattform bietet neben Videogenerierung auch Bild-, Sprach- und Musikwerkzeuge. Der Zugang zu Modellen und Funktionen hängt vom Tarif ab.
Nutzungsabhängig bezahlter Kreativbereich für Video-, Bild- und Audiogenerierung, mit Werkzeugen für Figurenkonsistenz, Kamerawinkel, Hochskalierung und Hintergrundentfernung.
- Die offizielle Navigation bietet Video-, Bild- und Audiogenerierung sowie Werkzeuge für Konsistenz, Kamerawinkel, Hochskalierung und Hintergrundentfernung.
- Laut Preisseite ist kein Abonnement nötig; Nutzer bestätigen den genauen Generierungspreis in der App. Beispielkosten sind keine festen Preise für spätere Generierungen.
Storyboard & Vorvisualisierung
Browserbasierte KI-Filmsuite, die Drehbücher in Szenenauszüge, Storyboards und Videosequenzen überführt, mit dauerhaften Figurenprofilen, Kamerasteuerung und Zeitachseneditor.
- Lightricks stellte die Plattform im Februar 2024 als KI-Filmstudio zur Visualisierung von Geschichten vom Drehbuch bis zum fertigen Bild vor. [techcrunch.com]
- Ein KI-Storyboardgenerator zerlegt eingefügte Drehbücher in Szenen und einzelne Einstellungsbilder. [ltx.io]
Kollaborative Storyboardplattform für Video- und Animationsteams mit KI-Bildern, zeitlich abgestimmten Animatics samt Ton sowie Kundenprüfung und Freigabe.
- KI-Bildgenerierung erstellt Varianten von Storyboardbildern aus Szenenbeschreibungen.
- Wandelt Storyboards in zeitlich abgestimmte Animatics mit Ton um und erfasst Versionen, Kommentare und Freigaben.
Forschungsframework für geometriegestützte Kurzdramengenerierung. Wandelt Gesamthandlung und lokalen Kontext in räumlich verankerte Videoabläufe mit mehreren Einstellungen und daraus erzeugte Videos um.
- DramaDirector trennt jede Einstellung in statische visuelle und dynamische erzählerische Bedingungen. Tiefen- und Posenreferenzen realer Kurzdramen steuern das erste Bild und die Bild-zu-Video-Synthese.
- Die Studie stellt DramaBoard vor: einen Benchmark aus 35 Realfilm-Dramen, 2.800 Episoden und 81.000 Einstellungen mit strukturierten Storyboards und mehrdimensionalen Bewertungsverfahren.
Drehbuch & Vorbereitung
KI-Vorproduktionsplattform für automatische Drehbuchauszüge (Besetzung, Requisiten, Drehorte, VFX, Kostüm), Drehpläne und Budgets. Ein AI Production Agent weist auf Produktionsrisiken hin.
- Automatische KI-Drehbuchauszüge markieren Besetzung, Requisiten, Drehorte, VFX und Kostüm und erstellen Drehplanübersichten, Zeitpläne und Budgetvorlagen.
- Der AI Production Agent analysiert Drehbücher, erkennt Produktionsrisiken und optimiert Drehtage.
KI-Schreibpartner für Roman- und Drehbuchautoren. Story Bible begleitet vom Entwurf zur Textfassung; hinzu kommen Umschreiben, Erweitern, Beschreiben und Plugins, etwa zur Drehbuchumwandlung.
- Story Bible führt vom Konzept über Gliederung und Kapitelplanung zur Entwurfserstellung im eigenen Stil.
Drehbuch- und Vorproduktionsplattform mit branchenüblichen Editoren, Beat Sheets, Drehbuchanalyse, Szenenauszügen, Einstellungslisten, Planung und Budgetierung sowie gemeinsamem Schreiben in Echtzeit.
- Bietet Drehbucheditoren für mehrere Formate, Entwicklungswerkzeuge wie Beat Sheets, Storyboards und Drehbuchanalyse sowie szenenweise Auszüge.
Schnitt & Postproduktion
Textbasierter Video- und Podcasteditor: Wer das Transkript bearbeitet, schneidet das Video. Mit KI-Coeditor Underlord, Studio Sound zur Tonbereinigung, Füllwortentfernung und Übersetzung.
- Der zentrale Ablauf ist textbasierter Schnitt: Änderungen am Transkript aktualisieren das Video automatisch.
- Underlord ist ein agentischer KI-Coeditor, der Drehbücher schreibt oder überarbeitet, Layouts und Übergänge anwendet und Schnittanweisungen ausführt.
Branchenüblicher Editor mit generativer Firefly-KI: Generative Extend ergänzt Frames und Raumton in 4K, Media Intelligence ermöglicht semantische Materialsuche und Untertitel lassen sich automatisch übersetzen.
- Generative Extend mit Adobe Firefly verlängert Clips in 4K um bis zu etwa 2 Sekunden Video und bis zu 10 Sekunden Ton. Die Clips werden mit Content Credentials gekennzeichnet. [helpx.adobe.com]
- Die Version vom April 2025 machte Generative Extend allgemein verfügbar und ergänzte semantische Suche mit Media Intelligence sowie automatische Untertitelübersetzung. [news.adobe.com]
Suite für Schnitt, Farbkorrektur, VFX und Audiopostproduktion. Die DaVinci Neural Engine betreibt KI-Funktionen wie Magic Mask, Voice Isolation, Gesichtserkennung, intelligente Bildanpassung und IntelliSearch.
- DaVinci Resolve 21 umfasst Neural-Engine-KI wie Magic Mask, Voice Isolation, Gesichtserkennung, intelligente Bildanpassung, IntelliSearch und CineFocus.
- Eine kostenlose Version ist verfügbar. DaVinci Resolve Studio (einmalig 295 US-Dollar) ergänzt die Neural Engine und erweiterte Funktionen.
Videoeditor für Browser und Desktop mit kostenlosem Zugang und kostenpflichtigen Funktionen wie KI-Untertiteln, Hintergrundentfernung, Sprachausgabe, Rauschminderung und Videogenerierung.
- Bietet automatische KI-Untertitel in mehreren Sprachen, Hintergrundentfernung für Video und Bild, Sprachausgabe und einen KI-Videogenerator.
KI-gestütztes Werkzeug für kurze Hochformatclips aus langen Videos, mit Erkennung geeigneter Momente, Bildanpassung, Untertiteln und visuellem Editor zur Prüfung des finalen Schnitts.
- Die offizielle Website beschreibt KI-Momenterkennung, bearbeitbare Hochformatanpassung, präzisen Zuschnitt und automatische Transkription mit gestalteten Untertiteln.
- Der aktuelle kostenlose Tarif umfasst insgesamt zwei lange Videos, nicht zwei pro Monat. Die Website wirbt mit einem Start ohne Kreditkarte und monatlichen kostenpflichtigen Tarifen.
Transkriptionsumgebung für Video und Ton zur Materialrecherche, Interviewprüfung und Untertitelvorbereitung, mit bearbeitbaren Transkripten samt Zeitstempeln und Dokument- oder Untertitelexport.
- Nimmt unterstützte öffentliche Videolinks und hochgeladene Medien an. Bearbeitbare Transkripte mit Zeitstempeln lassen sich als TXT, SRT, VTT, CSV, JSON und DOCX exportieren. Private und lokale Netzwerklinks werden nicht akzeptiert.
- Die Preisseite beschreibt nutzungsabhängig bezahlte Transkriptionsguthaben ohne Pflichtabonnement. Bearbeitung und Export verbrauchen keine zusätzlichen Guthaben.
Sprache, Synchronisation & Musik
KI-Audioplattform mit Sprachausgabe, Stimmenklonen, Synchronisation, Geräusch- und Musikgenerierung sowie Spracherkennung und Entwickler-APIs.
- ElevenCreative umfasst Sprache, Musik, Geräusche, Stimmenklonen, Synchronisation und videobezogene kreative Abläufe.
- Die Spracherkennung unterstützt Sprecherzuordnung und Zeitstempel; zusätzlich gibt es APIs für Sprache und Musik.
Stimmenklon- und Sprachsynthesedienst für Film- und Fernsehproduktionen, mit technisch betreutem individuellen Stimmenklonen, Echtzeit-TTS-API und einem Marktplatz für KI-Stimmen.
- Zu den Referenzen zählen die Rekonstruktion der jungen Luke-Skywalker-Stimme in The Mandalorian und Akzentanpassungen für Adrien Brody und Felicity Jones in The Brutalist.
- Auch eingesetzt in Emilia Pérez (Gesangsbearbeitung) und Cyberpunk 2077: Phantom Liberty (Erhalt der Stimme eines verstorbenen Schauspielers).
KI-Musikplattform, die aus Textprompts vollständige eigene Songs mit Gesang, Text und Produktion erzeugt. Mit Spurentrennung, Audiouploads und browserbasierter Bearbeitungsumgebung.
- Erzeugt vollständige eigene Songs verschiedener Genres aus einem Textprompt. Kommerzielle Nutzungsrechte gehören zu kostenpflichtigen Tarifen.
KI-Kompositionsassistent für eigene Stücke in über 250 Stilen. Unterstützt MIDI- und Audioeinflüsse, eigene Stilmodelle und Lizenzstufen bis zum vollständigen Urheberrechtseigentum.
- Erzeugt Musik in mehr als 250 Stilen mit Bearbeitung und Export in mehreren Formaten, einschließlich MIDI-Abläufen.
- Laut AIVA gewährt der Pro-Tarif Urheberrechtseigentum an erzeugten Kompositionen. Kommerzielle Nutzung unterliegt weiterhin den aktuellen Tarif- und Lizenzbedingungen.
Konzeptkunst & Lookentwicklung
Bildgenerierung und -bearbeitung für Konzeptkunst und Lookentwicklung. V8.2 ist der dokumentierte Standard, mit Personalisierung und Edit Model. Referenzfunktionen hängen von der gewählten Version ab.
- V8.2 wurde am 24. Juli 2026 zur Standardversion. Das enthaltene Edit Model ersetzt Abläufe mit Omni Reference, Character Reference und Retexture. [docs.midjourney.com]
- Laut offizieller Versionsdokumentation erschien V7 am 3. April 2025 mit Draft Mode und Omni Reference.
Kreative KI-Suite für Konzept- und Lookentwicklung: Echtzeitbilder, Videos über integrierte Modelle, 3D-Objekte aus Text oder Bildern, Hochskalierung und LoRA-Anpassung für eigene Stile.
- Echtzeitrendering wandelt einfache Formen in fotorealistische Bilder um. Unterstützt LoRA-Anpassung mit Nutzerdaten.
- Integriert Videomodelle anderer Anbieter wie Veo 3, Kling und Runway.
- Bietet KI-Abläufe für 3D-Objekte aus Text und Bildern.
Archivierte Einträge
Archivierter Eintrag — eingestellt. OpenAIs Sora 2 erzeugte Video und Ton aus Text oder Bildern. Die Sora-2-Modelle und die Videos API wurden am 24. September 2026 abgeschaltet und sind nicht mehr verfügbar. Laut OpenAI gibt es keine direkte Ersatz-API.
- OpenAI schaltete die Sora-2-Modelle und die Videos API am 24. September 2026 ab. Laut Unternehmen gibt es keine direkte Ersatz-API. [developers.openai.com]
- Vor der Abschaltung erzeugte Sora 2 detailreiche Clips mit synchronisiertem Ton aus Textprompts oder Bildern, darunter Hochformat 720x1280 und Querformat 1280x720.