AI Director Tools
繁體中文

面向導演與電影工作者的 AI 工具

更新於 2026-10-11

「套件」涵蓋至少三項製作工作流程;「專用」著重單一任務。 點選卡片右上角圖示即可回饋。 詳細規則請見收錄原則。

影片生成

Runway

套件

Runway AI, Inc. · 官網 · 價格

提供 Gen-4.5 影片創作、開發者 API 及互動式 GWM-1 世界模型研究的 AI 影片與模型平台。

  • 官網將 Gen-4.5 的特色概括為動作品質、提示遵循度與視覺保真度。 (截至 2026-10-11)
  • Runway 將 GWM-1 描述為用於環境互動和模擬工作流程的通用世界模型。 (截至 2026-10-11)
  • Runway Dev 於 2026 年 8 月 26 日加入 WAN 3.0,支援根據文字或起始影格影像生成最長 30 秒、帶原生音訊的影片。 (截至 2026-10-11) [docs.dev.runwayml.com]

Google Veo

專用

Google DeepMind · 官網

Google DeepMind 的影片生成模型(目前為 Veo 3.1),可生成帶原生音訊的電影感片段,音訊包括對白、音效和環境聲。

  • Veo 3.1 原生生成音訊,包括音效、環境雜訊和對白。
  • 透過參考影像提供角色一致性,並提供鏡頭運動控制(變焦、搖鏡、推軌)、場景延長,輸出最高可達 1080p/4K。
  • 可透過 Gemini app、Google Flow、Google AI Studio 和 Google Vids 使用。

Flow

專用

Google Labs · 官網

Google Labs 面向創作者打造的 AI 電影製作工具,由 Veo 影片模型驅動,結合影片與影像生成。可用地區有限。

  • Google 將 Flow 描述為專門的 AI 電影製作工具,可調用 Veo 3.1。 [deepmind.google]

Kling AI

專用

Kuaishou Technology · 官網

快手的 AI 影片生成平台。Kling 3.0 支援多模態輸入、最長 15 秒的影片片段,以及多語言原生音訊。

  • 快手於 2026 年 2 月 5 日公告 Kling 3.0 系列,介紹了最長 15 秒的影片生成和多語言原生音訊;公告中的 2K 和 4K 輸出指的是 Image 3.0 影像模型。 (截至 2026-10-11) [ir.kuaishou.com]
  • 快手還宣佈了 Kling O1,並將其描述為統一的多模態影片模型。 [ir.kuaishou.com]

Luma Dream Machine

套件

Luma AI · 官網

Luma 的 AI 創意工作區,圍繞其 Ray 影片模型建置,在無限畫布上整合影像、影片和音訊生成,並提供分鏡(storyboard)開發和帶鏡頭運動的圖生影片動畫。

  • 運行 Luma 自有的 Ray3 系列影片模型和 Uni-1 影像模型,同時也託管 Veo 3.1、Kling 等第三方模型。

Pika

套件

Pika Labs · 官網

面向影片、影像和音訊生成的 AI 創作平台,提供動作遷移、影片延長、影像編輯、語音和音效等應用。

  • 模型目錄包括 Pika 2.5 及其他影片模型;產品導航還列出影像和音訊工作流程。 (截至 2026-10-11)
  • 影片應用包括動作遷移和影片延長;影像與音訊應用包括編輯、語音及音效。 (截至 2026-10-11)

Hailuo AI

套件

MiniMax · 官網

MiniMax 的創作平台,提供影片、影像和音訊創作入口,以及 CineScope 等電影化預設。

  • 官網介面列出影片、影像和音訊創作工具,電影化預設包括 CineScope。 (截至 2026-10-11)

Wan

專用

Alibaba · 官網

阿里巴巴的影片生成模型系列與平台。公開模型文件介紹了文生影片和圖生影片能力。

  • 官方 Wan2.2 倉庫提供文生影片、圖生影片及文字/影像混合輸入模型的文件。 (截至 2026-10-11) [github.com]

Higgsfield

套件

Higgsfield AI · 官網

整合影像、影片、音訊、電影化創作和視覺特效工作流程的 AI 平台,並提供 API 和 MCP 入口。

  • 官網列出影像、影片與音訊工具,工作區包括 Cinema Studio、Effects 和 Ads Studio。 (截至 2026-10-11)
  • 產品導航提供 API 和 MCP 整合入口。 (截至 2026-10-11)

Katalist

專用

Katalist AI · 官網 · 價格

面向廣告與成效行銷團隊的 AI 影片創作平台,可根據腳本或已有素材製作影片,並調整產品、角色或聲音。

  • 官網介紹了根據簡報或腳本生成影片,以及在已有影片素材中替換產品。 (截至 2026-10-11)
  • 還提供角色或聲音替換,以及透過調整嘴型同步將已有影片在地化的工作流程。 (截至 2026-10-11)

Invideo

套件

Invideo · 官網 · 價格

整合腳本寫作、分鏡、影片生成和多軌時間軸編輯的 AI 影片製作套件,面向電影製作及其他影片工作流程。

  • 官網介紹了腳本寫作、逐鏡頭分鏡規劃,以及可透過自然語言指令控制的時間軸編輯器。 (截至 2026-10-11)
  • 平台在影片生成之外提供影像、語音和音樂工具;可使用的模型與功能取決於所選方案。 (截至 2026-10-11)

MaxVideoAI

套件

MaxVideoAI · 官網 · 價格

按量付費的創作工作區,整合影片、影像和音訊生成,以及角色一致性、鏡頭角度調整、放大和背景移除等工具。

  • 官網導航提供影片、影像與音訊生成,以及一致性、鏡頭角度、放大和背景移除工具。 (截至 2026-10-11)
  • 價格頁說明無需訂閱,使用者在應用程式中確認實際生成費用。範例費用不代表後續生成的固定價格。 (截至 2026-10-11)

分鏡與預視

LTX Studio

套件

Lightricks · 官網

基於網頁的 AI 電影製作整合套件,可將劇本轉化為場景拆解、分鏡和影片序列,提供持久角色檔案、鏡頭調度控制和時間軸編輯器。

  • Lightricks 於 2024 年 2 月推出,定位為 AI 驅動的電影製作工作室,用於把故事從劇本一路可視化到銀幕。 [techcrunch.com]
  • 包含 AI 分鏡生成器,可把貼上的劇本拆分為場景和逐鏡頭畫面。 [ltx.io]

Boords

專用

Boords Ltd · 官網 · 價格

面向影片和動畫團隊的協作式分鏡平台,提供為分鏡格生成畫面的 AI 影像生成、帶音訊的定時動態分鏡(animatic),以及客戶審閱與核准流程。

  • 包含 AI 影像生成,可根據場景描述生成分鏡畫面的多個變體。
  • 可將分鏡板轉換為帶音訊的定時動態分鏡,並追蹤版本、評論和核准確認。

DramaDirector

專用

Academic research team · 官網

一個用於幾何引導短劇生成的研究框架,可將整體劇情和局部脈絡轉化為以幾何資訊為約束的多鏡頭影片規劃和影片輸出。

  • DramaDirector 把每個鏡頭解耦為靜態視覺條件和動態敘事條件,從真實短劇鏡頭中檢索深度-姿態參考,用以引導首影格生成和圖生影片合成。
  • 該論文提出 DramaBoard 基準,由 35 部真人實拍劇、約 2,800 集、約 81,000 個鏡頭建置,附帶結構化分鏡和多維評估協議。

劇本與前期籌備

Filmustage

專用

Filmustage · 官網 · 價格

AI 前期製作平台,可自動拆解劇本(演員、道具、場地、視覺特效、服裝),生成拍攝日程和預算,並運行可提示製作風險的 AI Production Agent。

  • 自動 AI 劇本拆解會標記演員、道具、場地、視覺特效和服裝,並生成場景條板(stripboard)、拍攝日程和預算範本。
  • 其 AI Production Agent 會分析劇本以發現製作風險,並優化拍攝日安排。

Sudowrite

專用

Sudowrite · 官網

面向小說作者和編劇的 AI 寫作搭檔,提供從提綱到初稿的 Story Bible 工作流程、改寫、擴寫和描寫工具,以及包括劇本轉換在內的外掛。

  • Story Bible 引導作者從構思出發,經過提綱、章節規劃,直到以自己的風格生成初稿。

Celtx

套件

Celtx (Backlight) · 官網

編劇與前期製作平台,提供業界標準的劇本編輯器、節拍表(beat sheet)、劇本分析、場景拆解、鏡頭清單、排期與預算,以及即時協同寫作。

  • 提供多格式劇本編輯器,以及包括節拍表、分鏡和劇本分析在內的故事開發工具,並支援逐場景拆解。

剪輯與後期製作

Descript

專用

Descript · 官網 · 價格

以文字操作的影片與 Podcast 剪輯工具:修改逐字稿即可剪輯影片。包含 AI 剪輯協作代理 Underlord、Studio Sound 音訊清理、贅詞移除與翻譯。

  • 核心流程是以文字剪輯:修改逐字稿,影片會自動隨之更新。
  • Underlord 是 AI 剪輯協作代理,可以撰寫或修改腳本、套用版面與轉場,並執行剪輯指令。

Adobe Premiere Pro

套件

Adobe · 官網

業界標準剪輯軟體,配備由 Firefly 驅動的生成式 AI 功能:Generative Extend 可為 4K 片段補充畫面影格和環境底音(room tone),Media Intelligence 支援按語義搜尋素材,字幕可自動翻譯。

  • 由 Adobe Firefly 驅動的 Generative Extend 可延長 4K 影片片段(影片最多約 2 秒,音訊最多 10 秒),並為片段標示 Content Credentials。 [helpx.adobe.com]
  • 2025 年 4 月的版本全面上線了 Generative Extend,並新增 Media Intelligence 語義搜尋和自動字幕翻譯。 [news.adobe.com]

DaVinci Resolve

套件

Blackmagic Design · 官網 · 價格

涵蓋剪輯、調光、視覺特效和音訊的後期製作整合套件,其 DaVinci Neural Engine 驅動 Magic Mask、Voice Isolation、人臉辨識、智慧重新構圖和 IntelliSearch 等 AI 工具。

  • DaVinci Resolve 21 包含 Neural Engine AI 工具:Magic Mask、Voice Isolation、人臉辨識、智慧重新構圖、IntelliSearch 和 CineFocus。
  • 提供免費版本;DaVinci Resolve Studio($295,一次性付費)增加 Neural Engine 和進階功能。

CapCut

套件

ByteDance · 官網

提供免費入口及付費功能的線上與桌面影片編輯器,AI 功能包括字幕、背景移除、文字轉語音、降噪和影片生成。

  • 提供多語言 AI 自動字幕、影片與影像背景移除、文字轉語音和 AI 影片生成器。

Clipzi

專用

Clipzi · 官網 · 價格

將長影片轉為直式短片的 AI 輔助剪輯工具,提供片段識別、畫面重構、字幕和可視化編輯器,由使用者審核最終剪輯。

  • 官網介紹了 AI 片段識別、可編輯的直式畫面重構、精確裁切,以及帶樣式字幕的自動轉寫。 (截至 2026-10-11)
  • 目前免費方案總共可處理兩支長影片,而非每月兩支。官網提供免信用卡的使用入口與按月付費方案。 (截至 2026-10-11)

VidiRelay

專用

VidiRelay · 官網 · 價格

用於素材研究、採訪審閱和字幕準備的影片與音訊轉寫工作區,提供帶時間標記的可編輯文字,以及文件或字幕匯出。

  • 支援指定平台的公開影片連結及上傳的媒體,提供帶時間標記的可編輯轉寫文字,可匯出 TXT、SRT、VTT、CSV、JSON 和 DOCX。不接受私有連結和本地網路連結。 (截至 2026-10-11)
  • 價格頁介紹了無需強制訂閱的按量付費轉寫積分;編輯和匯出不額外消耗積分。 (截至 2026-10-11)

語音、配音與音樂

ElevenLabs

套件

ElevenLabs · 官網

AI 音訊平台,提供文字轉語音、聲音複製、配音、音效和音樂生成,以及語音轉文字和開發者 API。

  • ElevenCreative 覆蓋語音、音樂、音效、聲音複製、配音及影片相關創作工作流程。 (截至 2026-10-11)
  • 語音轉文字服務支援說話者區分和時間標記,並提供語音及音樂相關 API。 (截至 2026-10-11)

Respeecher

專用

Respeecher · 官網

用於影視製作的企業級聲音複製與語音合成服務,提供由工程師監督的客製聲音複製、即時 TTS(文字轉語音)API,以及 AI 語音市集。

  • 參與作品包括為 The Mandalorian 重現年輕 Luke Skywalker 的聲音,以及在 The Brutalist 中協助 Adrien Brody 與 Felicity Jones 調整口音。
  • 也用於 Emilia Pérez 的歌唱表現增強,以及 Cyberpunk 2077: Phantom Liberty 中保留已故演員的聲音。

Suno

專用

Suno · 官網

AI 音樂生成平台,可根據文字提示生成完整的原創歌曲(人聲、歌詞和完整製作),並提供音軌分離(stem separation)、音訊上傳和基於網頁的編輯工作站。

  • 只需一條文字提示即可生成各種曲風的完整原創歌曲;商業使用權隨付費方案提供。

AIVA

專用

AIVA Technologies · 官網

AI 作曲助手,可生成 250 多種風格的原創樂曲,支援上傳 MIDI 或音訊作為參考,以及自訂風格模型;最高授權方案提供完整著作權。

  • 可生成超過 250 種風格的音樂,提供編輯和多格式匯出,包括 MIDI 工作流程。
  • AIVA 聲明 Pro 方案提供生成作品的著作權;商業使用仍須遵守當前方案和授權條款。 (截至 2026-10-11)

概念美術與視覺風格開發

Midjourney

專用

Midjourney, Inc. · 官網

用於概念美術和視覺風格開發的影像生成與編輯服務。文件中的預設版本為 V8.2,提供個人化和 Edit Model;參考功能取決於所選版本。

  • V8.2 於 2026 年 7 月 24 日成為 Midjourney 的預設版本;該版本包含 Edit Model,它取代了 Omni Reference、Character Reference 和 Retexture 工作流程。 (截至 2026-10-11) [docs.midjourney.com]
  • 據 Midjourney 官方版本文件,V7 於 2025 年 4 月 3 日發佈,引入了 Draft Mode 和 Omni Reference。 (截至 2026-10-11)

Krea

套件

Krea AI · 官網

用於概念設計和視覺風格開發的 AI 創意整合套件:即時影像生成、透過整合模型生成影片、文生 3D 和圖生 3D 物體生成、畫質放大,以及用於自訂風格的 LoRA 微調。

  • 即時算圖可將簡單形狀轉換為寫實的影像;支援基於使用者資料的 LoRA 微調。
  • 整合第三方影片模型,包括 Veo 3、Kling 和 Runway。
  • 提供 AI 3D 生成工作流程,支援文生 3D 物體和圖生 3D 物體。

歷史條目

Sora (discontinued)

專用

OpenAI · 官網

待移除,暫時保留供參考。移入歷史條目的日期為 2026-10-11。

歷史條目,已停用。OpenAI 的 Sora 2 曾是一款可根據文字或影像生成帶音訊影片片段的模型,但 Sora 2 模型和 Videos API 已於 2026 年 9 月 24 日關停,不再可用;OpenAI 表示沒有一對一的替代 API。

  • OpenAI 已於 2026 年 9 月 24 日關停 Sora 2 模型和 Videos API;該公司表示沒有一對一的替代 API。 (截至 2026-09-25) [developers.openai.com]
  • 關停之前,Sora 2 可根據自然語言或影像輸入生成帶同步音訊、細節豐富的影片片段,輸出包括直式 720x1280 和橫式 1280x720。 (截至 2026-09-25)