面向導演與電影工作者的 AI 工具
更新於 2026-10-11
影片生成
提供 Gen-4.5 影片創作、開發者 API 及互動式 GWM-1 世界模型研究的 AI 影片與模型平台。
- 官網將 Gen-4.5 的特色概括為動作品質、提示遵循度與視覺保真度。
- Runway 將 GWM-1 描述為用於環境互動和模擬工作流程的通用世界模型。
- Runway Dev 於 2026 年 8 月 26 日加入 WAN 3.0,支援根據文字或起始影格影像生成最長 30 秒、帶原生音訊的影片。 [docs.dev.runwayml.com]
Google DeepMind 的影片生成模型(目前為 Veo 3.1),可生成帶原生音訊的電影感片段,音訊包括對白、音效和環境聲。
- Veo 3.1 原生生成音訊,包括音效、環境雜訊和對白。
- 透過參考影像提供角色一致性,並提供鏡頭運動控制(變焦、搖鏡、推軌)、場景延長,輸出最高可達 1080p/4K。
- 可透過 Gemini app、Google Flow、Google AI Studio 和 Google Vids 使用。
Google Labs 面向創作者打造的 AI 電影製作工具,由 Veo 影片模型驅動,結合影片與影像生成。可用地區有限。
- Google 將 Flow 描述為專門的 AI 電影製作工具,可調用 Veo 3.1。 [deepmind.google]
快手的 AI 影片生成平台。Kling 3.0 支援多模態輸入、最長 15 秒的影片片段,以及多語言原生音訊。
- 快手於 2026 年 2 月 5 日公告 Kling 3.0 系列,介紹了最長 15 秒的影片生成和多語言原生音訊;公告中的 2K 和 4K 輸出指的是 Image 3.0 影像模型。 [ir.kuaishou.com]
- 快手還宣佈了 Kling O1,並將其描述為統一的多模態影片模型。 [ir.kuaishou.com]
Luma 的 AI 創意工作區,圍繞其 Ray 影片模型建置,在無限畫布上整合影像、影片和音訊生成,並提供分鏡(storyboard)開發和帶鏡頭運動的圖生影片動畫。
- 運行 Luma 自有的 Ray3 系列影片模型和 Uni-1 影像模型,同時也託管 Veo 3.1、Kling 等第三方模型。
面向影片、影像和音訊生成的 AI 創作平台,提供動作遷移、影片延長、影像編輯、語音和音效等應用。
- 模型目錄包括 Pika 2.5 及其他影片模型;產品導航還列出影像和音訊工作流程。
- 影片應用包括動作遷移和影片延長;影像與音訊應用包括編輯、語音及音效。
整合影像、影片、音訊、電影化創作和視覺特效工作流程的 AI 平台,並提供 API 和 MCP 入口。
- 官網列出影像、影片與音訊工具,工作區包括 Cinema Studio、Effects 和 Ads Studio。
- 產品導航提供 API 和 MCP 整合入口。
面向廣告與成效行銷團隊的 AI 影片創作平台,可根據腳本或已有素材製作影片,並調整產品、角色或聲音。
- 官網介紹了根據簡報或腳本生成影片,以及在已有影片素材中替換產品。
- 還提供角色或聲音替換,以及透過調整嘴型同步將已有影片在地化的工作流程。
整合腳本寫作、分鏡、影片生成和多軌時間軸編輯的 AI 影片製作套件,面向電影製作及其他影片工作流程。
- 官網介紹了腳本寫作、逐鏡頭分鏡規劃,以及可透過自然語言指令控制的時間軸編輯器。
- 平台在影片生成之外提供影像、語音和音樂工具;可使用的模型與功能取決於所選方案。
分鏡與預視
基於網頁的 AI 電影製作整合套件,可將劇本轉化為場景拆解、分鏡和影片序列,提供持久角色檔案、鏡頭調度控制和時間軸編輯器。
- Lightricks 於 2024 年 2 月推出,定位為 AI 驅動的電影製作工作室,用於把故事從劇本一路可視化到銀幕。 [techcrunch.com]
- 包含 AI 分鏡生成器,可把貼上的劇本拆分為場景和逐鏡頭畫面。 [ltx.io]
面向影片和動畫團隊的協作式分鏡平台,提供為分鏡格生成畫面的 AI 影像生成、帶音訊的定時動態分鏡(animatic),以及客戶審閱與核准流程。
- 包含 AI 影像生成,可根據場景描述生成分鏡畫面的多個變體。
- 可將分鏡板轉換為帶音訊的定時動態分鏡,並追蹤版本、評論和核准確認。
劇本與前期籌備
AI 前期製作平台,可自動拆解劇本(演員、道具、場地、視覺特效、服裝),生成拍攝日程和預算,並運行可提示製作風險的 AI Production Agent。
- 自動 AI 劇本拆解會標記演員、道具、場地、視覺特效和服裝,並生成場景條板(stripboard)、拍攝日程和預算範本。
- 其 AI Production Agent 會分析劇本以發現製作風險,並優化拍攝日安排。
面向小說作者和編劇的 AI 寫作搭檔,提供從提綱到初稿的 Story Bible 工作流程、改寫、擴寫和描寫工具,以及包括劇本轉換在內的外掛。
- Story Bible 引導作者從構思出發,經過提綱、章節規劃,直到以自己的風格生成初稿。
剪輯與後期製作
以文字操作的影片與 Podcast 剪輯工具:修改逐字稿即可剪輯影片。包含 AI 剪輯協作代理 Underlord、Studio Sound 音訊清理、贅詞移除與翻譯。
- 核心流程是以文字剪輯:修改逐字稿,影片會自動隨之更新。
- Underlord 是 AI 剪輯協作代理,可以撰寫或修改腳本、套用版面與轉場,並執行剪輯指令。
業界標準剪輯軟體,配備由 Firefly 驅動的生成式 AI 功能:Generative Extend 可為 4K 片段補充畫面影格和環境底音(room tone),Media Intelligence 支援按語義搜尋素材,字幕可自動翻譯。
- 由 Adobe Firefly 驅動的 Generative Extend 可延長 4K 影片片段(影片最多約 2 秒,音訊最多 10 秒),並為片段標示 Content Credentials。 [helpx.adobe.com]
- 2025 年 4 月的版本全面上線了 Generative Extend,並新增 Media Intelligence 語義搜尋和自動字幕翻譯。 [news.adobe.com]
涵蓋剪輯、調光、視覺特效和音訊的後期製作整合套件,其 DaVinci Neural Engine 驅動 Magic Mask、Voice Isolation、人臉辨識、智慧重新構圖和 IntelliSearch 等 AI 工具。
- DaVinci Resolve 21 包含 Neural Engine AI 工具:Magic Mask、Voice Isolation、人臉辨識、智慧重新構圖、IntelliSearch 和 CineFocus。
- 提供免費版本;DaVinci Resolve Studio($295,一次性付費)增加 Neural Engine 和進階功能。
提供免費入口及付費功能的線上與桌面影片編輯器,AI 功能包括字幕、背景移除、文字轉語音、降噪和影片生成。
- 提供多語言 AI 自動字幕、影片與影像背景移除、文字轉語音和 AI 影片生成器。
將長影片轉為直式短片的 AI 輔助剪輯工具,提供片段識別、畫面重構、字幕和可視化編輯器,由使用者審核最終剪輯。
- 官網介紹了 AI 片段識別、可編輯的直式畫面重構、精確裁切,以及帶樣式字幕的自動轉寫。
- 目前免費方案總共可處理兩支長影片,而非每月兩支。官網提供免信用卡的使用入口與按月付費方案。
語音、配音與音樂
AI 音訊平台,提供文字轉語音、聲音複製、配音、音效和音樂生成,以及語音轉文字和開發者 API。
- ElevenCreative 覆蓋語音、音樂、音效、聲音複製、配音及影片相關創作工作流程。
- 語音轉文字服務支援說話者區分和時間標記,並提供語音及音樂相關 API。
用於影視製作的企業級聲音複製與語音合成服務,提供由工程師監督的客製聲音複製、即時 TTS(文字轉語音)API,以及 AI 語音市集。
- 參與作品包括為 The Mandalorian 重現年輕 Luke Skywalker 的聲音,以及在 The Brutalist 中協助 Adrien Brody 與 Felicity Jones 調整口音。
- 也用於 Emilia Pérez 的歌唱表現增強,以及 Cyberpunk 2077: Phantom Liberty 中保留已故演員的聲音。
AI 音樂生成平台,可根據文字提示生成完整的原創歌曲(人聲、歌詞和完整製作),並提供音軌分離(stem separation)、音訊上傳和基於網頁的編輯工作站。
- 只需一條文字提示即可生成各種曲風的完整原創歌曲;商業使用權隨付費方案提供。
概念美術與視覺風格開發
用於概念美術和視覺風格開發的影像生成與編輯服務。文件中的預設版本為 V8.2,提供個人化和 Edit Model;參考功能取決於所選版本。
- V8.2 於 2026 年 7 月 24 日成為 Midjourney 的預設版本;該版本包含 Edit Model,它取代了 Omni Reference、Character Reference 和 Retexture 工作流程。 [docs.midjourney.com]
- 據 Midjourney 官方版本文件,V7 於 2025 年 4 月 3 日發佈,引入了 Draft Mode 和 Omni Reference。
歷史條目
歷史條目,已停用。OpenAI 的 Sora 2 曾是一款可根據文字或影像生成帶音訊影片片段的模型,但 Sora 2 模型和 Videos API 已於 2026 年 9 月 24 日關停,不再可用;OpenAI 表示沒有一對一的替代 API。
- OpenAI 已於 2026 年 9 月 24 日關停 Sora 2 模型和 Videos API;該公司表示沒有一對一的替代 API。 [developers.openai.com]
- 關停之前,Sora 2 可根據自然語言或影像輸入生成帶同步音訊、細節豐富的影片片段,輸出包括直式 720x1280 和橫式 1280x720。