감독과 영화인을 위한 AI 도구
업데이트 2026-10-11
영상 생성
Gen-4.5 창작 모델, 개발자 API, 상호작용형 GWM-1 월드 모델 연구를 제공하는 AI 영상 및 모델 플랫폼입니다.
- 공식 사이트는 Gen-4.5의 움직임 품질, 프롬프트 준수와 시각적 충실도를 강조합니다.
- Runway는 GWM-1을 환경과 상호작용하고 시뮬레이션 워크플로를 개발하기 위한 범용 월드 모델로 설명합니다.
- Runway Dev는 2026년 8월 26일 WAN 3.0을 추가했습니다. 텍스트나 시작 프레임 이미지로 네이티브 오디오가 포함된 최대 30초 영상을 생성합니다. [docs.dev.runwayml.com]
Google DeepMind의 영상 생성 모델로, 현재 Veo 3.1이 제공됩니다. 대사, 효과음, 주변 소리를 포함한 네이티브 오디오와 함께 영화적인 영상을 생성합니다.
- Veo 3.1은 효과음, 주변 소음, 대사 등 오디오를 직접 생성합니다.
- 참조 이미지를 통한 캐릭터 일관성, 카메라 움직임 제어(줌, 팬, 달리), 장면 확장과 최대 1080p/4K 출력을 제공합니다.
- Gemini 앱, Google Flow, Google AI Studio와 Google Vids에서 사용할 수 있습니다.
Google Labs가 창작자를 위해 만든 AI 영화 제작 도구입니다. Veo 영상 모델로 영상과 이미지를 생성하며, 이용 가능한 지역은 제한됩니다.
- Google은 Flow를 Veo 3.1을 이용할 수 있는 전용 AI 영화 제작 도구로 소개합니다. [deepmind.google]
Kuaishou의 AI 영상 생성 플랫폼입니다. Kling 3.0은 멀티모달 입력, 최대 15초 영상과 다국어 네이티브 오디오를 지원합니다.
- Kuaishou는 2026년 2월 5일 Kling 3.0 시리즈를 발표하며 최대 15초 영상 생성과 다국어 네이티브 오디오를 소개했습니다. 발표에서 2K 및 4K 출력은 Image 3.0 모델의 기능으로 설명했습니다. [ir.kuaishou.com]
- Kuaishou는 통합 멀티모달 영상 모델로 소개한 Kling O1도 발표했습니다. [ir.kuaishou.com]
Ray 영상 모델을 중심으로 이미지, 영상, 오디오 생성을 무한 캔버스에 결합한 Luma의 AI 창작 공간입니다. 스토리보드 개발과 카메라 움직임을 포함한 이미지 기반 영상 생성을 제공합니다.
- Luma의 Ray3 시리즈 영상 모델과 Uni-1 이미지 모델을 사용하며, Veo 3.1과 Kling 등 외부 모델도 제공합니다.
영상, 이미지, 오디오를 생성하는 AI 창작 플랫폼입니다. 동작 전이, 영상 확장, 이미지 편집, 음성 및 효과음 앱을 제공합니다.
- 모델 목록에는 Pika 2.5와 다른 영상 모델이 있으며, 제품 메뉴에는 이미지와 오디오 워크플로도 있습니다.
- 영상 앱은 동작 전이와 영상 확장을, 이미지 및 오디오 앱은 편집, 음성, 효과음을 제공합니다.
MiniMax의 창작 플랫폼으로, 영상, 이미지, 오디오 제작 도구와 CineScope 같은 영화적 프리셋을 제공합니다.
- 공식 인터페이스에는 영상, 이미지, 오디오 제작 도구가 있으며 영화적 프리셋에 CineScope가 포함됩니다.
Alibaba의 영상 생성 모델군 및 플랫폼입니다. 공개 Wan 모델 문서는 텍스트 기반 및 이미지 기반 영상 생성을 다룹니다.
- 공식 Wan2.2 저장소에는 텍스트 기반, 이미지 기반, 텍스트·이미지 혼합 입력 영상 생성 모델이 설명되어 있습니다. [github.com]
이미지, 영상, 오디오, 영화적 연출과 시각 효과 워크플로를 제공하는 AI 창작 플랫폼입니다. API와 MCP 연동 진입점도 제공합니다.
- 공식 사이트에는 이미지, 영상, 오디오 도구와 Cinema Studio, Effects, Ads Studio 작업 공간이 소개되어 있습니다.
- 제품 메뉴에서 API와 MCP 연동 진입점을 제공합니다.
광고 및 퍼포먼스 팀을 위한 AI 영상 제작 플랫폼입니다. 시나리오나 기존 광고 소재로 새 영상과 제품, 캐릭터, 음성의 여러 버전을 만듭니다.
- 공식 사이트는 기획안·시나리오 기반 영상 생성과 기존 광고 영상 내 제품 교체를 설명합니다.
- 캐릭터나 음성 교체, 립싱크 조정을 통한 기존 영상의 현지화도 설명합니다.
시나리오 작성, 스토리보드, 영상 생성과 멀티트랙 타임라인 편집기를 제공하는 AI 영상 제작·편집 통합 도구입니다. 영화 제작과 다양한 영상 워크플로를 지원합니다.
- 공식 사이트는 시나리오 작성, 숏별 스토리보드와 자연어 편집 지시로 제어할 수 있는 타임라인 편집기를 설명합니다.
- 영상 생성과 함께 이미지, 음성, 음악 도구를 제공합니다. 사용 가능한 모델과 기능은 선택한 요금제에 따라 달라집니다.
스토리보드 및 프리비즈
시나리오를 장면 분석, 스토리보드와 영상 시퀀스로 바꾸는 웹 기반 AI 영화 제작 통합 도구입니다. 지속적으로 사용하는 캐릭터 프로필, 카메라 방향 제어와 타임라인 편집기를 제공합니다.
- Lightricks가 2024년 2월 출시한 AI 영화 제작 스튜디오로, 시나리오를 영상으로 시각화합니다. [techcrunch.com]
- 붙여 넣은 시나리오를 장면과 숏별 이미지로 나누는 AI 스토리보드 생성기가 포함됩니다. [ltx.io]
영상 및 애니메이션 팀을 위한 협업 스토리보드 플랫폼입니다. 프레임용 AI 이미지 생성, 오디오가 포함된 애니매틱과 고객 검토·승인 워크플로를 제공합니다.
- 장면 설명으로 스토리보드 프레임의 여러 버전을 만드는 AI 이미지 생성 기능이 있습니다.
- 스토리보드를 오디오가 포함된 애니매틱으로 바꾸고 버전, 댓글과 승인을 관리합니다.
기하 정보로 안내하는 단편 드라마 생성 연구 프레임워크입니다. 전체 줄거리와 개별 맥락을 바탕으로 근거를 갖춘 여러 숏의 영상 계획과 결과물을 만듭니다.
- DramaDirector는 각 숏을 정적 시각 조건과 동적 서사 조건으로 분리합니다. 실제 단편 드라마 숏에서 깊이·포즈 참조를 검색하여 첫 프레임 생성과 이미지 기반 영상 합성을 안내합니다.
- 논문은 실사 드라마 35편, 에피소드 2.8천 개, 숏 8.1만 개로 만든 DramaBoard 벤치마크를 소개합니다. 구조화된 스토리보드와 다차원 평가 절차를 포함합니다.
시나리오 및 사전 제작
시나리오의 배우, 소품, 장소, VFX, 의상을 자동으로 분석하고 촬영 일정과 예산을 만드는 AI 사전 제작 플랫폼입니다. AI Production Agent로 제작 위험도 파악합니다.
- AI 시나리오 분석으로 배우, 소품, 장소, VFX, 의상을 태그하고 스트립보드, 일정과 예산 템플릿을 생성합니다.
- AI Production Agent는 시나리오를 분석하여 제작 위험을 찾고 촬영 일정을 최적화합니다.
소설가와 시나리오 작가를 위한 AI 집필 도우미입니다. 구성에서 초안까지 지원하는 Story Bible, 다시 쓰기·확장·묘사 도구와 시나리오 변환 등의 플러그인을 제공합니다.
- Story Bible은 아이디어부터 구성, 챕터 기획과 초안 생성까지 작가 고유의 스타일로 작업하도록 안내합니다.
편집 및 후반 작업
전사문을 수정하면 영상도 바뀌는 텍스트 기반 영상 및 팟캐스트 편집기입니다. Underlord AI 공동 편집자, Studio Sound 오디오 정리, 군더더기 말 제거와 번역을 제공합니다.
- 핵심은 텍스트 기반 편집으로, 전사문을 수정하면 영상이 자동으로 반영됩니다.
- Underlord는 시나리오 작성·수정, 레이아웃과 전환 적용, 편집 요청 실행이 가능한 에이전트형 AI 공동 편집자입니다.
Firefly 기반 생성형 AI 기능을 제공하는 업계 표준 편집기입니다. Generative Extend는 4K 클립에 프레임과 룸톤을 추가하고, Media Intelligence는 의미 기반 영상 검색을 지원하며 자막은 자동 번역됩니다.
- Adobe Firefly 기반 Generative Extend는 4K 클립을 확장하고(영상 약 2초, 오디오 최대 10초) Content Credentials를 표시합니다. [helpx.adobe.com]
- 2025년 4월 버전에서 Generative Extend 정식 제공, Media Intelligence 의미 기반 검색과 자동 자막 번역이 추가되었습니다. [news.adobe.com]
편집, 색보정, VFX와 오디오 후반 작업을 결합한 통합 도구입니다. DaVinci Neural Engine이 Magic Mask, Voice Isolation, 얼굴 인식, 스마트 리프레이밍과 IntelliSearch 같은 AI 기능을 제공합니다.
- DaVinci Resolve 21에는 Magic Mask, Voice Isolation, 얼굴 인식, 스마트 리프레이밍, IntelliSearch와 CineFocus 등 Neural Engine AI 도구가 포함됩니다.
- 무료 버전이 있으며, DaVinci Resolve Studio(일회성 295달러)는 Neural Engine과 고급 기능을 추가합니다.
무료 이용과 유료 기능을 제공하는 온라인 및 데스크톱 영상 편집기입니다. AI 자막, 배경 제거, 텍스트 음성 변환, 노이즈 감소와 영상 생성 기능이 있습니다.
- 다국어 AI 자동 자막, 영상·이미지 배경 제거, 텍스트 음성 변환과 AI 영상 생성기를 제공합니다.
긴 영상을 짧은 세로 영상으로 바꾸는 AI 보조 클립 제작 도구입니다. 주요 순간 감지, 리프레이밍, 자막과 최종 편집본 검토용 시각 편집기를 제공합니다.
- 공식 사이트는 AI 주요 순간 감지, 조정 가능한 세로 리프레이밍, 정밀 트리밍과 스타일 자막을 포함한 자동 전사를 설명합니다.
- 현재 무료 요금제로 처리할 수 있는 긴 영상은 매달 2개가 아니라 총 2개입니다. 신용카드 없이 시작할 수 있으며 월간 유료 요금제가 있습니다.
음성, 더빙 및 음악
텍스트 음성 변환, 음성 복제, 더빙, 효과음과 음악 생성을 제공하는 AI 오디오 플랫폼입니다. 음성 전사와 개발자 API도 제공합니다.
- ElevenCreative는 음성, 음악, 효과음, 음성 복제, 더빙과 영상 관련 창작 워크플로를 다룹니다.
- 음성 전사는 화자 구분과 타임스탬프를 지원하며, 음성과 음악용 API도 제공합니다.
영화와 TV 제작에 쓰이는 기업용 음성 복제 및 합성 서비스입니다. 엔지니어가 감독하는 맞춤 음성 복제, 실시간 TTS API와 AI 음성 마켓플레이스를 제공합니다.
- The Mandalorian에서 젊은 Luke Skywalker의 음성을 재현했으며, The Brutalist에서 Adrien Brody와 Felicity Jones의 억양 보정에 사용되었습니다.
- Emilia Pérez의 노래 보정과 Cyberpunk 2077: Phantom Liberty의 사망한 배우 음성 보존에도 사용되었습니다.
텍스트 프롬프트로 보컬, 가사와 전체 프로덕션을 포함한 완성된 창작곡을 만드는 AI 음악 플랫폼입니다. 스템 분리, 오디오 업로드와 웹 기반 편집 작업 공간을 제공합니다.
- 하나의 텍스트 프롬프트로 다양한 장르의 완성된 창작곡을 생성합니다. 상업적 이용 권한은 유료 요금제에 포함됩니다.
콘셉트 아트 및 비주얼 개발
콘셉트 아트와 비주얼 개발을 위한 이미지 생성·편집 서비스입니다. 공식 문서상 기본 버전은 V8.2이며 개인화와 Edit Model을 제공합니다. 참조 기능은 선택한 버전에 따라 다릅니다.
- V8.2는 2026년 7월 24일 Midjourney의 기본 버전이 되었습니다. 이 버전의 Edit Model은 Omni Reference, Character Reference와 Retexture 워크플로를 대체합니다. [docs.midjourney.com]
- 공식 버전 문서에 따르면 V7은 2025년 4월 3일 출시되어 Draft Mode와 Omni Reference를 도입했습니다.
기록 항목
서비스 종료된 기록 항목입니다. OpenAI의 Sora 2는 텍스트나 이미지로 영상과 오디오를 생성하던 모델입니다. Sora 2 모델과 Videos API는 2026년 9월 24일 종료되어 더 이상 이용할 수 없습니다. OpenAI는 일대일로 대체하는 API가 없다고 안내합니다.
- OpenAI는 2026년 9월 24일 Sora 2 모델과 Videos API를 종료했습니다. 일대일로 대체하는 API는 없다고 안내합니다. [developers.openai.com]
- 종료 전 Sora 2는 자연어 또는 이미지 입력으로 풍부한 세부 묘사와 동기화된 오디오를 갖춘 영상을 생성했습니다. 세로 720x1280 및 가로 1280x720 출력을 지원했습니다.