AI Director Tools
한국어

감독과 영화인을 위한 AI 도구

업데이트 2026-10-11

“통합”은 제작 워크플로 3개 이상을 다루고, “특화”는 한 가지 작업에 집중합니다. 카드 오른쪽 위 아이콘으로 의견을 보내 주세요. 자세한 기준은 등록 원칙을 참고하세요.

영상 생성

Runway

통합

Runway AI, Inc. · 공식 사이트 · 요금

Gen-4.5 창작 모델, 개발자 API, 상호작용형 GWM-1 월드 모델 연구를 제공하는 AI 영상 및 모델 플랫폼입니다.

  • 공식 사이트는 Gen-4.5의 움직임 품질, 프롬프트 준수와 시각적 충실도를 강조합니다. (2026-10-11 기준)
  • Runway는 GWM-1을 환경과 상호작용하고 시뮬레이션 워크플로를 개발하기 위한 범용 월드 모델로 설명합니다. (2026-10-11 기준)
  • Runway Dev는 2026년 8월 26일 WAN 3.0을 추가했습니다. 텍스트나 시작 프레임 이미지로 네이티브 오디오가 포함된 최대 30초 영상을 생성합니다. (2026-10-11 기준) [docs.dev.runwayml.com]

Google Veo

특화

Google DeepMind · 공식 사이트

Google DeepMind의 영상 생성 모델로, 현재 Veo 3.1이 제공됩니다. 대사, 효과음, 주변 소리를 포함한 네이티브 오디오와 함께 영화적인 영상을 생성합니다.

  • Veo 3.1은 효과음, 주변 소음, 대사 등 오디오를 직접 생성합니다.
  • 참조 이미지를 통한 캐릭터 일관성, 카메라 움직임 제어(줌, 팬, 달리), 장면 확장과 최대 1080p/4K 출력을 제공합니다.
  • Gemini 앱, Google Flow, Google AI Studio와 Google Vids에서 사용할 수 있습니다.

Flow

특화

Google Labs · 공식 사이트

Google Labs가 창작자를 위해 만든 AI 영화 제작 도구입니다. Veo 영상 모델로 영상과 이미지를 생성하며, 이용 가능한 지역은 제한됩니다.

  • Google은 Flow를 Veo 3.1을 이용할 수 있는 전용 AI 영화 제작 도구로 소개합니다. [deepmind.google]

Kling AI

특화

Kuaishou Technology · 공식 사이트

Kuaishou의 AI 영상 생성 플랫폼입니다. Kling 3.0은 멀티모달 입력, 최대 15초 영상과 다국어 네이티브 오디오를 지원합니다.

  • Kuaishou는 2026년 2월 5일 Kling 3.0 시리즈를 발표하며 최대 15초 영상 생성과 다국어 네이티브 오디오를 소개했습니다. 발표에서 2K 및 4K 출력은 Image 3.0 모델의 기능으로 설명했습니다. (2026-10-11 기준) [ir.kuaishou.com]
  • Kuaishou는 통합 멀티모달 영상 모델로 소개한 Kling O1도 발표했습니다. [ir.kuaishou.com]

Luma Dream Machine

통합

Luma AI · 공식 사이트

Ray 영상 모델을 중심으로 이미지, 영상, 오디오 생성을 무한 캔버스에 결합한 Luma의 AI 창작 공간입니다. 스토리보드 개발과 카메라 움직임을 포함한 이미지 기반 영상 생성을 제공합니다.

  • Luma의 Ray3 시리즈 영상 모델과 Uni-1 이미지 모델을 사용하며, Veo 3.1과 Kling 등 외부 모델도 제공합니다.

Pika

통합

Pika Labs · 공식 사이트

영상, 이미지, 오디오를 생성하는 AI 창작 플랫폼입니다. 동작 전이, 영상 확장, 이미지 편집, 음성 및 효과음 앱을 제공합니다.

  • 모델 목록에는 Pika 2.5와 다른 영상 모델이 있으며, 제품 메뉴에는 이미지와 오디오 워크플로도 있습니다. (2026-10-11 기준)
  • 영상 앱은 동작 전이와 영상 확장을, 이미지 및 오디오 앱은 편집, 음성, 효과음을 제공합니다. (2026-10-11 기준)

Hailuo AI

통합

MiniMax · 공식 사이트

MiniMax의 창작 플랫폼으로, 영상, 이미지, 오디오 제작 도구와 CineScope 같은 영화적 프리셋을 제공합니다.

  • 공식 인터페이스에는 영상, 이미지, 오디오 제작 도구가 있으며 영화적 프리셋에 CineScope가 포함됩니다. (2026-10-11 기준)

Wan

특화

Alibaba · 공식 사이트

Alibaba의 영상 생성 모델군 및 플랫폼입니다. 공개 Wan 모델 문서는 텍스트 기반 및 이미지 기반 영상 생성을 다룹니다.

  • 공식 Wan2.2 저장소에는 텍스트 기반, 이미지 기반, 텍스트·이미지 혼합 입력 영상 생성 모델이 설명되어 있습니다. (2026-10-11 기준) [github.com]

Higgsfield

통합

Higgsfield AI · 공식 사이트

이미지, 영상, 오디오, 영화적 연출과 시각 효과 워크플로를 제공하는 AI 창작 플랫폼입니다. API와 MCP 연동 진입점도 제공합니다.

  • 공식 사이트에는 이미지, 영상, 오디오 도구와 Cinema Studio, Effects, Ads Studio 작업 공간이 소개되어 있습니다. (2026-10-11 기준)
  • 제품 메뉴에서 API와 MCP 연동 진입점을 제공합니다. (2026-10-11 기준)

Katalist

특화

Katalist AI · 공식 사이트 · 요금

광고 및 퍼포먼스 팀을 위한 AI 영상 제작 플랫폼입니다. 시나리오나 기존 광고 소재로 새 영상과 제품, 캐릭터, 음성의 여러 버전을 만듭니다.

  • 공식 사이트는 기획안·시나리오 기반 영상 생성과 기존 광고 영상 내 제품 교체를 설명합니다. (2026-10-11 기준)
  • 캐릭터나 음성 교체, 립싱크 조정을 통한 기존 영상의 현지화도 설명합니다. (2026-10-11 기준)

Invideo

통합

Invideo · 공식 사이트 · 요금

시나리오 작성, 스토리보드, 영상 생성과 멀티트랙 타임라인 편집기를 제공하는 AI 영상 제작·편집 통합 도구입니다. 영화 제작과 다양한 영상 워크플로를 지원합니다.

  • 공식 사이트는 시나리오 작성, 숏별 스토리보드와 자연어 편집 지시로 제어할 수 있는 타임라인 편집기를 설명합니다. (2026-10-11 기준)
  • 영상 생성과 함께 이미지, 음성, 음악 도구를 제공합니다. 사용 가능한 모델과 기능은 선택한 요금제에 따라 달라집니다. (2026-10-11 기준)

MaxVideoAI

통합

MaxVideoAI · 공식 사이트 · 요금

영상, 이미지, 오디오 생성에 캐릭터 일관성, 카메라 각도 변경, 업스케일링과 배경 제거 도구를 결합한 종량제 창작 공간입니다.

  • 공식 메뉴는 영상, 이미지, 오디오 생성과 일관성, 카메라 각도, 업스케일링, 배경 제거 도구를 제공합니다. (2026-10-11 기준)
  • 요금 페이지에 따르면 구독 없이 사용하며 앱에서 정확한 생성 견적을 확인합니다. 예시 비용은 향후 생성 작업의 고정 가격이 아닙니다. (2026-10-11 기준)

스토리보드 및 프리비즈

LTX Studio

통합

Lightricks · 공식 사이트

시나리오를 장면 분석, 스토리보드와 영상 시퀀스로 바꾸는 웹 기반 AI 영화 제작 통합 도구입니다. 지속적으로 사용하는 캐릭터 프로필, 카메라 방향 제어와 타임라인 편집기를 제공합니다.

  • Lightricks가 2024년 2월 출시한 AI 영화 제작 스튜디오로, 시나리오를 영상으로 시각화합니다. [techcrunch.com]
  • 붙여 넣은 시나리오를 장면과 숏별 이미지로 나누는 AI 스토리보드 생성기가 포함됩니다. [ltx.io]

Boords

특화

Boords Ltd · 공식 사이트 · 요금

영상 및 애니메이션 팀을 위한 협업 스토리보드 플랫폼입니다. 프레임용 AI 이미지 생성, 오디오가 포함된 애니매틱과 고객 검토·승인 워크플로를 제공합니다.

  • 장면 설명으로 스토리보드 프레임의 여러 버전을 만드는 AI 이미지 생성 기능이 있습니다.
  • 스토리보드를 오디오가 포함된 애니매틱으로 바꾸고 버전, 댓글과 승인을 관리합니다.

DramaDirector

특화

Academic research team · 공식 사이트

기하 정보로 안내하는 단편 드라마 생성 연구 프레임워크입니다. 전체 줄거리와 개별 맥락을 바탕으로 근거를 갖춘 여러 숏의 영상 계획과 결과물을 만듭니다.

  • DramaDirector는 각 숏을 정적 시각 조건과 동적 서사 조건으로 분리합니다. 실제 단편 드라마 숏에서 깊이·포즈 참조를 검색하여 첫 프레임 생성과 이미지 기반 영상 합성을 안내합니다.
  • 논문은 실사 드라마 35편, 에피소드 2.8천 개, 숏 8.1만 개로 만든 DramaBoard 벤치마크를 소개합니다. 구조화된 스토리보드와 다차원 평가 절차를 포함합니다.

시나리오 및 사전 제작

Filmustage

특화

Filmustage · 공식 사이트 · 요금

시나리오의 배우, 소품, 장소, VFX, 의상을 자동으로 분석하고 촬영 일정과 예산을 만드는 AI 사전 제작 플랫폼입니다. AI Production Agent로 제작 위험도 파악합니다.

  • AI 시나리오 분석으로 배우, 소품, 장소, VFX, 의상을 태그하고 스트립보드, 일정과 예산 템플릿을 생성합니다.
  • AI Production Agent는 시나리오를 분석하여 제작 위험을 찾고 촬영 일정을 최적화합니다.

Sudowrite

특화

Sudowrite · 공식 사이트

소설가와 시나리오 작가를 위한 AI 집필 도우미입니다. 구성에서 초안까지 지원하는 Story Bible, 다시 쓰기·확장·묘사 도구와 시나리오 변환 등의 플러그인을 제공합니다.

  • Story Bible은 아이디어부터 구성, 챕터 기획과 초안 생성까지 작가 고유의 스타일로 작업하도록 안내합니다.

Celtx

통합

Celtx (Backlight) · 공식 사이트

업계 표준 시나리오 편집기, 비트 시트, 시나리오 분석, 장면 분석, 숏 리스트, 일정과 예산을 제공하는 시나리오 및 사전 제작 플랫폼입니다. 실시간 공동 집필도 지원합니다.

  • 여러 형식의 시나리오 편집기, 비트 시트·스토리보드·시나리오 분석 등 이야기 개발 도구와 장면별 분석을 제공합니다.

편집 및 후반 작업

Descript

특화

Descript · 공식 사이트 · 요금

전사문을 수정하면 영상도 바뀌는 텍스트 기반 영상 및 팟캐스트 편집기입니다. Underlord AI 공동 편집자, Studio Sound 오디오 정리, 군더더기 말 제거와 번역을 제공합니다.

  • 핵심은 텍스트 기반 편집으로, 전사문을 수정하면 영상이 자동으로 반영됩니다.
  • Underlord는 시나리오 작성·수정, 레이아웃과 전환 적용, 편집 요청 실행이 가능한 에이전트형 AI 공동 편집자입니다.

Adobe Premiere Pro

통합

Adobe · 공식 사이트

Firefly 기반 생성형 AI 기능을 제공하는 업계 표준 편집기입니다. Generative Extend는 4K 클립에 프레임과 룸톤을 추가하고, Media Intelligence는 의미 기반 영상 검색을 지원하며 자막은 자동 번역됩니다.

  • Adobe Firefly 기반 Generative Extend는 4K 클립을 확장하고(영상 약 2초, 오디오 최대 10초) Content Credentials를 표시합니다. [helpx.adobe.com]
  • 2025년 4월 버전에서 Generative Extend 정식 제공, Media Intelligence 의미 기반 검색과 자동 자막 번역이 추가되었습니다. [news.adobe.com]

DaVinci Resolve

통합

Blackmagic Design · 공식 사이트 · 요금

편집, 색보정, VFX와 오디오 후반 작업을 결합한 통합 도구입니다. DaVinci Neural Engine이 Magic Mask, Voice Isolation, 얼굴 인식, 스마트 리프레이밍과 IntelliSearch 같은 AI 기능을 제공합니다.

  • DaVinci Resolve 21에는 Magic Mask, Voice Isolation, 얼굴 인식, 스마트 리프레이밍, IntelliSearch와 CineFocus 등 Neural Engine AI 도구가 포함됩니다.
  • 무료 버전이 있으며, DaVinci Resolve Studio(일회성 295달러)는 Neural Engine과 고급 기능을 추가합니다.

CapCut

통합

ByteDance · 공식 사이트

무료 이용과 유료 기능을 제공하는 온라인 및 데스크톱 영상 편집기입니다. AI 자막, 배경 제거, 텍스트 음성 변환, 노이즈 감소와 영상 생성 기능이 있습니다.

  • 다국어 AI 자동 자막, 영상·이미지 배경 제거, 텍스트 음성 변환과 AI 영상 생성기를 제공합니다.

Clipzi

특화

Clipzi · 공식 사이트 · 요금

긴 영상을 짧은 세로 영상으로 바꾸는 AI 보조 클립 제작 도구입니다. 주요 순간 감지, 리프레이밍, 자막과 최종 편집본 검토용 시각 편집기를 제공합니다.

  • 공식 사이트는 AI 주요 순간 감지, 조정 가능한 세로 리프레이밍, 정밀 트리밍과 스타일 자막을 포함한 자동 전사를 설명합니다. (2026-10-11 기준)
  • 현재 무료 요금제로 처리할 수 있는 긴 영상은 매달 2개가 아니라 총 2개입니다. 신용카드 없이 시작할 수 있으며 월간 유료 요금제가 있습니다. (2026-10-11 기준)

VidiRelay

특화

VidiRelay · 공식 사이트 · 요금

영상 자료 조사, 인터뷰 검토와 자막 준비를 위한 영상·오디오 전사 공간입니다. 수정 가능한 타임스탬프 전사문과 문서 또는 자막 내보내기를 제공합니다.

  • 지원되는 공개 영상 링크와 업로드한 미디어를 처리하며, 타임스탬프 전사문을 편집하고 TXT, SRT, VTT, CSV, JSON, DOCX로 내보낼 수 있습니다. 비공개 또는 로컬 네트워크 링크는 허용하지 않습니다. (2026-10-11 기준)
  • 요금 페이지는 필수 구독 없이 전사 크레딧을 종량제로 이용한다고 설명합니다. 편집과 내보내기에는 추가 크레딧을 사용하지 않습니다. (2026-10-11 기준)

음성, 더빙 및 음악

ElevenLabs

통합

ElevenLabs · 공식 사이트

텍스트 음성 변환, 음성 복제, 더빙, 효과음과 음악 생성을 제공하는 AI 오디오 플랫폼입니다. 음성 전사와 개발자 API도 제공합니다.

  • ElevenCreative는 음성, 음악, 효과음, 음성 복제, 더빙과 영상 관련 창작 워크플로를 다룹니다. (2026-10-11 기준)
  • 음성 전사는 화자 구분과 타임스탬프를 지원하며, 음성과 음악용 API도 제공합니다. (2026-10-11 기준)

Respeecher

특화

Respeecher · 공식 사이트

영화와 TV 제작에 쓰이는 기업용 음성 복제 및 합성 서비스입니다. 엔지니어가 감독하는 맞춤 음성 복제, 실시간 TTS API와 AI 음성 마켓플레이스를 제공합니다.

  • The Mandalorian에서 젊은 Luke Skywalker의 음성을 재현했으며, The Brutalist에서 Adrien Brody와 Felicity Jones의 억양 보정에 사용되었습니다.
  • Emilia Pérez의 노래 보정과 Cyberpunk 2077: Phantom Liberty의 사망한 배우 음성 보존에도 사용되었습니다.

Suno

특화

Suno · 공식 사이트

텍스트 프롬프트로 보컬, 가사와 전체 프로덕션을 포함한 완성된 창작곡을 만드는 AI 음악 플랫폼입니다. 스템 분리, 오디오 업로드와 웹 기반 편집 작업 공간을 제공합니다.

  • 하나의 텍스트 프롬프트로 다양한 장르의 완성된 창작곡을 생성합니다. 상업적 이용 권한은 유료 요금제에 포함됩니다.

AIVA

특화

AIVA Technologies · 공식 사이트

250개 이상의 스타일로 창작곡을 생성하는 AI 작곡 도우미입니다. MIDI·오디오 참조 업로드와 맞춤 스타일 모델을 지원하며, 저작권 전체 소유까지 가능한 라이선스 등급을 제공합니다.

  • 250개 이상의 스타일로 음악을 생성하고 편집과 여러 형식의 내보내기를 지원합니다. MIDI 워크플로도 포함됩니다.
  • AIVA는 Pro 요금제에서 생성된 곡의 저작권을 소유할 수 있다고 안내합니다. 상업적 이용에는 현행 요금제와 라이선스 조건이 적용됩니다. (2026-10-11 기준)

콘셉트 아트 및 비주얼 개발

Midjourney

특화

Midjourney, Inc. · 공식 사이트

콘셉트 아트와 비주얼 개발을 위한 이미지 생성·편집 서비스입니다. 공식 문서상 기본 버전은 V8.2이며 개인화와 Edit Model을 제공합니다. 참조 기능은 선택한 버전에 따라 다릅니다.

  • V8.2는 2026년 7월 24일 Midjourney의 기본 버전이 되었습니다. 이 버전의 Edit Model은 Omni Reference, Character Reference와 Retexture 워크플로를 대체합니다. (2026-10-11 기준) [docs.midjourney.com]
  • 공식 버전 문서에 따르면 V7은 2025년 4월 3일 출시되어 Draft Mode와 Omni Reference를 도입했습니다. (2026-10-11 기준)

Krea

통합

Krea AI · 공식 사이트

콘셉트와 비주얼 개발을 위한 AI 통합 도구입니다. 실시간 이미지 생성, 연동 모델을 통한 영상 생성, 텍스트·이미지 기반 3D 오브젝트 생성, 업스케일링과 맞춤 스타일용 LoRA 미세 조정을 제공합니다.

  • 실시간 렌더링으로 단순한 도형을 사실적인 이미지로 바꾸며, 사용자 자료 기반 LoRA 미세 조정을 지원합니다.
  • Veo 3, Kling과 Runway 등 외부 영상 모델을 연동합니다.
  • 텍스트 및 이미지 기반 3D 오브젝트 생성 워크플로를 제공합니다.

기록 항목

Sora (discontinued)

특화

OpenAI · 공식 사이트

삭제 대기 중이며 참고용으로 보존합니다. 2026-10-11에 기록 항목으로 옮겼습니다.

서비스 종료된 기록 항목입니다. OpenAI의 Sora 2는 텍스트나 이미지로 영상과 오디오를 생성하던 모델입니다. Sora 2 모델과 Videos API는 2026년 9월 24일 종료되어 더 이상 이용할 수 없습니다. OpenAI는 일대일로 대체하는 API가 없다고 안내합니다.

  • OpenAI는 2026년 9월 24일 Sora 2 모델과 Videos API를 종료했습니다. 일대일로 대체하는 API는 없다고 안내합니다. (2026-09-25 기준) [developers.openai.com]
  • 종료 전 Sora 2는 자연어 또는 이미지 입력으로 풍부한 세부 묘사와 동기화된 오디오를 갖춘 영상을 생성했습니다. 세로 720x1280 및 가로 1280x720 출력을 지원했습니다. (2026-09-25 기준)