Step-by-step workflow

AI 숏폼 영상 제작 워크플로우

완성 영상을 한 도구에 맡기지 않고 대본, 장면, 음성, 편집으로 나누면 실패한 단계만 고칠 수 있습니다.

예상 시간
40~90분
난이도
보통
비용
낮음~보통
단계
4단계

마지막 확인일: 2026년 8월 23일 · 실제 기능과 가격은 각 공식 사이트를 확인하세요.

Follow these steps

단계별로 따라 하기

  1. 1CH

    STEP 1

    ChatGPT

    첫 3초 훅과 컷별 메시지를 빠르게 설계합니다.

    입력값
    주제, 시청자, 영상 길이, CTA
    출력값
    시간 구간별 대본과 장면 목록
    다음으로 넘길 것
    장면마다 주체·행동·구도를 한 줄로 정리해 영상 도구로 넘깁니다.
    [주제]를 [시청자]에게 설명하는 30초 쇼츠를 5개 컷으로 나누고 대사, 자막, 화면 행동을 표로 작성해줘.
    ChatGPT 상세 보기 →
  2. 2Kling / Runway 로고

    STEP 2

    Kling / Runway

    대본의 핵심 장면을 짧은 영상 컷으로 만듭니다.

    입력값
    컷 설명, 참조 이미지, 유지 요소
    출력값
    3~5초 영상 클립
    다음으로 넘길 것
    성공한 클립만 내려받아 파일명에 컷 번호를 붙입니다.
    9:16. [주체]가 [단순 행동]을 한다. [카메라] 한 가지, [유지 요소]가 처음부터 끝까지 유지되고 화면은 글자 없이 깨끗하다.
    Kling / Runway 상세 보기 →
  3. 3ElevenLabs (내레이션이 필요할 때) 로고

    STEP 3

    ElevenLabs (내레이션이 필요할 때)

    음성이 필요한 영상은 대본 확정 뒤 내레이션을 별도로 제작해 수정 비용을 줄입니다.

    입력값
    최종 대사, 언어, 톤과 속도
    출력값
    컷 길이에 맞는 음성 파일
    다음으로 넘길 것
    음성 파일과 대본을 편집 타임라인에 함께 넣습니다.
    [대사]를 [톤]으로 자연스럽고 또렷하게 읽는다. 문장 사이 호흡은 짧게 유지한다.
    ElevenLabs (내레이션이 필요할 때) 상세 보기 →
  4. 4편집 도구 로고

    STEP 4

    편집 도구

    클립, 정확한 자막, 로고와 음성을 최종 조합합니다.

    입력값
    영상 클립, 음성, 자막, 브랜드 자산
    출력값
    게시 가능한 세로 영상
    다음으로 넘길 것
    업로드 전 소리 없이도 이해되는지와 안전 영역을 확인합니다.
    AI 생성보다 컷 길이, 자막 대비, CTA 타이밍을 사람이 최종 검수합니다.
    편집 도구 상세 보기 →

비용과 재작업을 줄이는 지점

  • 대본과 스토리보드를 확정한 뒤 영상 크레딧을 사용하세요.
  • 모든 컷을 한 번에 만들지 말고 첫 컷의 스타일을 먼저 확정하세요.
  • 영상은 3~5초 초안으로 시험하고 성공한 컷만 고품질로 출력하세요.
  • 자막과 로고는 영상 생성이 아니라 편집 단계에서 넣으세요.

도구별 사용법 더 보기