GPT로 영상 제작, 지금은 어떻게 해야 할까?
──────────────────
“ChatGPT에 글만 입력하면 동영상까지 바로 만들어 주나요?”
AI 영상에 관심이 있다면 한 번쯤 궁금해질 만한 부분입니다.
결론부터 말하면, GPT는 영상 제작 과정에서 상당히 많은 일을 할 수 있지만 ‘ChatGPT에서 Sora를 이용해 바로 영상을 만든다’는 과거 방식은 현재 기준으로 그대로 적용되지 않습니다.
OpenAI는 Sora 웹과 앱 서비스를 2026년 4월 26일 종료했습니다. Sora API 역시 2026년 9월 24일 종료될 예정입니다. 따라서 예전에 작성된 ‘ChatGPT Plus로 Sora 영상을 만드는 방법’ 같은 글을 볼 때는 작성 날짜를 확인할 필요가 있습니다.
그렇다면 GPT는 영상 제작에 쓸모가 없어진 걸까요?
그렇지는 않습니다.
오히려 영상의 아이디어 → 대본 → 장면 분할 → 이미지 제작 → 영상 생성용 프롬프트 → 자막과 제목으로 이어지는 제작 과정을 GPT로 설계하는 방식이 실용적입니다.
──────────────────
【 1. GPT에게 영상 아이디어 만들기 】
가장 먼저 할 수 있는 것은 영상 기획입니다.
예를 들어 단순히
“고양이 영상 아이디어 알려줘”
라고 하는 것보다,
“유튜브 쇼츠용 30초 영상입니다. 직장인이 퇴근했는데 고양이가 현관에서 기다리고 있는 내용으로 처음 3초에 시선을 끌 수 있는 스토리를 만들어줘.”
처럼 영상 플랫폼, 길이, 소재, 분위기를 같이 알려주는 편이 좋습니다.
GPT는 이를 바탕으로 영상의 시작과 전개, 마지막 장면까지 구성하는 데 활용할 수 있습니다.
──────────────────
【 2. 영상 대본도 만들 수 있습니다 】
정보형 영상이라면 GPT 활용 범위가 더 넓어집니다.
예를 들어
“스마트폰 배터리를 오래 사용하는 방법을 설명하는 60초짜리 영상 대본을 작성해줘. 내레이션과 화면에 보여줄 내용을 구분해줘.”
라고 요청할 수 있습니다.
그러면 단순한 글이 아니라
장면 1
내레이션
화면 구성
장면 2
내레이션
화면 구성
과 같은 방식으로 제작용 대본을 구성할 수 있습니다.
특히 쇼츠나 릴스처럼 영상 시간이 짧다면 먼저 영상 길이를 정한 뒤 대본을 요청하는 것이 중요합니다.
──────────────────
【 3. 긴 대본을 장면별로 나누기 】
AI 영상 제작에서 생각보다 중요한 것이 장면 분할입니다.
예를 들어 30초짜리 영상을 한 번에 만들려고 하기보다 필요한 장면을 먼저 나눌 수 있습니다.
장면 1
비 오는 저녁, 퇴근하는 직장인
장면 2
아파트 현관문을 여는 모습
장면 3
문 앞에서 기다리던 고양이
장면 4
고양이를 안아주는 모습
이런 식입니다.
GPT에게
“이 이야기를 AI 영상으로 만들기 좋게 5개 장면으로 나누고 각 장면의 인물, 배경, 행동, 카메라 구도를 설명해줘.”
라고 요청하면 영상 제작용 콘티의 초안을 만들 수 있습니다.
──────────────────
【 4. AI 영상 생성기에 넣을 프롬프트 만들기 】
GPT가 특히 편리한 부분 중 하나입니다.
AI 영상 생성 서비스에서는 단순히
“바닷가를 걷는 남자”
라고 입력하는 것보다 피사체와 행동, 장소, 카메라 움직임, 조명, 분위기 등을 구체적으로 정리하는 것이 영상의 방향을 전달하기 쉽습니다.
예를 들어 GPT에게 다음과 같이 요청할 수 있습니다.
“AI 영상 생성기에 사용할 프롬프트를 만들어줘. 해 질 무렵 제주도 해변을 혼자 걷는 30대 남성이 등장하고 카메라는 뒤에서 천천히 따라간다. 따뜻하고 영화 같은 분위기로 만들어줘.”
여기서 중요한 점은 GPT가 영상을 직접 렌더링하는 역할과 영상 생성기에 전달할 지시문을 설계하는 역할을 구분하는 것입니다.
사용하는 영상 생성 서비스에 맞춰 프롬프트를 다시 정리해 달라고 요청할 수도 있습니다.
──────────────────
【 5. 이미지부터 만든 뒤 영상화하는 방법 】
영상마다 동일한 인물이나 캐릭터가 등장해야 한다면 처음부터 영상만 생성하는 것보다 기준이 되는 이미지와 캐릭터 설정을 먼저 만드는 방식도 생각해볼 수 있습니다.
예를 들어 GPT를 활용해
캐릭터의 나이
헤어스타일
의상
색상
배경
조명
카메라 구도
등을 먼저 정리합니다.
그다음 기준 이미지를 만들고, 이미지 입력을 지원하는 영상 생성 도구에서 움직임을 추가하는 방식입니다.
과거 Sora 역시 텍스트뿐 아니라 정지 이미지를 바탕으로 영상의 움직임을 생성하는 기능을 제공했습니다.
──────────────────
【 6. GPT 하나로 완성 영상까지 자동으로 만들어지는 것은 아닙니다 】
여기서 가장 많이 혼동할 수 있는 부분입니다.
과거에는 OpenAI가 Sora와 Sora 2를 통해 텍스트 및 이미지 기반 동영상 생성 기능을 제공했습니다. Sora 2는 영상뿐 아니라 동기화된 대화와 음향 효과 생성도 지원했습니다.
하지만 현재는 Sora 웹·앱 서비스가 종료된 상태입니다.
따라서 현재 GPT 영상 제작을 알아본다면 예전의 Sora 사용 화면이나 요금제를 기준으로 따라 하기보다는,
GPT에서 영상 기획·대본·콘티·프롬프트 작성 → 현재 이용 가능한 영상 생성 도구에서 실제 영상 생성 → 편집 도구에서 자막·음악·장면 연결
과 같이 전체 제작 과정을 나누어 생각하는 편이 정확합니다.
──────────────────
【 GPT로 영상 만들 때 사용할 수 있는 요청 예시 】
처음 시작한다면 아래처럼 한 번에 요청해도 됩니다.
“30초짜리 세로형 AI 영상을 만들려고 합니다. 주제는 미래의 서울입니다. 전체 스토리를 만든 뒤 5개 장면으로 나누고, 각 장면마다 등장인물·배경·행동·카메라 움직임·조명·분위기를 정리해주세요. 마지막에는 각 장면을 AI 영상 생성기에 입력할 수 있는 프롬프트로 만들어주세요.”
이렇게 하면 GPT가 단순히 대본만 작성하는 것이 아니라 영상 제작을 위한 설계도 역할을 하는 결과물을 만들 수 있습니다.
──────────────────
【 영상 프롬프트에는 무엇을 넣어야 할까? 】
영상 생성용 프롬프트를 만들 때는 최소한 다음 내용을 구체적으로 정해두면 편리합니다.
무엇이 등장하는가
사람, 동물, 자동차, 건물 등
무엇을 하는가
걷는다, 달린다, 뒤돌아본다 등
어디인가
거리, 카페, 바닷가, 우주 등
카메라는 어떻게 움직이는가
고정, 천천히 따라가기, 줌인 등
어떤 분위기인가
밝음, 어두움, 따뜻함, 긴장감 등
영상 비율은 무엇인가
유튜브 일반 영상인지 세로형 쇼츠·릴스용인지 등
복잡한 프롬프트를 처음부터 직접 작성하기 어렵다면 원하는 장면을 평범한 문장으로 설명한 뒤 “이 내용을 AI 영상 생성용 프롬프트로 구체화해줘”라고 GPT에 요청하는 방법도 있습니다.
──────────────────
【 오래된 Sora 사용법은 날짜를 확인하세요 】
AI 서비스는 기능 변화가 빠르기 때문에 영상 제작 관련 글은 특히 작성 시점을 확인해야 합니다.
OpenAI의 Sora 웹·앱은 2026년 4월 26일 종료됐으며, Sora API 역시 2026년 9월 24일 종료 예정입니다.
따라서 현재 검색되는 과거 Sora 사용법이나 당시의 ChatGPT 요금제별 영상 생성 조건은 현재 이용 방법으로 받아들이지 않는 것이 좋습니다.
──────────────────
GPT 영상 제작의 핵심은 ‘버튼 한 번으로 완성 영상 만들기’보다 영상 제작에 필요한 여러 단계를 빠르게 설계하는 것에 있습니다.
아이디어가 없을 때는 영상 주제를 만들고, 아이디어가 있다면 대본을 작성하고, 대본이 있다면 장면별 콘티로 나누고, 다시 각 장면을 AI 영상 생성용 프롬프트로 바꿀 수 있습니다.
즉 현재 GPT를 영상 제작에 활용한다면
아이디어 → 스토리 → 대본 → 장면 분할 → 이미지·영상 프롬프트 → 실제 영상 생성 → 편집
이라는 흐름으로 접근하면 이해하기 쉽습니다.
특히 AI 영상 서비스를 처음 이용한다면 영상 생성 버튼부터 찾기보다는 GPT로 먼저 장면을 구체적으로 설계해 보는 것부터 시작해보는 것이 좋겠습니다.