AI 모션그래픽 만들기, 편집 툴 없이 말로만 시키면 어디까지 될까?
말로만 시켜서 나온 영상 세 편부터 보세요. 「느낌 좋게」 대신 무엇을 말해야 원하는 화면이 나오는지도 정리했습니다.
영상 편집을 한 번도 안 배웠어도, 말만으로 이런 영상이 나올까요?
제 답은 「말로 고쳐 가며 만들 수 있다」입니다. 위 영상은 AI에게 말로 시키고, 보고, 고치기를 거듭해서 나온 결과입니다. 한 문장으로 바로 나온 게 아닙니다.
그래서 이 글에는 제가 AI에게 실제로 보낸 문장을 그대로 실었습니다. 어떤 말이 어떤 화면이 됐는지 보고 나면, 「느낌 좋게」 대신 무엇을 말해야 하는지도 보입니다.
이 정도까지 나옵니다
세 편 모두 예시로 지은 가상 가게, 가상 서비스입니다. 화면에도 예시라고 적었습니다.
맨 위 영상은 지도 원테이크입니다. 생일 케이크 주문 하나가 예약, 새벽 제작, 배달, 후기를 거쳐 미니어처 동네를 지나갑니다. 왼쪽 위 시계가 그 주문이 겪은 시각을 셉니다.
두 번째는 학원 관리 서비스의 새 기능을 소개하는 제품 화면 원테이크입니다. 카메라가 누를 곳으로 다가가고, 커서가 누를 때마다 화면이 바뀝니다. 컷 없이 한 번에 이어집니다.
세 번째는 모바일 청첩장 템플릿 다섯 종을 소개하는 출시 필름입니다. 템플릿 판 위를 카메라가 흐르다 한 장으로 들어가고, 같은 내용이 다섯 디자인으로 박자에 맞춰 바뀝니다.
그림이 아니라 코드라서 가능한 일
드라마나 애니메이션처럼 AI가 사람과 장면을 그려 내는 영상은 이 글에서 다루지 않습니다.
| 생성 영상 | 코드로 찍는 모션그래픽 | |
|---|---|---|
| AI가 하는 일 | 사람과 장면을 직접 그려 낸다 | 글자·숫자·화면이 움직이는 코드를 쓴다 |
| 이런 영상 | 드라마, 애니메이션 | 설명 영상, 제품 소개, 릴스 |
위 영상들은 전부 오른쪽입니다. AI가 HTML과 CSS로 화면을 짜고, HyperFrames라는 도구가 그 화면을 영상으로 찍습니다. HeyGen이 공개한 오픈소스(Apache 2.0)이고, 웹 페이지의 시간을 한 프레임씩 옮겨 찍는 스톱모션 방식입니다.
영상이 코드이니 고칠 때도 말로 하면 됩니다. 마음에 안 드는 곳을 말하면 AI가 그 부분의 코드를 고치고 다시 찍습니다.
실제로 보낸 문장, 그리고 바뀐 화면
아래는 제 첫 릴스입니다. 블로그 첫 글 LLM이란?을 풀어 만들었습니다. 화면 속 채팅은 연출한 예시 화면입니다.
이 영상을 다듬으며 Claude Code에 보낸 메시지 중 넷을 맞춤법까지 그대로 옮깁니다.
「책 넘기는 느낌이면 좋겠어」
너무 지금 내용이 허술하고 배경도 너무 연관성이 없는 카드뉴스 그냥 읽어주는 느낌이야. 3d에셋이라던지 , 잘 써야할거같고 장면 넘어가는 게 책 넘기는 느낌이면 좋겠어. 스윽 스윽 소리 별로야.
장면 전환이 책장 넘기기로 바뀌고, 「스윽」 효과음은 빠졌습니다.
「다 알 내용인데 엉뚱한 답이 나오는걸로」
그리고 지금 썸네일이랑 나오는 질문의 예시들을 조금 더 사람들이 다 알 내용인데 엉뚱한 답이 나오는걸로 공감을 이끌어내야할 거 같아.
이 메시지 바로 뒤에 나온 질문이 「세종대왕 맥북프로 던짐 사건 알려 줘」입니다. 누구나 말이 안 되는 걸 아는 질문에 AI가 진지하게 답을 지어내는 장면을 재연했습니다.

「독이될수도 득이될수도」
중간에 AI모델들이 성능이 좋아져서 더 잘 속을수도 있으니 중요한 내용은 확인해야한다는 거 중간에 넣자 astra나 opus5.5라던지 최신 모델 이름 툭툭 넣으면서. AI는 만능이 아니고 어떻게 활용하는 지에 따라 독이될수도 득이될수도 있다 이런걸로 영상 넣어줘.
메시지 하나가 장면 두 개가 됐습니다. 「똑똑할수록 더 감쪽같다」와 「AI는 만능이 아니다」입니다.

「핵심 키워드를 쓰고 부제로 훅킹있게」
AI가 지어낸 역사, 이렇게 나오니까 너무 별로다. 핵심 키워드를 쓰고 부제로 훅킹있게 넣던지. 시스템도 개선해줘.
커버가 「AI가 지어낸 역사」에서 「할루시네이션」 키워드와 질문 부제로 바뀌었습니다. 바뀐 건 커버 한 줄이고, 나머지 장면은 그대로 두고 다시 찍었습니다.

「시스템도 개선해줘」를 덧붙인 덕에 이 수정은 다음 릴스부터 쓰는 커버 규칙이 됐습니다. 지금은 렌더 전에 도구가 그 규칙부터 검사합니다.
「느낌 좋게」 말고, 이렇게 시킵니다
「별로야」처럼 막연하게 말한 곳은 여러 번 다시 시켜야 했습니다. 바로 화면이 된 부분에는 공통점이 있습니다.
| 이렇게 말했다 | 무엇을 말한 것인가 |
|---|---|
| 「카드뉴스 그냥 읽어주는 느낌」 | 싫은 것을 누구나 아는 이름에 빗댔다 |
| 「책 넘기는 느낌」, 「스윽 스윽 소리 별로야」 | 원하는 것과 싫은 것을 손에 잡히는 물건과 소리로 말했다 |
| 「다 알 내용인데 엉뚱한 답이 나오는걸로 공감」 | 화면이 아니라 보는 사람의 반응을 목표로 줬다 |
| 「독이될수도 득이될수도」 | 넣을 메시지를 문장 그대로 줬다 |
| 「시스템도 개선해줘」 | 한 번 고친 것을 다음에도 지키는 규칙으로 남기게 했다 |
움직임의 이름을 알면 원하는 걸 한 단어로 짚을 수 있습니다. 「자연스럽게 나오게」 대신 「스태거로 차례로」, 「강조해 줘」 대신 「푸시 인으로 천천히 다가가게」.
| 묶음 | 이름 | 이럴 때 |
|---|---|---|
| 움직임 | 이징, 예비동작, 팔로스루, 아크, 오버랩, 모션 블러 | 사람 손으로 움직인 듯 자연스럽게 |
| 등장 | 스태거, 마스크 리빌, 키네틱 타이포, 카운트업, 비트 싱크 | 목록은 차례로, 숫자는 굴러 올라가게, 카피는 박자에 |
| 카메라 | 푸시 인, 패럴랙스, 홀드 | 시선을 모으고, 깊이를 주고, 읽을 시간을 줄 때 |
| 장면 잇기 | 매치컷, 줌스루, 휩팬, 루프 | 컷 대신 닮은 모양이나 카메라 움직임으로 이을 때 |
둘을 섞으면 이런 문장이 됩니다. 제가 정리한 예시이고, 이 문장으로 찍어 보지는 않았습니다.
카페 여름 신메뉴 소개 릴스. 세로, 15초, 나레이션 없이 배경음만.
보는 사람이 "이거 마시러 가야겠다"고 저장하게 만드는 게 목표.
첫 장면부터 바로 움직이게. 신메뉴 컵은 푸시 인으로 천천히 다가가고,
토핑 세 개는 스태거로 차례로. 장면은 컷 대신 매치컷: 동그란 컵 뚜껑이 다음 장면의 해로.
보라·파랑 그라디언트, 모든 요소 가운데 정렬은 쓰지 말 것.
인스타 버튼이 덮는 오른쪽 가장자리에는 글자를 두지 말 것. 이 규칙은 다음 영상에도 지켜.
만드는 법: 설치부터 첫 영상까지
1. 준비물
| 쓰는 것 | |
|---|---|
| 코드를 쓰는 AI | Claude Code 같은 코딩 에이전트 |
| 코드를 영상으로 | HyperFrames (Node.js 22 이상, FFmpeg 필요) |
| 3D가 필요하면 | Blender (무료) |
터미널과 설치가 부담스럽다면 아직 이 방법이 맞지 않을 수 있습니다. 렌더는 내 컴퓨터에서 돌아가서 따로 돈이 들지 않습니다. 비용이 드는 건 코딩 에이전트, 그리고 따로 붙이는 음성이나 생성 서비스입니다.
2. 에이전트에 붙이기
Claude Code라면 두 줄입니다.
claude plugin marketplace add heygen-com/hyperframes
claude plugin install hyperframes@hyperframes
다른 에이전트라면 작업할 폴더에서 아래 명령을 실행하고, 고르는 화면에서 「Core Skills」를 고른 뒤 에이전트를 다시 엽니다.
npx skills add heygen-com/hyperframes
3. 첫 요청
거창한 기획서는 필요 없습니다. 공식 시작 안내의 첫 예시도 한 줄입니다.
Using /hyperframes, make a 10-second product intro for https://example.com.
주소 자리에 보여 주고 싶은 페이지를 넣습니다. 에이전트가 방향을 제안하고, 빠진 게 있으면 되묻습니다. Claude Code 플러그인이라면 /hyperframes:hyperframes로 부릅니다.
4. 보고, 말로 고치기
첫 결과가 나오면 브라우저 미리보기가 열립니다. 나중에 다시 보려면 프로젝트 폴더에서 이렇게 엽니다.
npx hyperframes preview
이제 말로 고칩니다. 앞에서 본 것처럼 싫은 것, 원하는 것, 보는 사람의 반응을 말로 주고 다시 뽑게 합니다. 공식 안내의 예시는 「제목을 키우고 한 번 더 렌더해 줘」 정도입니다.
5. 렌더
npx hyperframes render --output video.mp4
한 번으로 끝내지 않으려면: 시스템
영상 하나는 말로 금방 나옵니다. 두 번째, 열 번째에도 같은 퀄리티가 나오게 하려면 몇 가지를 고정해 둬야 합니다. 제가 쓰는 방식입니다.
| 고정하는 것 | 어떻게 | 왜 |
|---|---|---|
| 틀 | 색, 서체, 커버 모양을 파일 하나에 두고 영상마다 내용만 바꾼다 | 피드에서 한 채널로 보인다 |
| 규칙 | 퇴짜 놓은 것은 문서에 적어 AI가 매번 읽게 한다 | 같은 지적을 두 번 하지 않는다 |
| 검사 | 렌더 전에 글자가 화면 밖으로 나가거나 겹치는지, 커버 규칙을 지켰는지 도구가 먼저 본다 | 눈으로 놓치는 것을 기계가 잡는다 |
| 이름 | 자주 쓰는 움직임에 이름을 붙이고 부품으로 만든다 | 한 단어로 시킬 수 있다 |
| 버전 | 도구 버전을 고정하고, 무작위 값과 현재 시각은 쓰지 않는다 | 다시 렌더해도 같은 영상이 나온다 |
만들 때 유의할 점
- 첫 결과는 초안입니다. 공식 안내도 첫 버전은 최종본이 아니라고 적습니다. 이야기, 사실, 글자가 읽히는지, 소리를 한 번은 직접 확인합니다.
- 숫자와 사실은 직접 확인합니다. AI는 그럴듯한 수치를 지어낼 수 있습니다. 화면에 들어가는 숫자는 출처를 대조합니다.
- 실제 상호, 로고, 사람은 쓰지 않습니다. 예시라면 가상 가게, 가상 제품으로 만들고 화면에 「예시」라고 적습니다.
- 음악과 서체는 라이선스를 봅니다. 출처 표기가 필요한 곡(CC BY)은 설명란에 출처를 붙이고, 표기가 필요 없는 곡(CC0)도 받은 곳을 기록해 둡니다.
- 인스타 버튼과 캡션이 덮는 자리는 비웁니다. 오른쪽 가장자리와 아래쪽에 핵심 글자를 두지 않습니다.
- 렌더 뒤에는 눈으로 봅니다. 검사를 통과해도 겹침, 빈 화면, 멈춘 구간은 화면에서만 보입니다. 프레임을 바둑판처럼 모아 한 장으로 보면 빠릅니다.
ffmpeg -i video.mp4 -vf "fps=1,scale=270:-1,tile=6x2" -frames:v 1 sheet.png
그래서 남는 건 아이디어입니다
프롬프트를 더 깎고, 영상 기법과 도구를 더 잘 조합하면 퀄리티는 지금보다 훨씬 올라갈 것 같습니다.
그리고 솔직히 무섭기도 하고 놀랍기도 합니다. 몇 줄로 시키기만 해도, 예전에 비해 이런 영상이 정말 쉽고 빠르게 나옵니다.
하지만 실제 상업적으로 나오는 영상들과 나란히 놓으면, 퀄리티가 많이 떨어지는 건 사실입니다.
영상은 예전보다 훨씬 많이 쏟아질 겁니다. 만드는 게 쉬워질수록 그 속에서 눈에 띄는 건 결국 무엇을 말할지(아이디어), 무엇을 담을지(콘텐츠), 어떻게 보여 줄지(표현)입니다. 도구는 누구나 쓸 수 있게 됐고, 이제 그 세 가지가 더 중요해지는 시대인 것 같습니다.
출처
- HyperFrames GitHub (heygen-com/hyperframes) README, LICENSE (2026년 10월 8일 확인)
- HyperFrames Quickstart (2026년 10월 8일 확인)
#AI모션그래픽#HyperFrames#하이퍼프레임#ClaudeCode#릴스#프롬프트
함께 읽기
AILLM이란? 챗GPT는 어떻게 답을 만들까
챗GPT는 정답을 찾아서 답하는 게 아니라, 다음에 올 말을 예측해서 이어 씁니다. 이 원리부터 알면 할루시네이션, 프롬프트, 검색 기능까지 한결 쉬워집니다.