Veo
자연어 프롬프트나 참조 이미지를 바탕으로 영화 같은 영상 클립을 만듭니다. 카메라 움직임, 장면 분위기, 인물 동작과 시청각 연출을 구체적으로 지시할 수 있습니다.
영상 프롬프트는 Google Flow용 상세 한글 프롬프트와 CapCut용 쇼폼 제작 한글 프롬프트 두 종류로 제공합니다. Google Flow는 짧은 생성 장면 제작, CapCut은 스크립트 기반 영상 구성·자동 자막·AI 음성·편집·출력을 한 작업 흐름으로 연결하는 용도입니다.
강의에서는 8초 세로형 장면을 기준으로 실습합니다. 이미지, 동영상, 음성, 캐릭터, 아바타를 함께 추가해 생성할 수 있습니다.
AI Video Maker와 Script to Video를 활용해 텍스트·스크립트에서 영상 구성을 만들고, 자동 자막·AI 음성·효과·편집·출력을 연결할 수 있습니다.
Google Flow는 텍스트나 이미지 프롬프트를 바탕으로 영화 같은 영상 클립과 장면을 만드는 AI 크리에이티브 스튜디오입니다. Google 공식 설명에 따르면 Flow는 Veo·Imagen·Gemini를 중심으로 설계되어, 아이디어 정리, 이미지 재료 제작, 영상 생성, 장면 연결과 일관성 관리까지 한 작업 공간에서 진행할 수 있습니다.
복잡한 영상 제작 과정을 여러 도구로 나누지 않고, 인물·장소·소품·스타일을 장면의 재료로 관리할 수 있다는 점이 Flow를 사용하는 가장 큰 이유입니다. 지원되는 Veo 모델에서는 영상에 맞는 대사, 효과음과 환경음 등 동기화된 오디오도 생성할 수 있습니다.
자연어 프롬프트나 참조 이미지를 바탕으로 영화 같은 영상 클립을 만듭니다. 카메라 움직임, 장면 분위기, 인물 동작과 시청각 연출을 구체적으로 지시할 수 있습니다.
영상에 사용할 캐릭터, 배경, 소품과 스타일 이미지를 생성합니다. 먼저 기준 이미지를 만든 뒤 영상 장면에 활용하면 캐릭터와 시각 요소의 방향을 더 분명하게 잡을 수 있습니다.
영상 아이디어를 확장하고 장면 순서, 대사, 촬영 지시와 상세 프롬프트를 정리하는 데 활용합니다. 짧은 아이디어를 실제 생성에 필요한 구체적인 장면 설명으로 발전시키는 역할입니다.
Lyria 3는 Google DeepMind의 음악 생성 모델입니다. Flow의 공식 핵심 모델은 Veo·Imagen·Gemini이며, 배경음악이 필요한 경우 Lyria 3를 지원하는 Gemini 등에서 음악을 별도로 만든 뒤 영상 편집 단계에서 활용할 수 있습니다.
정보 기준일: 2026년 7월 26일 · Google의 Flow 공식 안내는 Veo·Imagen·Gemini를 핵심 모델로 설명합니다. Lyria 3는 별도의 음악 생성 모델로 구분해 안내합니다. Google Flow 공식 안내 · Lyria 3 공식 안내
Google Flow는 장면 하나를 짧게 만드는 방식으로 접근하는 것이 좋습니다. 한 번에 긴 영상을 만들기보다, 8초 안팎의 장면을 여러 개 만든 뒤 필요한 경우 CapCut에서 연결·편집합니다.





CapCut(캡컷)은 웹·데스크톱·모바일에서 사용할 수 있는 AI 기반 영상 편집 도구입니다. 공식 안내 기준으로 AI Video Maker, 텍스트·스크립트 기반 영상 생성, 자동 자막, 텍스트 음성 변환과 일반 영상 편집 기능을 제공합니다.
K Biz Note에서는 Google Flow를 짧은 생성 장면 제작에 사용하고, CapCut은 30~40초 세로형 쇼폼의 전체 구성과 후편집에 사용합니다. 기존 사진·동영상·로고가 있으면 원본 자료를 우선 배치하고, 부족한 장면만 AI 생성 또는 스톡 자료로 보완하는 방식이 적합합니다.
영상 아이디어나 프롬프트를 입력해 스크립트, 이미지·클립, 자막과 음악을 포함한 영상 초안을 구성하는 용도입니다. 생성 결과는 바로 확정하지 않고 실제 매장·제품 정보와 대조해 편집합니다.
완성된 스크립트를 바탕으로 관련 시각 자료와 장면 흐름을 구성합니다. 사실관리가 중요한 홍보·교육 영상은 AI가 대본을 새로 쓰게 하기보다 검수된 대본을 먼저 준비하는 방식이 안정적입니다.
영상 음성을 인식해 자동 자막을 생성할 수 있습니다. 상호명·메뉴명·고유명사·숫자와 가격은 자동 결과를 그대로 사용하지 않고 직접 교정합니다.
텍스트를 AI 음성으로 변환하고 장면, 자막, 음악, 효과와 화면 비율을 편집합니다. 생성 영상과 실제 촬영 자료를 한 프로젝트에서 조합하는 후편집 도구로 활용합니다.
정보 기준일: 2026년 8월 18일 · CapCut 공식 안내 기준. 기능 이름과 제공 범위는 웹·데스크톱·모바일, 지역, 계정, 요금제에 따라 달라질 수 있습니다. CapCut AI Video Maker · Script to Video · Auto Captions
K Biz Note의 CapCut 바로 입력용 한글 프롬프트은 기존 생성 데이터의 주제·장면·카메라·분위기·음향을 한 번에 정리합니다. 대본 근거와 시각자료 지시를 분리해 실제 정보는 유지하고, 대본은 간결한 평서형으로 구성하며 촬영·편집 조건은 시각자료 선택에만 사용합니다.
프랜차이즈·외식업·일반 소상공인 영상 실습에 각각 3개씩, 총 9개를 제공합니다. 정상적인 광고 장면으로 시작해 안전한 엉뚱한 반전 1회를 넣고, 약 6초 전후 제품·메뉴·브랜드로 돌아온 뒤 마지막 약 1초는 대사·내레이션 없이 정지감 있는 화면과 현장음 잔향으로 여운을 남깁니다.
기준: 마지막 장면을 대사로 설명하지 않음 · 제품·음식 형태 왜곡 없음 · 위험 행동 없음 · 특정 개인·집단 조롱 없음 · 음식 낭비 없음 · 근거 없는 효능·매출 과장 없음.
대상 · 주제 · 영상 목적 · 9:16/30~40초 · 대본 근거 · 장면 흐름 · 시각 스타일 · 카메라 · 음향 · 편집 기준을 한 입력문으로 제공합니다.
문체 기준: 존칭어 없음 · 간결한 평서형 중심 · 불필요한 수식어 최소화. 원본에 없는 메뉴·재료·맛·성과 정보 추가 제한.
| 구분 | 권장 방법 |
|---|---|
| CapCut 프롬프트 | 기존 생성 데이터의 사실과 시각·촬영 정보를 한 입력문으로 제공 |
| 영상 비율 | 쇼츠·릴스 기준 9:16 세로형 우선 |
| 영상 길이 | 30~40초 실습 기준. 자동 생성 후 실제 재생시간 확인 |
| 보유 사진·영상 | AI 재생성보다 원본 자료 우선 배치 |
| 자막 | 자동 자막 활용 가능. 상호명·메뉴명·숫자·가격 직접 검수 |
| AI 음성 | 텍스트 음성 변환 활용 가능. 발음·속도·고유명사 확인 |
| Google Flow 연계 | Flow 생성 장면을 CapCut 프로젝트에 삽입해 전체 쇼폼으로 편집 |
| 최종 출력 | 장면·대본·자막·로고·연락처 확인 후 내보내기 |