쓸모 쓸모연구소 · 실전 노트
제 106 호이번 주 새 글 1 편2026 · 09 · 26
AI 크리에이티브
Google Flow

구글 플로우 한글 프롬프트로 Veo 3 영상 만드는 법

구글 플로우(Google Flow)에 한글 프롬프트 업데이트가 나와, 이제 한글 문장을 그대로 입력해 Veo 3 영상을 만들 수 있다. 이 글은 텍스트로 시작하는 방법과 이미지로 시작하는 방법의 클릭 순서, 원하는 대사를 정확히 넣는 구글 플로우 한글 프롬프트 작성법을 정리했다. 바탕이 된 건 45초짜리 짧은 영상이다.

구글 플로우 한글 프롬프트로 Veo 3 영상 만드는 법 삽화
삽화 · 쓸모연구소

먼저 알아둘 말

  • 구글 플로우(Flow): 구글이 만든 웹 기반 AI 영상 제작 도구. 설치 없이 브라우저에서 구글 계정으로 쓴다.
  • Veo 3: 플로우 안에서 영상을 실제로 만들어 내는 구글의 영상 생성 모델. 화면과 함께 소리까지 만든다.
  • 프롬프트: AI에게 "이런 영상을 만들어 달라"고 입력하는 지시 문장.

구글 플로우 접속하기

  1. 구글에서 "구글 플로우"를 검색하거나 구글 랩스(Google Labs, 구글이 실험 서비스를 모아 둔 사이트)에서 Flow를 연다.
  2. 구글 계정으로 로그인한다.
  3. 프로젝트 목록 화면이 나오면 준비가 끝난 것이다.

텍스트로 Veo 3 영상 만들기: 클릭 순서

  1. "새 프로젝트"를 클릭한다.
  2. "텍스트 동영상 변환"을 클릭한다.
  3. 화면 우측의 "모델"을 클릭하고 목록에서 Veo 3를 선택한다.
  4. 한글로 프롬프트를 입력한다.

이 영상에서 실제로 쓴 프롬프트는 "서울 거리를 걸으며 노래한다"다. 결과 영상에서는 인물이 실제로 노래를 부르고, 가사에 Veo 3 업데이트를 언급하는 말이 섞여 나온다. 이어서 "할아버지와 할머니가 대화한다"를 넣은 결과가 붙는데, 여기서는 "여보", "사랑해요" 같은 대사가 모델이 알아서 만들어낸 말로 나온다. 프롬프트에 대사를 지정하지 않으면 이렇게 된다. 원하는 대사를 정확히 넣는 법은 아래 "대사를 정확히 넣고 싶을 때"에 적었다.

이미지로 Veo 3 영상 만들기: 클릭 순서

  1. "프레임 동영상 변환" 화면에서 플러스(+) 버튼을 클릭한다. 프레임 동영상 변환은 올린 사진을 첫 장면으로 삼아 영상을 만드는 방식이다.
  2. 원하는 이미지를 업로드하고 선택한다.
  3. 한글로 프롬프트를 입력한다.

프롬프트 예시는 두 개였다. "사랑은 지나간다"를 넣었더니 결과 영상의 대사가 정확히 그 문장으로 나왔고, "귤을 참 맛있어. 서울 거리에서 노래한다"를 넣었을 때도 그 내용이 대사에 반영됐다.

텍스트 방식과 이미지 방식, 뭐가 다른가

텍스트 방식은 이미지 없이 문장만으로 시작하고, 이미지 방식은 사진 한 장을 올린 다음 문장을 붙인다. 둘 다 마지막 단계는 한글 프롬프트 입력으로 같다. 영상은 이제 플로우에서도 손쉽게 한글로 영상을 만들 수 있다는 말로 끝난다.

영상은 접속부터 저장까지를 통째로 건너뛴다. 접속은 위의 "구글 플로우 접속하기"대로 하면 되고, 프로젝트 목록 화면에서 "새 프로젝트"를 만들면 위의 1번부터 그대로 이어진다. 만든 장면은 프로젝트 안에 계속 쌓이고, 장면마다 내려받기 항목이 따로 붙는다. 항목 이름은 버전마다 바뀌므로 화면에 보이는 목록에서 고르면 된다. 비용과 준비물은 아래에 정리했다.

영상에 없는 배경 (편집자 정리)

여기부터는 영상에서 다루지 않은 내용이다. 실제로 따라 해보려면 알아야 하는 것들을 따로 정리했다.

플로우가 어떤 도구인가

플로우는 구글이 만든 웹 기반 AI 영상 제작 도구다. 프롬프트로 장면을 만들고, 만든 장면을 하나의 프로젝트 안에 모아두는 구조다. 영상 생성 모델 Veo가 그 안에서 돌아간다. 설치할 프로그램은 없고 구글 계정으로 로그인해 브라우저에서 쓴다. 다만 쓸 수 있는 국가와 요금제 조건이 걸려 있고 이 조건은 바뀌므로, 지금 내 계정으로 되는지는 구글 공식 안내를 확인해야 한다.

Veo 3는 소리까지 같이 만든다

영상 속 결과물에서 인물이 말을 하고 노래를 부르는 이유가 여기 있다. Veo 3는 화면만 만드는 게 아니라 대사, 효과음, 배경음을 함께 생성한다. 그래서 "노래한다", "대화한다" 같은 한 문장만 넣어도 결과에 목소리가 붙는다. 뒤집어 말하면 소리 없는 영상을 원해도 소리가 붙어 나올 수 있고, 대사 내용을 지정하지 않으면 모델이 알아서 만들어낸다.

대사를 정확히 넣고 싶을 때

프롬프트 안에서 대사를 따옴표로 감싸 적으면 그 문장이 그대로 발화된다. 영상 속 프롬프트는 이런 형태가 아니었고, 그래서 모델이 대사를 알아서 지어냈다. 같은 프롬프트를 다시 돌려도 결과는 매번 달라지므로, 대사만큼은 문장 안에 못을 박아두는 편이 낫다.

프롬프트
할아버지가 할머니의 손을 잡고 낮은 목소리로 "여보, 고마웠어"라고 말한다.
할머니는 웃으며 "나도요"라고 답한다.
1980년대 한국 시골집 툇마루, 늦은 오후 햇빛, 카메라 고정.

텍스트 시작과 프레임 시작을 언제 나눠 쓰나

텍스트 동영상 변환은 재료 없이 문장만으로 출발한다. 인물의 얼굴이나 장소가 만들 때마다 달라진다. 프레임 동영상 변환은 시작 이미지를 정해두고 그 그림에서 영상이 출발한다. 같은 인물이나 같은 배경을 여러 컷에 걸쳐 유지하고 싶으면 이쪽이 유리하다. 영상 후반부에 나온 방식이 이것이다.

준비물과 전제

  • 구글 계정
  • 웹 브라우저. 화면이 넓은 데스크톱 환경이 다루기 편하다
  • 이미지 방식으로 갈 거라면 시작 프레임으로 쓸 사진 파일

생성 횟수는 크레딧(영상을 하나 만들 때마다 차감되는 사용권)처럼 차감되는 방식이 흔하고, 요금제에 따라 고를 수 있는 모델과 횟수가 달라진다. 무료로 어디까지 되는지와 금액은 자주 바뀌므로 공식 요금제 안내를 확인해야 한다.

한글로 넣는다고 다 되는 것은 아니다

입력 언어가 늘어난 것과 결과가 의도대로 나오는 것은 다른 문제다. "노래한다" 같은 짧은 문장은 해석의 폭이 넓어서 매번 다른 장면이 나온다. 장면을 좁히려면 누가, 어디서, 어떤 표정으로, 어떤 분위기인지를 같이 적는 게 낫다. 카메라 움직임(고정, 천천히 다가감), 시간대(한낮, 해질 무렵), 화면비(가로세로 비율) 같은 조건도 문장에 넣을 수 있다. 영상에 나온 "서울 거리를 걸으며 노래한다"를 실제로 쓸 만한 수준까지 늘리면 이런 모양이 된다.

프롬프트
30대 여성이 비 갠 저녁 서울 을지로 골목을 천천히 걸으며 노래한다.
젖은 아스팔트에 네온 간판 불빛이 번지고, 표정은 담담하다.
카메라는 인물 정면에서 뒤로 물러나며 따라간다. 해질 무렵, 가로 16:9.

한 문장을 통째로 넣기보다 인물, 장소, 동작, 빛, 카메라를 줄 단위로 끊어 적으면 결과의 편차가 줄어든다.

자주 막히는 지점

  • 실존 인물이나 특정 브랜드를 지정하면 생성이 거부될 수 있다.
  • 얼굴이 컷마다 달라진다. 시작 이미지를 고정하는 프레임 방식으로 바꾸면 덜하다.
  • 한 번에 만들어지는 길이가 짧다. 긴 영상은 여러 장면을 만들어 이어 붙이는 작업이 된다.
  • 생성에 시간이 걸리고, 결과가 마음에 들지 않아도 소모된 분량은 돌아오지 않을 수 있다.

만든 영상을 쓰기 전에

구글은 자사 생성 모델의 결과물에 SynthID라는 식별 표시를 넣는다고 밝혀 왔다. SynthID는 AI로 만든 콘텐츠임을 기계가 알아볼 수 있게 심어 두는 표시다. 눈에 보이는 워터마크가 붙는지는 요금제에 따라 다를 수 있다. 상업적으로 쓸 계획이라면 이용약관과 요금제 안내에서 사용 범위를 먼저 확인하는 편이 안전하다.

다른 선택지

텍스트나 이미지에서 영상을 만드는 서비스는 플로우 말고도 있다. 클링, 런웨이, 루마 같은 이름이 자주 거론된다. 소리까지 한 번에 만드는지, 시작 프레임과 끝 프레임을 둘 다 지정할 수 있는지, 무료 한도가 있는지가 서비스마다 다르다. 대사가 들어간 장면을 한 번에 뽑는 게 목적이면 Veo 3 쪽이 유리하고, 여러 번 돌려보며 감을 잡는 게 목적이면 무료 한도가 있는 쪽을 같이 보는 게 낫다.

이 도구가 맞는 경우와 아닌 경우

몇 초짜리 장면, 광고 컷, 소셜 미디어용 클립처럼 짧은 결과가 필요한 작업에 맞는다. 반대로 정해진 콘티대로 정확히 나와야 하거나, 같은 인물이 여러 컷에 반복해서 등장해야 하거나, 자막과 편집이 정교해야 하는 작업이라면 생성 결과는 소재로만 쓰고 편집은 따로 하는 쪽이 현실적이다.

구글 플로우 한글 프롬프트 따라 하기 체크리스트

  • [ ] 새 프로젝트 생성
  • [ ] 텍스트 변환 모드에서 Veo 3로 한글 프롬프트 입력해보기
  • [ ] 이미지 변환 모드에서 사진 올리고 한글 프롬프트 입력해보기

자주 묻는 질문

구글 플로우에 한글로 프롬프트를 넣어도 되나요?

된다. 한글 프롬프트 업데이트로 한글 문장을 그대로 입력해 Veo 3 영상을 만들 수 있다. 텍스트 동영상 변환과 프레임 동영상 변환 모두 마지막 단계에서 한글로 입력하면 된다.

Veo 3 영상에 원하는 대사를 넣으려면 어떻게 하나요?

말할 문장을 따옴표로 감싸 프롬프트 안에 적는다. 대사를 지정하지 않으면 모델이 "여보", "사랑해요"처럼 알아서 대사를 지어낸다. 같은 프롬프트라도 결과가 매번 달라지므로 대사는 문장으로 못 박는 편이 낫다.

구글 플로우는 무료로 쓸 수 있나요?

쓸 수 있는 국가와 요금제 조건이 걸려 있고, 요금제에 따라 고를 수 있는 모델과 생성 횟수가 다르다. 무료 범위와 금액은 자주 바뀌므로 구글 공식 요금제 안내를 확인해야 한다.

텍스트 동영상 변환과 프레임 동영상 변환은 언제 골라 쓰나요?

재료 없이 문장만으로 빠르게 만들어 보려면 텍스트 동영상 변환을 쓴다. 같은 인물이나 배경을 여러 컷에서 유지하고 싶으면 시작 이미지를 정해 두는 프레임 동영상 변환이 유리하다.

Veo 3로 만든 영상에는 소리가 자동으로 붙나요?

붙는다. Veo 3는 화면과 함께 대사, 효과음, 배경음을 생성한다. 그래서 "노래한다" 한 문장만 넣어도 목소리가 나오고, 소리 없는 영상을 원해도 소리가 붙어 나올 수 있다.

이 글은 영상의 자동 자막을 바탕으로 정리했다. 자막에는 모델 이름이 "베어 3"로 잡혀 있으나 Veo 3를 가리킨다.

원본 영상: youtube.com/…

원본 영상 보러가기 ↗