한국어

YouTube에서 이 튜토리얼 보기

YouTube

정지된 사진을 말하게 만들고 싶으신가요—입을 열고 눈을 깜빡이며, 입력한 내용 그대로 말하는 초상화처럼요? VisionStory라면 단 한 장의 이미지로, 브라우저에서 바로 카메라나 편집 경험 없이도 그대로 할 수 있습니다. 위 영상은 전체 흐름을 보여주고, 아래 단계별 가이드는 모든 과정을 자세히 다룹니다.

진행하면서 인물 사진 1장을 업로드해 나만의 재사용 가능한 아바타로 준비하게 됩니다. 다른 사용자는 이를 볼 수 없으며, 매번 같은 이미지를 다시 업로드하지 않아도 이후 비디오에서 다시 선택해 사용할 수 있습니다. 모든 작업은 무료 계정으로 VisionStory의 말하는 사진 도구 안에서 실행됩니다.

1단계: 선명한 인물 사진 1장 업로드

AI 비디오를 여세요. 캐릭터 패널에서 업로드를 선택해 기기에서 이미지를 고르거나, 사진을 드롭존으로 바로 드래그해 넣습니다. 얼굴과 어깨가 보이고, 눈과 입이 가려지지 않으며, 나중에 다시 프레이밍할 수 있도록 피사체 주변에 약간의 여백이 있는 정면 사진 1장을 사용하세요.

  • 지원 파일: JPG, JPEG, PNG, WebP, HEIC.
  • 최대 파일 크기: 30 MB.
  • 권장 시작 크기: 인물 사진 기준 최소 512 x 768 픽셀.
  • 업로드 방식: 한 번에 원본 이미지 1장.
Dragging a portrait onto the Upload control in the VisionStory Characters panel

영상이 최종적으로 사용될 구도에 맞춰 원본 사진의 구도를 잡아두세요. 꽉 잘린 인물 사진은 9:16에서는 괜찮아도, 16:9에서는 좌우로 넓은 프레임을 채울 이미지 영역이 없어 얼굴이 지나치게 타이트하게 크롭될 수 있습니다.

2단계: VisionStory로 아바타 검증 및 준비하기

업로드 후 VisionStory가 이미지에 사용 가능한 인물이 있는지 확인하고 캐릭터로 준비합니다. 업로드 실패는 대부분 원본 사진 문제입니다. 얼굴이 너무 작거나, 많이 가려져 있거나, 옆으로 너무 돌아가 있거나, 흐리거나, 다른 얼굴과 너무 가까울 수 있습니다.

준비에 실패했다면 같은 크롭으로 계속 재시도하지 마세요. 얼굴이 더 크고 선명하며, 각도가 더 정면에 가깝고, 어깨가 보이고, 조명이 고르고, 가림이 적은 원본을 선택하세요.

VisionStory avatar preview beside a checklist for a clear, unobstructed source photo

처리가 끝나면 아바타가 공개 캐릭터 라이브러리 위에 표시되고 아바타 미리보기에서 열립니다. 이는 본인에게만 보입니다.

3단계: 할당된 음성 미리듣기 또는 변경하기

VisionStory는 인물의 추정 나이와 성별을 바탕으로 적합한 기본 음성을 자동으로 할당합니다. 그대로 사용하거나, 미리듣거나, 다른 음성으로 바꿀 수 있습니다.

  1. 현재 음성을 선택해 음성 라이브러리를 엽니다.
  2. 각 음성 오른쪽의 재생 버튼으로 샘플을 들어보세요.
  3. 맞지 않으면 언어, 성별, 나이, 사용 사례로 필터링하세요.
  4. 몇 가지 대안을 미리 들어본 뒤, 아바타와 영상 목적에 모두 맞는 음성을 선택하세요.
VisionStory Voice Library with Language, Gender, Age, and Use Case filters and a preview button

음성이 인물의 추정 나이·성별과는 맞아도, 내레이션/교육/광고/대화형 콘텐츠에는 어색할 수 있습니다. 인구통계만 보지 말고, 인물과 목적을 함께 맞추세요.

4단계: 게시 목적에 맞게 사진 프레이밍하기

아바타 미리보기에서 최종 영상에 인물이 어느 정도 보일지 정하세요. 사진을 드래그해 피사체 위치를 조정하고, 줌 컨트롤로 더 가까이/멀리 이동합니다. 그런 다음 게시할 곳에 맞는 화면 비율을 선택하세요:

  • TikTok, Instagram Reels, YouTube Shorts 등 모바일 중심 배치에는 9:16 세로
  • 정사각형 소셜 게시물, 프로필 중심 레이아웃, 유연한 임베드에는 1:1 정사각형
  • YouTube, 프레젠테이션, 웹사이트, 와이드 코스에는 16:9 가로
The same VisionStory avatar shown in 9:16, 1:1, and 16:9 aspect ratios

줌으로는 존재하지 않는 픽셀을 만들어낼 수 없습니다. 원본 사진에서 인물이 이미 가장자리를 꽉 채우고 있다면, 억지로 더 넓게 크롭하기보다 배경 여백이 더 있는 이미지로 시작하세요.

5단계: Change Look과 Generate Image의 차이 알아두기

아바타 옆에는 2가지 AI 이미지 도구가 있으며, 사용 전 차이를 알아두면 좋습니다.

Change Look은 현재 아바타가 이미 첨부된 상태로 AI 채팅을 열어, 새 의상/배경/스타일을 설명할 수 있게 해줍니다. image-to-image 워크플로이며, 원래 아바타도 계속 사용할 수 있습니다. Generate Image는 사진 대신 텍스트로 캐릭터 설명을 입력해 시작하므로 text-to-image 워크플로입니다. 두 경우 모두 채팅을 이어가며 결과를 다듬을 수 있습니다.

VisionStory Change Look chat opened with the current avatar attached as the starting image

정리하면: 캐릭터가 이미 있고 새로운 비주얼로 변주하고 싶다면 Change Look, 프롬프트로 캐릭터를 새로 만들고 싶다면 Generate Image를 사용하세요.

6단계: 짧은 스크립트를 추가해 말하는 비디오 생성하기

업로드한 아바타를 선택한 상태에서 스크립트 박스에 짧은 대화체 문장 1개를 입력하세요. 짧은 문장은 렌더링이 더 빠르고, 사진/크롭/음성/립싱크/모션을 한 번에 판단하기 쉽습니다.

Generate Talking Video를 클릭하세요. VisionStory는 선택한 아바타, 프레이밍, 스크립트, 음성을 사용해 얼굴을 애니메이션화하고, 입 모양을 음성과 동기화하며, 생생한 눈 깜빡임과 고개 움직임을 더합니다. 렌더링에는 몇 분 정도가 걸립니다.

A short VisionStory script generating a talking-avatar result from the uploaded portrait

첫 결과는 원본 사진을 실전에서 테스트하는 용도라고 생각하세요. 아래 4가지를 확인합니다:

  • 최종 크기에서 얼굴이 충분히 선명한지
  • 움직이는 동안 눈과 입이 계속 가려지지 않는지
  • 선택한 비율 안에 머리와 어깨가 편하게 들어오는지
  • 움직이는 아바타가 원본 인물처럼 보이는지

크롭이 너무 타이트하거나 움직임에서 얼굴이 흐릿해 보인다면, 스크립트보다 먼저 원본 이미지나 프레이밍을 수정하세요. 스크립트를 바꾼다고 구도 문제는 해결되지 않습니다.

7단계: 말하는 사진 아바타 재사용 또는 삭제하기

캐릭터 목록으로 돌아가면, 업로드한 아바타가 공개 캐릭터 라이브러리 위에 표시되며 같은 진행자가 필요할 때 언제든 선택할 수 있습니다. 다른 사용자는 이를 볼 수 없고, 구독자는 아바타를 무제한으로 만들고 보관할 수 있습니다.

  • 재사용: 사진을 다시 업로드하는 대신 아바타를 선택하세요.
  • 룩 전환: 아바타를 열고 저장된 룩 썸네일 중 하나를 선택하세요.
  • 삭제: 아바타에 마우스를 올려 오른쪽 상단의 삭제 버튼을 표시한 뒤, 아바타와 룩을 삭제하기 전에 확인을 진행하세요.
A reusable uploaded avatar in VisionStory Characters with the delete control and confirmation dialog

자주 발생하는 사진 문제 해결

VisionStory가 사용 가능한 얼굴을 찾지 못함. 얼굴이 더 크고 정면을 바라보는, 더 밝고 선명한 이미지를 사용하세요. 눈이나 입이 가려진 사진, 강한 측면 각도, 다른 얼굴이 주 피사체에 가깝게 붙어 있는 사진은 피하세요.

가로(landscape) 크롭이 너무 가까움. 원본 인물 사진의 좌우 이미지 영역이 부족한 경우가 많습니다. 더 넓은 원본을 사용하거나, 인물 주변 여백이 더 있는 사진을 선택하세요.

아바타가 아직 준비 중. 준비가 완료될 때까지 기다린 뒤 캐릭터를 사용하세요. 멈춘 것 같다면 캐릭터 화면을 새로고침하고, 다른 복사본을 업로드하기 전에 아바타가 이미 생성되었는지 확인하세요.

결과가 흐릿해 보임. 더 높은 해상도의 초점이 맞는 사진으로 시작하고, 작은 얼굴을 과하게 확대하지 마세요. 출력 해상도만으로는 원본에 없던 디테일을 되살릴 수 없습니다.

이것만으로도 사진을 말하게 만들 수 있습니다. 인물 사진 1장을 업로드하고, 음성을 맞추고, 프레이밍한 뒤 생성하세요. 이제 사진은 필요할 때마다 다시 쓸 수 있는 말하는 아바타가 됩니다.

완성형 스크립트/음성/설정/크레딧/생성 워크플로까지 모두 보고 싶으신가요? AI 말하는 아바타 만드는 방법을 따라 하거나, 긴 스크립트를 대량으로 AI 비디오로 변환해 보세요. 또는 지금 바로 시작: 첫 말하는 사진을 무료로 만들어 보세요.

자주 묻는 질문

  • VisionStory의 말하는 사진 도구에 선명한 정면 사진을 업로드한 다음, 말하게 할 짧은 문장을 입력하고, 할당된 음성을 그대로 사용하거나 선택한 뒤 Generate Talking Video를 클릭하세요. 무료 플랜에서도 설치 없이 브라우저에서 몇 분 만에 립싱크된 말하는 비디오를 만들 수 있습니다.