디지털 라이브 방송 비디오 제작에 대한 보모 수준의 튜토리얼: 대본에서 다국어 영화까지

🛒 운영 및 콘텐츠 입문자를 위해 주제선정부터 다국어 영화제작까지 원스톱 제작을 도와드립니다.

튜토리얼 목표

이 튜토리얼에서는 HeyGen을 예로 들어 스크립트에서 시작하고, 게시 가능한 디지털 음성 방송 비디오를 완성하고, 다국어 버전을 일괄 생성하는 방법을 배우는 데 도움을 줍니다. 편집 배경 지식이 필요 없이 프로세스 전반에 걸쳐 단계를 따르기만 하면 됩니다.

준비 체크리스트

  • [ ] HeyGen 계정(또는 Synthesia와 같은 유사한 도구)을 등록하고 무료 할당량을 확인하세요.
  • [ ] 100~200 단어의 음성 스크립트를 준비합니다(AI 지원으로 생성 가능).
  • [ ] 동영상의 목적과 형식을 결정합니다. 가로 버전(16:9)은 Bilibili/YouTube에 적합하고 세로 버전(9:16)은 ​​Douyin/Video Account/Kuaishou에 적합합니다.
  • [ ] 브랜드 관련 자료(로고, 배경이미지, 음성자막 카피)를 준비합니다.
  • [ ] 사용하는 이미지의 출처를 확인하세요. 플랫폼 자체 이미지인지, 승인한 사운드/이미지 자료인지 확인하세요.

1단계: 음성 스크립트 작성

구두 방송 대본은 "후크 - 본문 - 행동 촉구" 구조를 따릅니다.

``텍스트 [Hook] 많은 분들이 짧은 영상을 만드는 것이 어렵다고 생각하시는데, 사실 방법은 하나뿐입니다. [텍스트] 오늘 3단계를 사용하여 카피라이팅을 음성 비디오로 바꿔보세요... [CTA] 체계적으로 학습하고 싶으신 분은 댓글란에 "tutorial"이라고 답변해주시면 전체 목록을 보내드리겠습니다.


쓰기 포인트:

- 구두 방송 및 자막을 원활하게 하기 위해 각 문장은 20 단어로 제한됩니다.
- 구어체를 사용하고 악센트나 긴 절을 사용하지 마세요.
- "키 일시정지" 또는 "자막 강조"가 필요한 위치를 나타냅니다.

### 구두 방송 대본 템플릿 예시(직접 적용 가능)

``텍스트
[훅] 콘텐츠를 만들 때 가장 두려운 점은 글을 못 쓰는 게 아니라, 한번 쓰면 아무도 읽지 않을 것이라는 점이다.
[Pain Point] 밤늦게까지 대본을 작성하고 녹화를 수십 번 했는데도 조회수가 두 자릿수에 안착한 적이 있나요?
[방법] 오늘은 방법을 공유하겠습니다. 먼저 AI를 사용하여 원고를 일괄 제작한 다음 디지털 휴먼을 사용하여 영화를 일괄 제작합니다. 일주일 분량의 작품을 하루 만에 생산할 수 있습니다.
[세부사항] 첫째, 주제 선정은 'Pain Point + 시나리오'를 사용해야 합니다. 둘째, 대본은 짧고 구어체여야 합니다. 셋째, 통일된 이미지를 사용하여 지속적으로 출력하고 메모리 포인트를 설정합니다.
【CTA】완전한 스크립트 템플릿을 원하시나요? 댓글란에 "디지털맨"이라고 답해주시면 템플릿을 보내드리겠습니다.

이 구조는 제품 소개, 지식 대중화, 이벤트 홍보 등 대부분의 구두 방송 시나리오에 적합하며 콘텐츠를 직접 대체하는 데 사용할 수 있습니다.

2단계: 디지털 휴먼 비디오 생성

  1. 헤이젠의 '동영상 만들기'에 들어가서 '아바타(디지털 휴먼 이미지)'를 선택하세요.
  2. 가로 또는 세로 형식을 선택합니다.
  3. 스크립트를 텍스트 상자에 붙여넣고 언어(기본 중국어)를 설정합니다.
  4. 이미지 및 음성 선택 : "자연스러운 말투와 선명한 입 모양"의 기본 이미지를 우선시합니다.
  5. 생성을 클릭하고 생성을 기다립니다(보통 몇 분).

체크포인트 : 입 모양이 올바른지, 말하는 속도가 자연스러운지, 마지막에 눈에 띄는 끊김 현상이 있는지.

3단계: 음성 및 말하기 속도 조정

  • 음성 속도: 기본값은 1.0입니다. 물품/건조물 운반 시 1.1-1.2로 조정할 수 있지만 1.3을 초과하지 마십시오. 그렇지 않으면 입 모양이 쉽게 동기화되지 않습니다.
  • 일시 정지: 스크립트에 쉼표/마침표를 삽입하여 자연스럽게 문장을 끊습니다. 강조해야 할 곳에 새로운 문장을 시작하세요.
  • 사운드 변경 : 만족스럽지 않은 경우 사운드 목록을 전환한 후 다시 생성하세요.

4단계: 자막 및 배경 추가

  1. "자동 자막"을 켜고 자막 스타일과 위치를 선택하세요.
  2. 배경 추가: 단색, 브랜드 이미지 또는 흐린 배경을 사용할 수 있습니다.
  3. 브랜드 로고 및 엔딩 액션 가이드를 추가합니다. (추후 편집 소프트웨어에서 처리 가능)

자막 제안: 핵심 숫자와 CTA에 강조 표시된 색상을 사용하여 완료율을 높이세요.

5단계: 다국어 일괄 생성

  1. 프로젝트의 원본 비디오를 복사하고 "재생성"을 선택하십시오.
  2. 언어를 대상 언어(예: 영어, 일본어)로 전환합니다.
  3. 플랫폼 번역을 사용하거나 수동 교정 후 번역된 텍스트를 붙여넣습니다. (품질을 높이려면 후자를 권장합니다.)
  4. 모든 언어 버전을 일괄적으로 내보냅니다.

참고: 브랜드 감각을 손상시킬 수 있는 "직역"을 피하기 위해 번역 후 발음과 용어를 반드시 확인하십시오.

6단계: 규정 준수 및 플랫폼 적응

게시하기 전에 확인하세요:

  • [ ] "AI 생성 콘텐츠" 주석을 켭니다(플랫폼의 요구에 따라).
  • [ ] 구두방송 대본에는 절대적인 표현이나 불법적인 약속(광고법)이 포함되어 있지 않습니다.
  • [ ] 사용된 이미지와 사운드는 승인된 출처에서 나온 것입니다.
  • [ ] 대상 플랫폼 사양에 따라 내보냅니다(Douyin 세로 버전 1080×1920, 사이트 B 가로 버전 1920×1080).

7단계: 릴리스 및 데이터 검토

  1. 게시 후 완료율, 3초 이탈률, 상호작용률에 중점을 둡니다.
  2. 다양한 이미지, 말하는 속도, 표지의 데이터를 비교해보세요.
  3. 데이터 피드백을 다시 스크립트 라이브러리에 쓰고 다음 배치를 반복합니다.

포스트 템포 제안

  • 시작 기간: 주당 3-5개 항목, 다양한 후크와 이미지 테스트.
  • 안정 기간: 주당 2~3개의 기사를 수정하고, 우수한 주제 선택 방향에 중점을 둡니다.
  • 리뷰 테이블 : 각 영상의 영상, 재생, 완성, 상호작용, 전환을 기록하고, 2주마다 추세를 확인합니다.

자료 이름 지정 및 보관 사양

``텍스트 {날짜}{시리즈}{버전}_{언어}.mp4 예: 20260815_제품소개_v2_zh.mp4



통일된 네이밍을 통해 팀 협업과 다국어 관리가 더욱 효율적으로 이루어지며 "최종 버전 v3 최종 버전"의 혼동을 피할 수 있습니다.

### 채널 사양을 빠르게 확인

| 플랫폼 | 추천 프레임 | 권장 기간 | 비고 |
|---|---|---|---|
| Douyin/비디오 계정 | 9:16 세로버전 | 30~60초 | 훅의 처음 3초가 가장 중요합니다 |
| 스테이션 B/유튜브 | 16:9 가로 버전 | 1~3분 | 높은 정보 밀도, 자막 추가 가능 |
| 작은 빨간 책 | 9:16 수직 | 40~90초 | 표지와 제목 모두 중요 |

내보내기 전에 대상 플랫폼에 따라 해당 사양을 선택하여 2차 자르기로 인한 이미지 품질 손실을 방지하세요.

## 확인 방법

- 검증1: 생성된 영상의 입 모양과 발음이 기본적으로 일치합니다.
- 확인 2: 자막에 오타가 없고, C-bit 정보를 읽을 수 있습니다.
- 검증 3: 다국어 버전은 무작위로 확인되었으며 오역이 없습니다.
- 검증 4: 완성된 영화는 AI 주석을 완료했으며 플랫폼 규칙을 준수합니다.

## 흔히 발생하는 실수와 주의사항

1. 대본이 너무 깁니다. 단일 대본은 구두 재생의 60~90초(대략 250~350단어)로 제한되어야 합니다. 너무 길면 쉽게 끝나요.
2. 말하는 속도가 너무 빠릅니다. 1.3배속 이상에서는 입 모양이 무너지기 쉽습니다. 1.25배속으로 사용자가 직접 읽게 하는 것이 좋습니다.
3. 다국어 직역: 해외판은 엄격한 번역을 피하기 위해 원어민이 교정해야 합니다.
4. 라벨이 지정되지 않은 AI 콘텐츠: 라벨 지정을 무시하면 계정이 차단될 위험이 있으므로 게시 시 반드시 확인하세요.
5. 소재 혼동: 시리즈별로 대본, 소재, 완성된 영화 폴더를 만들고 날짜와 버전으로 이름을 지정합니다.

## 자주 묻는 질문 및 문제 해결(FAQ)

1. 생성이 너무 느리거나 대기열에 있습니까?

   대기열은 피크 기간 동안 정상이며 사전에 배치로 생성될 수 있습니다. 무료 할당량을 모두 사용한 후에는 기다리거나 업그레이드해야 합니다.

2. 입모양도 틀리고 목소리도 어색하다?

   좀 더 자연스러운 이미지와 음성을 다시 선택하고, 말하기 속도를 다시 1.0으로 조정하고, 문장을 더 짧은 문장으로 나눕니다.

3. 영상에는 자막이 있지만 플랫폼이 자동으로 자막을 추가합니다. 이런 일이 반복되나요?

   내보낼 때 인라인 자막을 끄거나 대신 플랫폼의 "자동 자막"을 사용하십시오.

4. 디지털 휴먼 이미지는 외국인 같은데, 중국인 입 모양은 이상하다?

   중국어에 최적화된 이미지에 우선순위가 부여됩니다. 사용자 정의 이미지에는 중국어 자료의 녹음이 필요합니다.

5. 플랫폼에서 취급하고 있거나 품질이 낮다고 판단했나요?

원본 스크립트, 차별화된 이미지(실제 자료/애니메이션 전환 추가)를 보장하고 AI 생성을 표준화합니다.

6. 저렴한 비용으로 여러 이미지를 테스트하는 방법은 무엇입니까?

   동일한 스크립트를 사용하여 각각 2~3개의 이미지 버전을 생성하고, 규모를 확대하기 전에 적은 예산을 사용하여 데이터를 비교합니다.

## 요약 및 다음 단계

이제 게시 가능한 디지털 음성 방송 비디오를 독립적으로 제작할 수 있게 되었으며, 다국어 대량 생산 및 규정 준수의 핵심 사항을 숙지하게 되었습니다. 먼저 작은 배치로 3~5개의 항목을 검증하고 실제 데이터(완성, 상호 작용, 변환)를 사용하여 다양한 이미지와 스크립트 스타일을 비교하는 것이 좋습니다. 안정적인 모델을 실행한 후에는 디지털 휴먼 또는 프로그래밍 방식 생산 라인을 사용자 정의하는 것을 고려할 수 있습니다.

## 고도화 및 확장

- 맞춤형 디지털 휴먼: 전용 이미지와 음성을 녹음하여 브랜드 인지도를 높입니다.
- 라이브 방송 디지털 피플 : 녹음 및 방송부터 실시간 대화형 고객 서비스 및 전달까지.
- 프로그래밍된 생산: 스크립트 라이브러리 + 예약 생성 + 자동 릴리스를 사용하여 조립 라인을 구성합니다.
- 콘텐츠 매트릭스: 다중 계정, 다중 언어, 다중 이미지 조합 및 데이터 피드백 주제 선택.

사용자 후기

  • 후기를 불러오는 중...