デジタル ライブ ブロードキャスト ビデオ制作に関する乳母レベルのチュートリアル: 台本から多言語フィルムまで
🛒 運営やコンテンツの初心者向けに、テーマ選定から多言語映像制作までワンストップでお手伝いいたします。
チュートリアルの目的
このチュートリアルでは、例として HeyGen を取り上げ、スクリプトから開始し、公開可能なデジタル音声ブロードキャスト ビデオを完成させ、多言語バージョンをバッチ作成する方法を学習します。プロセス全体の手順に従うだけで、編集の経験は必要ありません。
準備チェックリスト
- [ ] HeyGen アカウント (または Synthesia などの同様のツール) を登録し、無料割り当てを確認します。
- [ ] 100 ~ 200 ワードの音声スクリプトを準備します (AI 支援により生成可能)。
- [ ] ビデオの目的と形式を決定します。横バージョン (16:9) は Bilibili/YouTube に適しており、縦バージョン (9:16) は Douyin/ビデオ アカウント/Kuaishou に適しています。
- [ ] ブランド関連素材(ロゴ、背景画像、音声字幕コピー)を準備します。
- [ ] 使用する画像のソースを確認します。プラットフォーム独自の画像、または許可した音声/画像素材です。
ステップ 1: 音声スクリプトを作成する
口頭ブロードキャストのスクリプトは、「フック - 本文 - 行動喚起」の構造に従います。
【フック】短い動画を作るのは難しいと思っている人も多いですが、実は方法は一つだけ。
[本文] 今日は、3 つのステップを使用して、コピーライティングを音声ビデオに変換します。
[CTA] 体系的に学習したい場合は、コメント欄に「チュートリアル」と返信してください。完全なリストをお送りします。
「」
書き方のポイント:
- 口頭放送や字幕を容易にするために、各文は 20 単語までに制限する必要があります。
- 口語的にし、書き言葉のアクセントや長い句を避けてください。
- 「キーの一時停止」または「字幕の強調」が必要な場所を示します。
### 口頭ブロードキャスト スクリプト テンプレートの例 (直接適用可能)
```テキスト
[フック] コンテンツを作るときに一番怖いのは、書けないことではなく、書いても誰も読んでくれないことです。
【苦労点】 夜更かしして台本を書いて何十回も録画しても、再生回数が二桁のままという経験はありませんか?
【方法】 今回は、まずAIを使って原稿を一括制作し、次にデジタルヒューマンを使ってフィルムを一括制作する方法を紹介します。 1週間分の仕事を1日で生み出すことができます。
【詳細】 まず、テーマ選定は「ペインポイント+シナリオ」で行うべきです。第二に、台本は短く口語的である必要があります。第三に、統一された画像を使用して、連続的に出力し、メモリポイントを確立します。
【CTA】完全なスクリプト テンプレートを入手したいですか?コメント欄に「デジタルマン」と返信していただければテンプレートをお送りします。
「」
この構造は、製品紹介、知識の普及、イベントのプロモーションなど、ほとんどの口頭ブロードキャスト シナリオに適しており、コンテンツの置き換えに直接使用できます。
## ステップ 2: デジタル ヒューマン ビデオを生成する
1. HeyGen の「ビデオの作成」に入り、「アバター (デジタル ヒューマン イメージ)」を選択します。
2. 水平または垂直フォーマットを選択します。
3. スクリプトをテキスト ボックスに貼り付け、言語を設定します (デフォルトは中国語)。
4. 画像と音声を選択:デフォルトの画像である「自然な話し方とはっきりとした口の形」を優先します。
5. 「生成」をクリックし、生成されるまで待ちます (通常は数分)。
チェックポイント:口の形は正しいか、話すスピードは自然か、最後に明確な間があるか。
## ステップ 3: 音声と話す速度を調整する
- 話す速度: デフォルトは 1.0 ですが、物品や乾物を運ぶ場合は 1.1 ~ 1.2 に調整できますが、1.3 を超えないようにしてください。そうしないと、口の形が同期しにくくなります。
- 一時停止: スクリプトにカンマ/ピリオドを挿入して、文を自然に区切ります。強調する必要がある箇所で新しい文を始めます。
- サウンドの変更: 満足できない場合は、サウンドリストを切り替えてから再生成します。
## ステップ 4: 字幕と背景を追加する
1.「自動字幕」をオンにして、字幕のスタイルと位置を選択します。
2. 背景を追加する: 単色、ブランド イメージ、またはぼかした背景を使用できます。
3. ブランドロゴとエンディングアクションガイドを追加します(後から編集ソフトで加工可能)。
字幕の提案: キー番号と CTA に強調表示された色を使用して、完了率を高めます。
## ステップ 5: 多言語バッチ生成
1. プロジェクト内の元のビデオをコピーし、「再生成」を選択します。
2. 言語をターゲット言語(英語、日本語など)に切り替えます。
3. プラットフォーム翻訳を使用するか、手動校正後に翻訳されたテキストを貼り付けます (高品質を得るには後者をお勧めします)。
4. すべての言語バージョンをバッチでエクスポートします。
注:ブランドセンスを損なう「直訳」を避けるため、翻訳後は必ず発音や用語を確認してください。
## ステップ 6: コンプライアンスとプラットフォームの適応
投稿する前に確認してください:
- [ ] 「AI 生成コンテンツ」注釈をオンにします (プラットフォームの要求に応じて)。
- [ ] 口頭放送台本には、絶対的な条件や違法な約束(広告法)は含まれていません。
- [ ] 使用されている画像と音声は認可されたソースからのものです。
- [ ] ターゲット プラットフォームの仕様に従ってエクスポートします (Douyin 縦バージョン 1080×1920、サイト B 横バージョン 1920×1080)。
## ステップ 7: リリースとデータのレビュー
1. 公開後、完了率、3 秒間の直帰率、インタラクション率に注目します。
2. 異なる画像、話速、表紙のデータを比較します。
3. データ フィードバックをスクリプト ライブラリに書き込み、次のバッチを繰り返します。
### テンポの提案を投稿する
- 開始期間: 週に 3 ~ 5 アイテム、さまざまなフックとイメージをテストします。
- 安定期: トピック選択の方向性を上回るパフォーマンスに重点を置き、週に 2 ~ 3 つの記事を固定します。
- レビューテーブル: 各ビデオのビデオ、再生、完了、インタラクション、変換を記録し、2 週間ごとに傾向を確認します。
### マテリアルの命名とアーカイブの仕様
```テキスト
{日付}_{シリーズ}_{バージョン}_{言語}.mp4
例:20260815_製品紹介_v2_zh.mp4
「」
統一された名前により、チームのコラボレーションと多言語管理がより効率的になり、「最終バージョン v3 最終バージョン」の混乱が回避されます。
### チャンネル仕様のクイックチェック
|プラットフォーム |おすすめフレーム |推奨期間 |備考 |
|---|---|---|---|
| Douyin/ビデオアカウント | 9:16 縦バージョン | 30~60秒 |サビの最初の 3 秒が最も重要です |
|ステーションB/YouTube | 16:9 横バージョン | 1~3分 |情報密度が高く、字幕も追加可能 |
|小さな赤い本 | 9:16 垂直 | 40~90秒 |表紙もタイトルも重要 |
エクスポートする前に、二次トリミングによる画質の低下を避けるために、ターゲット プラットフォームに応じて対応する仕様を選択してください。
## 検証方法
・検証1:生成された動画の口の形と発音は基本的に一致しています。
・検証2:字幕に誤字はなく、Cビット情報が読み取れる。
- 検証 3: 多言語版はランダムにチェックされており、誤訳はありません。
- 検証 4: 完成したフィルムは AI アノテーションを完了し、プラットフォームのルールに準拠しています。
## よくある間違いと注意事項
1. スクリプトが長すぎます。1 つのスクリプトの口頭再生時間は 60 ~ 90 秒 (約 250 ~ 350 ワード) に制限する必要があります。長すぎるとすぐに終わってしまいます。
2. 話す速度が速すぎる: 1.3 倍速を超えると、口の形が崩れやすくなります。 1.25倍速で自分で読んでもらうのが良いでしょう。
3. 多言語直訳:厳格な翻訳を避けるために、海外版はネイティブスピーカーによる校正が必要です。
4. ラベルのない AI コンテンツ: ラベルを無視すると、アカウントが禁止される危険があるため、公開するときに必ず確認してください。
5. マテリアルの混乱: シリーズごとに脚本、マテリアル、および完成したフィルムのフォルダーを作成し、日付とバージョンを付けて名前を付けます。
## よくある質問とトラブルシューティング (FAQ)
1. 生成が遅すぎるか、キューに入れられていますか?
キューはピーク期間中は正常であり、事前にバッチで生成できます。無料割り当てが使い果たされてから待つか、アップグレードする必要があります。
2. 口の形が悪くて声がぎこちない?
より自然な画像と音声を選択し直し、話す速度を 1.0 に戻し、文章を短い文章に分割します。
3. ビデオには字幕が付いていますが、プラットフォームによって自動的に追加されます。これが繰り返されていますか?
エクスポート時にインライン字幕をオフにするか、代わりにプラットフォームの「自動字幕」を使用してください。
4. デジタルヒューマンの画像は外国人に見えますが、中国人の口の形は変ですか?
中国語で最適化された画像が優先されます。カスタム イメージには中国語素材の記録が必要です。
5. プラットフォームによって扱いや品質が低いと判断されましたか?
オリジナルのスクリプトを確保し、差別化された画像 (実写素材/アニメーショントランジションを追加) を確保し、AI 生成を標準化します。
6. 複数のイメージを低コストでテストするにはどうすればよいですか?
同じスクリプトを使用してイメージの 2 ~ 3 バージョンをそれぞれ生成し、スケールアップする前に少ない予算でデータを比較します。
## 概要と次のステップ
この時点で、公開可能なデジタル音声ブロードキャスト ビデオを独自に制作できるようになり、多言語の大量生産とコンプライアンスの重要なポイントを習得しました。最初に 3 ~ 5 個の項目を小さなバッチで検証し、実際のデータ (完了、インタラクション、変換) を使用してさまざまな画像とスクリプト スタイルを比較することをお勧めします。安定したモデルを使い果たしたら、デジタル ヒューマンやプログラムによる生産ラインのカスタマイズを検討できます。
## 進歩と拡大
- カスタマイズされたデジタル ヒューマン: 独自の画像と音声を記録して、ブランドの認知度を高めます。
- ライブブロードキャストのデジタル担当者: 録画とブロードキャストから、リアルタイムのインタラクティブな顧客サービスと配信まで。
- プログラム生産: スクリプトライブラリ + スケジュール生成 + 自動リリースを使用して組立ラインを形成します。
- コンテンツ マトリックス: 複数のアカウント、複数の言語、複数の画像の組み合わせ、およびデータ フィードバックのトピック選択。
ユーザーレビュー