スクリプトを、リアルなAIプレゼンターに変えてみませんか?このステップバイステップガイドでは、VisionStoryで初めてのAIトーキングアバター動画を作る方法を解説します。アバターを選び、言葉を入力し、音声を選んで、数分で洗練されたトーキング動画を生成できます。上の解説動画を見たら、以下の手順に沿って進めましょう。
Step 1: アバターを選ぶ/作成する
AI動画を開き、誰に話してもらうかを決めましょう。アバターは次の3つの方法で用意できます。
- 内蔵アバターを選ぶ:VisionStoryの既成の公開キャラクターから選択。最速で始められます。
- 自分の写真をアップロード:正面向きで鮮明な画像を追加し、実在の人物をトーキングアバターに変換します。
- アバターを生成:テキストプロンプトから、まったく新しいキャラクターを作成します。
選択したアバターは、いつでもChange Lookで調整できます。

Step 2: スクリプトを追加
アバターに話してほしい内容を指定します。右側のパネルで、音声の用意方法を選びましょう。
- Script:アバターに話させたい文章を入力し、AIに音声を生成させます。
- Import:事前に録音した音声ファイルをアップロードして、動画を動かします。アバターのAIリップシンクが録音に追従します。
- Record:VisionStory内で直接、自分の声を録音します。
最初は短めのスクリプトにして、仕上がりを素早く確認しましょう。
Step 3: 音声を選ぶ
各アバターにはデフォルトの音声が設定されていますが、変更できます。
- Voice Library:ライブラリを開いて88言語・1,000+の音声をチェック。検索で欲しい音声をすぐ見つけられます。
- 声をクローン:自分の録音の短いサンプルから、カスタムAI音声を作成できます。
- プレビュー&補正:Preview Audioで生成前に音声を確認し、Voice Enhanceで音をクリアに整えられます。

Step 4: 動画モデル・解像度・オプションを選ぶ
生成前に、動画の見た目を設定します。
- Video Model:VisionStoryは、自然なリップシンクと表情表現のために、最新のトーキングアバターモデル「V-Character 4.0」を使用します。
- 解像度:公開先に合わせて720P、1080P、または2Kを選択します。
- アスペクト比:プラットフォームに合わせて、9:16(縦)、16:9(横)、1:1(正方形)を切り替えます。
- グリーンスクリーン動画:編集で背景を差し替えたいときだけオンにし、単色背景で出力します。
- Motion:アバターの動きの大きさを調整し、よりダイナミックな話し方にできます。
Step 5: クレジットを確認して生成
VisionStoryは、生成前にコストを表示します。
- クレジット詳細:「クレジット詳細」を展開すると、合計の計算方法を確認できます。コストは選択した解像度と長さによって変わります(例:60秒の720P動画は15クレジット)。
- Generate Talking Video:問題なければ「Generate」をクリック。VisionStoryがアバターをアニメーション化し、台本に合わせて口元と表情を同期させます。
Step 6: 動画を確認・共有・管理
処理が完了すると、動画はAssetsに表示され、次の操作ができます。
- 完成版をプレビューし、整理しやすいように名前を変更できます。
- MP4をダウンロードするか、どこにでも投稿できる共有リンクをコピーできます。
- XやFacebookなどのSNSへ直接共有できます。
- 不要な動画を削除できます。
以上で、初めてのAIトーキングアバター動画が完成です。ここから、別のアバターを試したり、自分の音声をクローンしたり、プロジェクトの成長に合わせてより高解像度で書き出したりしてみましょう。
