> ## Documentation Index
> Fetch the complete documentation index at: https://www.vozo.ai/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# はじめに

> あなたの写真と音声入力を使って、ポートレートをおしゃべり動画にする方法を学びます。

## プロジェクトを作成

はじめに、**工作台**に移動し、**おしゃべり動画生成 - 写真から開始**をクリックしてください。

これにより、アップロードダイアログが開き、画像ファイルをドラッグ＆ドロップするか、クリックしてアップロードできます。

音声は複数の方法で入力できます：

### テキストから音声へ

スクリプトがあり、テキストから音声を生成したい場合は、このオプションを選択してください。

<Steps>
  <Step title="言語と声を選択">
    ドロップダウンから希望する言語と声を選択します。リストにある声に満足できない場合は、\_「ライブラリからさらに選択」\_をクリックして、より多くのオプションを探索してください。

    <Tip>
      **クローン音声を使用する：**

      \_「ライブラリからさらに選択 > クローン音声 > 新しい声をクローン」\_をクリックし、指示に従って音声をアップロードまたは録音してカスタム音声を作成します。
    </Tip>
  </Step>

  <Step title="スクリプトを入力">
    スクリプトを入力し、再生ボタンをクリックしてプレビューします。
  </Step>
</Steps>

### 音声をアップロード

音声ファイルがすでにある場合は、このオプションを選択して直接アップロードしてください。

## プレビューとダウンロード

動画が生成されたら、プロジェクトページで結果を直接プレビューできます。

動画をダウンロードするには、右上隅の**ダウンロード/エクスポート**ボタンをクリックします。

## よくある質問

<AccordionGroup>
  <Accordion title="エクスポートされた動画はどの解像度とエンコーディングを使用していますか？">
    * **解像度**：**720p**でエクスポート。システムは入力画像に基づいて最も適切なアスペクト比を自動的に選択し、固定解像度で出力します。可能な解像度は以下の通りです：
      * **16:9** → 1248×704
      * **4:3** → 1120×832
      * **1:1** → 960×960
      * **3:4** → 832×1120
      * **9:16** → 704×1248
      * **21:9** → 1504×640
    * **フレームレート**：**25fps**に固定
    * **エンコーディング**：**H.264**
    * **ビットレート**：通常約**1100 kb/s**、コンテンツに応じて**1000–2000 kb/s**の範囲で動的に変動
  </Accordion>

  <Accordion title="Talking Photoの料金はいくらですか？">
    詳細な料金規則については、[AIツールのポイント利用規則](/docs/common/tools-points-rules#talking-photo)ページを参照してください。
  </Accordion>
</AccordionGroup>
