テキストから MP3 音声へ:正しく再生できる音声を書き出す
短い原稿から MP3 音声を作成します。全セクションを変換する前に、発音、再生、取り込み先アプリのファイル要件を確認しましょう。

3 ステップで動画用音声の制作手順を組み立てる
実際の素材から始め、条件を揃えたテストを一度行い、完成した音声を動画と合わせて確認してから規模を広げます。
音声の用途を選ぶ
動画に必要なのが声、音楽、効果音、同期、既存の音源のどれかを判断します。
短いテストを生成する
選んだモデルや編集ソフトで、代表的な一場面を条件を揃えて試します。
最終ミックスを確認する
実際に納品する動画で、タイミング、明瞭さ、権利、書き出しの動作を確認します。
再生確認用の一文を準備する
製品名、日付、文末の間を含む講座の紹介文を使います。発音の指示は、選んだモデルのドキュメントに記載された制御項目に設定してください。珍しい名前は、本番用に原稿を分割する前に実際に聞いて確認する必要があります。長い番組は名前を付けたセクションに分けます。一語だけ間違っていても、巨大な単一ファイルでは修正が難しくなります。原稿の版を音声ファイルと一緒に保存し、編集者がどの文章を読み上げたか確認できるようにしてください。
取り込み先に合わせて MP3 を選ぶ
取り込み先アプリのファイル要件によって、エンコード、長さ、容量、音量の条件が決まります。ライブラリを変換する前に確認してください。Seed Speech TTS 2.0 は Opus にも対応しています。MP3 を求める取り込み先には MP3 を、Opus を求める処理には Opus を選びます。どちらの形式も読み上げ内容の誤りは修正しません。ダウンロードしたファイルを最初から最後まで再生してください。冒頭のクリッピング、末尾の途切れ、途中の発音と速度を確認します。API の成功応答が示すのはジョブの完了です。その音声をポッドキャスト配信や学習プラットフォームで使えるかどうかは、再生確認で判断します。
編集工程を分けて考える
音声合成で作成するのは声のファイルです。ポッドキャストのマスタリングや音楽とのミックスには、音量、フェード、タイミングを制御できる別の編集ソフトが必要です。一般的な文書からファイルへの変換は変換ページを参照してください。原稿を修正したら該当セクションを再生成し、隣接するファイルとのつなぎ目を聞いて確認します。版を含むファイル名と順序付きのセクションによって、古いテイクが最終編集に混ざるのを防げます。
確実な書き出しと受け渡しを記録する
承認済み原稿、音声設定、MP3 ファイル、確認担当者、取り込み先アプリを保存します。繰り返し使う場合、API 連携でセクションを送信し、結果を追跡して、承認済みファイルをコンテンツ管理システムに配置できます。ナレーターを選ぶ際は音声選択ガイドを参照してください。
次の作業に進む
よくある質問
参照した音声モデルは MP3 に対応していますか?+
はい。Seed Speech TTS 2.0 のドキュメントには MP3 が出力形式として記載されています。
MP3 なら正しい発音が保証されますか?+
いいえ。名前、数字、間を聞いて確認してください。ファイル形式は読み上げ内容を修正しません。
TTS のリクエストで音楽をミックスできますか?+
この音声エンドポイントにはミックス用の制御が記載されていません。音声編集ソフトで声のファイルと音楽を組み合わせてください。
長い原稿を分割するのはなぜですか?+
セクションに分けると、修正、確認、ファイルの差し替えが管理しやすくなります。