VOICE CLONE — 2026.08
僕の声、どっちが本物?
自分の声を2時間半ぶん学習させて、AIのクローン音声を作りました。 同じ文章を3つの声が読んでいます。どれが本物か、当ててみてください。
音声 A
音声 B
音声 C
答えを見る
- 音声A:AIクローン(Eleven v3・タグ演出+整音)— 採用した声。抑揚はタグで演出
- 音声B:本物(マイク録音)— 学習用に朗読した音声の冒頭
- 音声C:AIクローン(Multilingual v2)— いちばん本人の声に近い。でも棒読み気味
意外だったこと。本人の声にいちばん近いのはv2でした。でも少しAIっぽくないですか?カタコトだし。 v3は声は少し似てないですが、オーディオタグで抑揚をつけられます([明るく])。 私が採用したのはv3です! 聞く人が求めているのは「本人らしさ」ではなく「聞きやすさ」ですよね〜。
この声で、10分の教材動画を撮影ゼロ・編集ゼロで作っています。 原稿を書いて生成するだけ。読み間違い(「表」を「おもて」と読む等)は、 原稿をひらがなに直すだけで解決しました。
※悪用防止のため、声のモデル自体は非公開にしています。