musely
同意必須

音声クローン:短い録音を何度でも使える声に変える

音声クローンは、誰かの話し声のサンプルから、入力したテキストをそのまま読み上げられる合成音声を作り出す技術です。Muselyでは10秒から5分のクリアな音声と、利用許可があることのご確認だけで作成できます。完成した声はライブラリに名前付きで保存され、39言語に対応し、Muselyのすべてのテキスト読み上げツールでご利用いただけます。

1

音声サンプルを追加

MP3、M4A または WAV · 10 秒〜5 分 · 最大 20MB

音声をアップロード

MP3、M4A または WAV · 10 秒〜5 分 · 最大 20MB

より良い結果のために:一人がはっきりと自然に話してください。BGMや雑音は入れないようにしましょう。

詳細設定(オプション)

2

音声に名前をつける

無断で声をクローンされた?報告する

クローンされた声

クローン音声のプレビューがここに表示されます

更新日: 2026年8月15日
10s最低サンプル長
39対応言語数
~30s音声作成までの時間
200音声1つあたりのクレジット
Musely 音声クローンとは?

音声クローンとは、実在する人の話し声の録音から合成音声を作り出すプロセスです。Musely 音声クローンは、何時間ものスタジオ録音ではなく、たった1つの短いサンプルからこれを行います。10秒から5分の音声をアップロードし、同意を確認するだけで、約30秒で音声が完成します。あらかじめ用意された音声ライブラリから選ぶ通常のテキスト読み上げとは異なり、ここでの声はご自身が提供したものです。

仕様

音声クローンに必要なものと得られるもの

サンプル音声

長さ10秒〜5分
サイズ最大20MB
対応形式MP3、M4A、WAV
音質話者1人、ノイズ最小限、BGMなし

生成される音声

完成までの時間約30秒
対応言語1つの声で39言語
保存期間削除するまでライブラリに保存
利用範囲アカウント内のすべてのMuselyテキスト読み上げツールで使用可能

正直に伝える限界

アクセントサンプルのアクセントがそのまま引き継がれ、言語ごとに変化しません
感情表現の幅ナレーションと会話調がもっとも得意です
歌唱非対応
オフライン利用非対応(生成はすべてサーバー側で行われます)

料金プラン

音声1つあたりの料金作成時に一度だけ200クレジット
Creatorプラン$19.9/月、アクティブな音声5つ
Businessプラン$99.9/月、アクティブな音声20
Freeプランシステム音声のみ利用可能、クローン機能は含まれません
仕組み

音声クローンの流れ

1

使用権のあるサンプルを用意する

もっとも重要な要素です。1人の話者による10秒から5分の音声を、MP3、M4A、WAVのいずれかで、20MBまでの範囲でご用意ください。長さよりも音質のクリアさが重要です。部屋の反響、BGM、複数人の声の重なりは、いずれもクローンの品質を下げる原因になります。

2

同意を確認する

音声を作成する前に、話者本人の許可を得ていることをご確認いただきます。ご自身以外の声を使う場合は、必ず書面で許可を取得してください。同意なく他人の声を複製した場合の法的リスクは実在し、法域によって異なります。

3

音声に名前を付ける

後で見てすぐ分かる名前を付けましょう。「voice 3」のような名前より「ナレーション・温かみのある声」のような名前がおすすめです。著名人など高リスクな人物名と一致する名前は登録できません。

4

何度でも生成できる

作成した音声は保存されます。原稿を入力し、39言語の中から選んで生成するだけです。料金は音声の作成時に一度だけかかり、文章ごとに課金されることはありません。

活用例

音声クローンが選ばれる理由

作家

自分の声で本を朗読する

クリアな1分間の録音をもとに、体力的に自分では読み切れなかった章をクローンに朗読してもらいました。

講師

録り直しなしで講座音声を更新する

教材の内容が変わったときも、録音の予約を取り直す代わりに文章を打ち直すだけで済みます。

ブランドマーケター

すべてのチャネルで同じ声を使う

広告も、説明動画も、電話の自動応答も、すべて同じ声で統一できるようになりました。以前は予算的に不可能でした。

家族の記録係

大切な声を残す

母の許可を得て声をクローンしました。将来、子どもたちが母の声で読み聞かせを聞けるようにするためです。

支援技術ユーザー

自分らしい声で話す

既存の合成音声は自分の声とはまったく違いました。この声は自分らしく、入力した文章をそのまま読み上げてくれます。

動画プロデューサー

出演者の声を他言語にも展開する

出演者が英語で一度録音すれば、同じ声でスペイン語版やドイツ語版も制作できます。

比較

音声クローンサービスの比較

項目MuselyElevenLabsResemble AIPlayHT
各社が公表する最低サンプル長✓ 10秒⚠ プランにより異なる⚠ プランにより異なる⚠ プランにより異なる
クローン作成前の同意確認✓ 音声ごとに履歴付きで必須✓ 必須✓ 必須✓ 必須
1つのアカウントで他ツールでもクローン音声を再利用可能✓ 可能、すべてのMuselyテキスト読み上げツールで⚠ 自社製品内のみ⚠ 自社製品内のみ⚠ 自社製品内のみ
1つのクローン音声が対応する言語数✓ 39⚠ 要確認⚠ 要確認⚠ 要確認
対応するアップロード形式✓ MP3、M4A、WAV✓ 一般的な音声形式✓ 一般的な音声形式✓ 一般的な音声形式
定額の月額プランにクローン機能が含まれる✓ 含まれる、Creator $19.9/月⚠ 段階制プラン⚠ 従量課金制⚠ 段階制プラン
事前に明示されるアクティブな音声数の上限✓ Creatorで5、Businessで20⚠ プランにより異なる⚠ プランにより異なる⚠ プランにより異なる
競合サービスの情報は2026年8月時点の各社公開情報に基づいており、頻繁に変更されます。ご検討の際は各社の最新ページをご確認ください。
レビュー

日常的にクローンを利用する方の声

クローンが役立つ場面と、そうでない場面についての率直な感想です。

★★★★★

本当に10秒で十分でした。スタジオ収録が必要だと思っていましたが、その必要はありませんでした。

AU
美和
作家
★★★★★

1つの声をアカウント内のすべてのツールで使い回せることが、クローン作成そのもの以上に時間の節約につながっています。

VP
動画プロデューサー
★★★★☆

ナレーションには非常に優れています。ただ、叫び声や泣き声などの表現は、まだ機械っぽさが残ります。

LC
講師
よくある質問

音声クローンに関する質問

音声クローンとは、実在する人の話し声の録音から合成音声を作り出す技術で、その声は実際には話していない文章も読み上げられるようになります。Muselyを含む最新のシステムでは、従来のシステムが必要としていた何時間ものスタジオ録音の代わりに、短いサンプル(わずか10秒で十分です)から音声を作成できます。

10秒から5分の間です。長さよりも音質のほうがはるかに重要です。話者は1人、背景ノイズは最小限に、BGMは入れないようにしてください。ノイズの多い5分間のサンプルよりも、クリアな30秒のサンプルのほうが良いクローンを生み出すことがほとんどです。

ご自身の声をクローンする場合はシンプルです。他人の声をクローンするには本人の許可が必要で、同意なく行うとパブリシティ権、生体データに関する法律、詐欺関連の法律に抵触する可能性があります(地域によって異なります)。Muselyでは音声の作成前に同意の確認を求めています。ご自身以外の声を使う場合は、必ず書面で許可を取得してください。

はい。1つのクローン音声で、39言語のいずれでもテキストを読み上げることができます。ただし、元のサンプルのアクセントはそのまま引き継がれるため、英語のサンプルでスペイン語を読み上げると、英語話者がスペイン語を話しているように聞こえます。その言語のネイティブらしい発音が必要な場合は、その言語のストック音声を選ぶほうが適していることが多いです。

音声の作成には200クレジットが一度だけかかります。クローン機能はCreatorプラン($19.9/月、アクティブな音声最大5つ)とBusinessプラン($99.9/月、最大20)に含まれています。FreeプランとProfessionalプランにはストック音声によるテキスト読み上げが含まれますが、クローン機能は含まれません。

歌うことはできません。言語ごとにアクセントが変わることもありません。叫び声や号泣、激しい演技表現など、感情の振れ幅が大きい表現は、まだ機械的に聞こえます。ナレーション、説明動画、会話調の読み上げがもっとも得意で、多くの方が必要とする用途はこれらでカバーされます。