YupVox Logo
YupVox
AIボイスクローニング・スタジオ

あなただけの声を 99%の高精度再現 わずか数秒で生成

Zero-Shot深層学習が50以上の音響特徴量を抽出し、声の温かみや自然な息づかいを忠実に再現。あなたの声そのままに100以上の言語を流暢に話せます。

料金プラン

クレジットカード不要 • 新規登録で50,000クレジット進呈

スタジオリアルタイムプレビュー最新のニューラル音声クローニング技術
https://yupvox.com/dashboard/voice-cloning
1

音声サンプル登録

2

AIモデル学習

3

試聴&微調整

4

ライブラリに保存

音声サンプル登録

音声ファイルをここにドラッグ&ドロップ

またはクリックして選択

MP3, WAV, M4A, FLAC (Recommend 1–10 minutes)

my-voice-sample.wav

03:24 · 12.5 MB

推奨音声基準
クリアな発声、暗騒音のない静かな環境
推奨収録時間:1〜10分
単一話者の音声(最高品質)
自然な抑揚と豊かな表現力
BGMや強いリバーブ・エフェクトは避けてください
デモ音声サンプル
男性ナレーション男性ナレーション
00:45
女性日常会話女性日常会話
00:38
アニメキャラクターアニメキャラクター
00:32
熟年男性トーン熟年男性トーン
00:40
AIモデル学習ステータス
68%

あなたのデジタル音声を生成中...

AIが音響特徴量を抽出し、あなたの固有のトーンを学習しています。

音声ファイルの受信完了
音響スペクトルの解析完了
+ニューラルモデルの学習68%
音質の最適化と出力準備待機中
推定所要時間

2–5 分

モデル種別

High Quality (HQ)

Training...
試聴&音色の一致度評価
原音 (Original)00:00 / 00:12
クローン音声 (Cloned)00:00 / 00:12
96%
音色の一致度96%
音高の再現性94%
自然な呼吸と抑揚92%
感情表現力90%
クローン済みボイス一覧
自分の声 (My Voice)

自分の声 (My Voice)

たった今

HQ多言語対応
女性 - 穏やか

女性 - 穏やか

2日前

HQ温かみ
アニメ風ヒロイン

アニメ風ヒロイン

5日前

HQキャラクター
熟練ナレーション

熟練ナレーション

1週間前

HQナレーション
青年ボイス

青年ボイス

2週間前

HQ日常会話
モデルパラメータ設定
品質モード
発音の安定度80%
原音忠実度ブースト90%
トーンスタイル
対応言語
Text to Speech で発話をテスト
73 / 500
読み上げ言語🇺🇸 English (US)
保存して制作に活用

クローン音声は「マイボイス」に保存され、TTSや動画吹き替えなどすべての機能で即座に利用可能です。

従来の課題

スタジオ録音や旧型AIクローンの限界と課題

何時間ものスタジオ拘束と高額な費用。従来のAIは平坦で金属質な機械音になりがちでした。

1

莫大なスタジオ費用とスケジュール拘束

原稿修正のたびにスタジオを再予約し、高価な機材とプロの声優の手配に多大なコストが発生します。

スマホで録音した10〜30秒の音声から一生使えるデジタルクローンを即座に作成
2

旧世代AIの機械的な金属音と不自然なイントネーション

古いモデルは声質が平坦で金属質なノイズが混ざり、人間の微細な声帯の響きや呼吸感が失われていました。

Zero-Shotモデルが声帯の響き、温かみ、呼吸のリズムを99%の精度で忠実に保存
3

海外展開における言葉の壁と発音の限界

YouTubeやポッドキャストを英語、中国語、スペイン語で配信したくても、流暢なネイティブ発音は困難です。

多言語AI合成:あなたの声質のまま100以上の言語をネイティブ級に流暢に発話
ご利用の流れ

わずか10秒の音声サンプルから3ステップでクローン完成

クラウドGPUによる高速処理で、最高精度の音質を維持しながら即座に音声合成へ適用可能。

01

10〜60秒の音声をアップロード

スマートフォンで録音したファイル(MP3、WAV、M4A)をドラッグ&ドロップするか、マイクで直接録音。

02

瞬時のニューラル解析と学習

高性能GPUが50以上の声帯ベクトル、フォルマント周波数、抑揚パターンを瞬時に抽出。

03

波形比較とTTSツールでの即時利用

原音とAI音声の波形を並べて試聴確認。完成した声で自由な原稿から高品質音声を生成。

スタジオの技術仕様

次世代AIボイスクローニングの先進機能

あなたの声のデジタルIDを作成・調教し、商用コンテンツへフル活用するための全機能。

99%の驚異的な声色再現度

類似度99%

声帯の微細な共鳴、ハスキーさ、音高のダイナミクス、発音の癖まで丸ごとキャプチャ。

1つの録音から100以上の言語に対応

100以上の言語

日本語のサンプル1つで、英語、フランス語、中国語、韓国語などをネイティブ同等の発音で発話可能。

完全暗号化によるプライバシーと所有権保護

完全非公開

作成された音声モデルは企業水準の暗号化で保護され、アカウントに厳密に紐付け。外部共有されることはありません。

豊かな感情表現と多彩な発話スタイル調整

多彩な感情表現

朗読ナレーション、日常会話、エネルギッシュなショート動画向けなど、多様な感情プリセットを選択可能。

従来手法との徹底比較

Yupvox AIボイスクローン vs 従来スタジオ録音・旧世代AI

Yupvoxの最新Zero-Shot深層学習と旧世代ツールの実力差を項目別に比較。

比較項目Yupvox AI Voice Clone ⚡従来スタジオ録音・旧世代AI ⏱️
必要な録音サンプルの長さスマホで録音した10〜30秒の短尺音声で十分数時間〜数十時間の大規模なプロスタジオ録音が必要
声のリアル感・自然な呼吸音99%の高い再現度で声帯の響きと自然な息づかいを完全維持平坦で金属音が混ざるロボット声、息継ぎがなく不自然
多言語クロスリンガル発話力本人の声質のまま100以上の言語を流暢にネイティブ発話録音した元の言語でしか発話できず他言語は不可
モデルの学習・生成にかかる時間高速クラウドGPUにより30秒以内に即座に生成完了24〜72時間以上待たされるか手動審査の待ち時間が発生
セキュリティと声の権利保護アカウント専用のエンドツーエンド暗号化で完全保護音声データの流出リスクや公開モデルへの無断混入の懸念
YupVox pricing

YupVox AI サービス料金プラン

柔軟なクレジット体系、隠れた費用なし。いつでもアップグレード・解約可能。

🔥 Launch Offer: 50% OFF 1st Month!
Use code LAUNCH50 for 50% OFF your first month.

Free

無料
$0/ 月
50.000
クレジット / 月
Usage Equivalent:
TTS:50,000文字
Audio Dub:~16.5分
Video Dub:~8.3分
無料登録で50,000クレジット進呈
1回あたり最大3,000文字
300の標準AI音声を利用可能
22種類の無料オンライン音声ツール
標準クラウド処理速度

Lite

ライト
$1.0$2
/ 月
With code LAUNCH50 (1st Month)
99.000
クレジット / 月
Usage Equivalent:
TTS:99,000文字
Audio Dub:~33分
Video Dub:~16.5分
99,000 クレジット / 月
1回あたり最大50,000文字
最大20個のオリジナル音声をクローン作成
3,000以上のプレミアムAI音声をすべて解放
標準クラウド処理速度
APIアクセス

Starter

スターター
$4.5$9
/ 月
With code LAUNCH50 (1st Month)
999.000
クレジット / 月
Usage Equivalent:
TTS:999,000文字
Audio Dub:~333分(約5.5時間)
Video Dub:~166.5分(約2.7時間)
999,000 クレジット / 月
1回あたり最大100,000文字
最大100個のオリジナル音声をクローン作成
3,000以上のプレミアムAI音声をすべて解放
高速処理プライオリティ
APIアクセス
一番人気

Growth

$9.5$19
/ 月
With code LAUNCH50 (1st Month)
2.499.000
クレジット / 月
Usage Equivalent:
TTS:2,500,000文字
Audio Dub:~833分(約13.8時間)
Video Dub:~416.5分(約6.9時間)
2,499,000 クレジット / 月
1回あたり最大100,000文字
最大500個のオリジナル音声をクローン作成
字幕から音声への自動吹き替えツール
最優先処理帯域幅
APIアクセス

Pro

プロ
$14.5$29
/ 月
With code LAUNCH50 (1st Month)
3.999.000
クレジット / 月
Usage Equivalent:
TTS:4,000,000文字
Audio Dub:~1,333分(約22.2時間)
Video Dub:~666.5分(約11.1時間)
3,999,000 クレジット / 月
1回あたり最大100,000文字
最大1,000個のオリジナル音声をクローン作成
字幕から音声への自動吹き替えツール
APIアクセス&専任1対1技術サポート
APIアクセス
Transparent Credit Conversion Formula

How Much Content Can You Create With 1 Plan?

All Yupvox tools share a unified credit balance. You can freely allocate credits across TTS, Audio, and Video dubbing.

Text to Speech (TTS)

1 Credit = 1 Ký tự

99,000 credits = ~99,000 characters (~16,500 words, ~25 book pages or ~2 hours of narration).

Audio Dubbing

50 Credits / giây (3.000 / phút)

99,000 credits = ~33 minutes of multi-speaker AI audio translation & expressive voice dubbing.

Video Dubbing & Sub

100 Credits / giây (6.000 / phút)

99,000 credits = ~16.5 minutes of AI video dubbing, subtitle masking & 4K MP4 re-rendering.

💡 Swipe horizontally to view all plans⇄
PlanCredits / CycleText to SpeechAudio DubbingVideo Dubbing
Free ($0)50,00050,000 文字 (~1h)~16.6 分~8.3 分
Lite ($1.0 / $2)99,000 / 月99,000 文字 (~2h)~33 分~16.5 分
Starter ($4.5 / $9)999,000 / 月1,000,000 文字 (~20h)~333 分 (約 5.5h)~166.5 分 (約 2.7h)
Growth ($9.5 / $19) ⭐2,499,000 / 月2,500,000 文字 (~50h)~833 分 (約 13.8h)~416.5 分 (約 6.9h)
Pro ($14.5 / $29)3,999,000 / 月4,000,000 文字 (~80h)~1,333 分 (約 22.2h)~666.5 分 (約 11.1h)

ボイスクローニングに関するよくある質問

最高品質のクローン音声を作成するにはどのような音声を録音すべきですか?

静かな部屋でスマートフォンのマイクやヘッドセットを使い、10〜60秒間自然なトーンで話すだけで十分です。ファンの音などのノイズを避けてください。

作成したクローン音声のセキュリティと著作権は安全ですか?

Yupvoxは厳格なユーザー隔離暗号化を適用。あなたの音声モデルはお客様のアカウントにのみ紐付けられ、一般モデルの学習や外部公開に使用されることは一切ありません。

クローン音声はどの言語を発音できますか?

Zero-Shotクロスリンガル合成により、1つの録音から英語、日本語、韓国語、中国語、フランス語、スペイン語など100以上の言語に対応可能です。

クローン音声の学習と生成にはどのくらいの時間がかかりますか?

Yupvoxの高性能GPUクラスターが音響特徴量を抽出し、30秒以内に音声モデルを初期化。すぐにWebブラウザ上で試聴・生成できます。

商用動画や収益化コンテンツにクローン音声を使用できますか?

もちろんです!生成された全音声について100%の商用利用権を保持。YouTube、TikTok、Web広告、オンライン講座、ポッドキャスト等に自由にお使いいただけます。

30秒でスタート

あなただけのAIデジタル音声を今すぐ手に入れよう

無料登録で50,000クレジット進呈。10秒の音声をアップロードして、あなたの声で世界中に届くコンテンツ制作を始めましょう。

料金プラン一覧を見る