100以上の言語に対応した4,000以上のAI音声で高品質なナレーションを生成。呼吸の間や感情表現を自在に調整し、同期SRT字幕付きの高音質320kbps MP3を出力。
クレジットカード不要 • 新規登録で50,000クレジット無料進呈
Auto-generate timestamped subtitle file (+15% credits)
Auto-normalize numbers & punctuation
台本の変更ごとにスタジオ代がかさみ、従来の音声合成はロボット調で感情が全く伝わりません。
台本を一行直すだけでもスタジオの手配や声優へのギャラで数万円の追加出費が発生します。
昔の音声合成は滑舌が悪く、喉の響きやブレス(息継ぎ)がないため感情が一切乗りません。
音声ファイルだけを出力すると、動画編集ソフトで各シーンの配置や字幕の再入力に何時間も取られます。
クラウド上で完全自動化。リアルな音声と同期字幕を数秒で手に入れられます。
YouTube、TikTok、オーディオブックの原稿を貼り付け。[pause]タグで自然な息継ぎの間を自由に挿入できます。
4,000以上の男女の声から選択。話速や音高を調整し、[laugh](笑い)や[sigh](ため息)などの感情タグを適用。
わずか1秒でブラウザプレビュー。高音質320kbps MP3音声と動画用SRT字幕ファイルを一括ダウンロード。
日本語、英語、ベトナム語、スペイン語、中国語、韓国語など、100以上の言語と4,000以上のネイティブアクセントを収録。放送基準のなめらかな発話を再現。
100カ国以上のネイティブアクセントと自然な地域イントネーションに対応。
性別、年齢層、地域アクセントなど、あらゆるジャンルの制作に最適な声を網羅。
温かみのある朗読、自然な日常会話、ドラマチックな強調まで自在に調整。
4,000以上のプリセットに加え、YupVoxならあなただけのデジタルボイスを作成可能。スマホで録音した3〜10秒の音声から、Zero-Shot Neuralモデルが50以上の音響ベクトルを抽出し、99%の忠実度で温かみのある声を再現。
語り口のリズム、呼吸の間、感情のニュアンス、必要なファイル形式の出力を細部まで制御。
[laugh](笑い声)、[sigh](ため息)、喉を鳴らす音など、人間の自然な身体反応を直接原稿に挿入可能。
話速を0.5倍から2.0倍まで細かく制御。TikTok向けのテンポ良いフックや落ち着いた朗読音声を作成できます。
最先端の多言語モデルにより、同一の声のキャラクターが世界100以上の言語を自然に話せます。
高音質320kbps MP3に加え、単語ごとの正確なタイムコードを持つ.SRT字幕を出力し、CapCutやPremiereへ直行可能。
手動のスタジオ収録や旧式TTSツールとYupVox Studioの機能差を比較。
柔軟なクレジット体系、隠れた費用なし。いつでもアップグレード・解約可能。
All Yupvox tools share a unified credit balance. You can freely allocate credits across TTS, Audio, and Video dubbing.
99,000 credits = ~99,000 characters (~16,500 words, ~25 book pages or ~2 hours of narration).
99,000 credits = ~33 minutes of multi-speaker AI audio translation & expressive voice dubbing.
99,000 credits = ~16.5 minutes of AI video dubbing, subtitle masking & 4K MP4 re-rendering.
| Plan | Credits / Cycle | Text to Speech | Audio Dubbing | Video Dubbing |
|---|---|---|---|---|
| Free ($0) | 50,000 | 50,000 文字 (~1h) | ~16.6 分 | ~8.3 分 |
| Lite ($1.0 / $2) | 99,000 / 月 | 99,000 文字 (~2h) | ~33 分 | ~16.5 分 |
| Starter ($4.5 / $9) | 999,000 / 月 | 1,000,000 文字 (~20h) | ~333 分 (約 5.5h) | ~166.5 分 (約 2.7h) |
| Growth ($9.5 / $19) ⭐ | 2,499,000 / 月 | 2,500,000 文字 (~50h) | ~833 分 (約 13.8h) | ~416.5 分 (約 6.9h) |
| Pro ($14.5 / $29) | 3,999,000 / 月 | 4,000,000 文字 (~80h) | ~1,333 分 (約 22.2h) | ~666.5 分 (約 11.1h) |
テキスト読み上げと特化型AIエンジンを組み合わせ、コンテンツ制作を総合的に効率化。
10秒の音声サンプルからあなたの声をクローンし、100以上の言語で自由自在に発話。
SRT字幕ファイルをアップロードすると、各シーンの秒数に合わせてAIが感情豊かに吹替。
音声や動画から99%の高精度で文字起こしを行い、タイムコード付きSRT字幕を出力。
TTS音声からシネマティックなビジュアル、カラオケ風動的字幕、BGM付きの動画を一括作成。
商用利用権、呼吸や間隔の調整方法、無料クレジット、出力形式について詳しく解説します。
わずか10秒で無料アカウントを作成。50,000クレジットを受け取り、4,000以上のスタジオ品質音声を今すぐ体験。