独自のオーディオデータセットから構築された、プロがトレーニングしたRVCまたはSo-VITS音声モデルを入手し、PCですぐに使用できる状態で提供され、無制限の音声クローン作成が可能です。
あなたのオーディオからカスタムRVCまたはSo-VITS音声モデルをトレーニングします
オーディオデータセットからトレーニングされた単一のRVCまたはSo-VITS音声モデル。
- 提供されたオーディオで1つのRVCまたはSo-VITSモデルをトレーニングする
- RVC出力:.pthモデルファイル +.indexファイル
- So-VITS出力: config.json +.pthファイル +.ptファイル
- 最低約5分の高品質オーディオが受け入れられます
- ローカルPC推論用に準備されたファイルが納品されます
- 納品後のトレーニング済みモデルの無制限のローカル使用
拡張データセットサポートと、音声品質向上のためのより長いトレーニング実行による強化されたトレーニング。
- Starterのすべてを、より高いトレーニング範囲で
- より大規模または多様なオーディオデータセット用に最適化
- モデルの精度向上のためのトレーニング期間の延長
- RVC出力:.pthモデルファイル +.indexファイル
- So-VITS出力: config.json +.pthファイル +.ptファイル
- ローカルPC推論用に準備されたファイルが納品されます
最も詳細で自然な音声モデル出力のための完全なスコープのトレーニング実行。
- Boostのすべてを、最大のトレーニング範囲で
- 最も洗練された音声再生のための最高のepoch数
- 20分以上の高品質なデータセットに最適
- RVC出力:.pthモデルファイル +.indexファイル
- So-VITS出力: config.json +.pthファイル +.ptファイル
- キュー内の優先処理
カスタムオファーをリクエストする
購入前のご質問をお問い合わせください
質問をするにはログインしてください
プラットフォームのスパムを減らすため、販売前メッセージはログイン済みユーザーのみが送信できます。
無料アカウントを作成するか、ログインしてこの Zinner に直接メッセージを送信してください。
ログイン / 登録一目でわかる
このサービスについての重要な詳細情報です。Zinn Hubによって生成されました。売り手によるものではありません。
価値ポジション
モデル形式
オーディオ要件
成果物の所有権
所要時間
受け取るもの
完全な説明
精密に音声をクローンして、自分のマシンで無限に再利用したい場合は、急いで低エポックで試みるのではなく、適切に訓練されたモデルが必要です。このサービスは、提供するオーディオから直接構築された完全に訓練されたRVCまたはSo-VITS音声モデルを提供し、出力の完全な所有権と必要に応じてローカルで実行する自由を与えます。
音声クローン技術は急速に進歩しており、RVC(Retrieval-based Voice Conversion)とSo-VITS-SVCは、現在利用可能な最も高性能なオープンソースフレームワークの2つです。適切なトレーニング、つまり正しい前処理、適切なエポック数、適切にインデックス化された出力ファイルが、説得力のあるクローンと濁ったロボットのような結果の違いを生み出します。このサービスはまさにそこに焦点を当てています。
**受け取るもの**
RVCモデルのトレーニングでは、`.pth`モデルファイルと`.index`ファイルを受け取ります。これらは、PC上の互換性のあるRVCインターフェースに音声をロードするために必要なすべてです。
So-VITSモデルのトレーニングでは、`config.json`、`.pth`モデルファイル、および`.pt`ファイルを受け取ります。これらはローカルで推論を実行するために必要な完全なセットです。
配信後、これらのファイルを自分のコンピュータで使用して、進行中の料金やプラットフォーム依存性なく、何度でもオーディオをクローンボイスに変換できます。
**プロセスの仕組み**
1. オーディオデータセットを提供します — 理想的には、ターゲット音声のクリーンで高品質な録音を20分以上。オーディオ品質が優れていて一貫している場合は、最低約5分でも機能します。
2. 適切なフレームワーク(RVCまたはSo-VITS、どちらを選択しても)を使用して、データセットのトレーニングを開始します。
3. 完了したモデルファイルは注文を通じて受け取られ、ローカルセットアップにロードする準備ができています。
**対象者**
このサービスは、自分の声、キャラクターの声、または必要な権利と許可を持つあらゆる声など、プロジェクトで特定の声を使いたいミュージシャン、プロデューサー、コンテンツクリエーター、開発者、趣味の人に適しています。また、一般的なプリセットではなく、適切にトレーニングされた基盤モデルを求めるAIオーディオツールを探索している人にも最適です。
**この出品者を選ぶ理由**
トレーニングは、データセットの品質と出力の整合性に注意を払って行われます。半訓練されたチェックポイントが単に渡されるのではなく、プロセスは適切に実行され、モデルをすぐに使用するために必要な完全なファイルセットを受け取ります。データセットや成果物について質問がある場合は、注文チャットを通じて明確なコミュニケーションが常に可能です。
Zinner クオリティ保証
すべての Zinner はプラットフォームに参加する前に審査・承認されます。
すべてのサービスは、当社の品質保証コミットメントによってサポートされています。
納品された作業を承認するまで、お客様の支払いは保護されます。
パッケージを比較
| 機能 | スターター | ブースト | プレミアム |
|---|---|---|---|
| 納期 | 2 日 | 3 日 | 4 日 |
| リビジョン | 0 | 0 | 0 |
| 提供されたオーディオでRVCまたはSo-VITSモデルを1つトレーニングする | ✓ | ✕ | ✕ |
| RVC出力:.pthモデルファイル +.indexファイル | ✓ | ✓ | ✓ |
| So-VITS出力: config.json +.pthファイル +.ptファイル | ✓ | ✓ | ✓ |
| 最低約5分の高品質オーディオが受け入れられます | ✓ | ✕ | ✕ |
| ローカルPC推論用に準備完了したファイルを配信 | ✓ | ✓ | ✕ |
| 納品後のトレーニング済みモデルの無制限のローカル使用 | ✓ | ✕ | ✕ |
| スターターのすべてが、より高いトレーニング範囲で | ✕ | ✓ | ✕ |
| より大規模または多様なオーディオデータセット向けに最適化されています | ✕ | ✓ | ✕ |
| モデル精度向上のための拡張トレーニング期間 | ✕ | ✓ | ✕ |
| ブーストのすべてを、最大のトレーニング範囲で | ✕ | ✕ | ✓ |
| 最も洗練された音声再生のための最高の時代カウント | ✕ | ✕ | ✓ |
| 20分以上の高品質なデータセットに最適 | ✕ | ✕ | ✓ |
| キュー内での優先処理 | ✕ | ✕ | ✓ |
ポートフォリオ
このZinnに関連するセラーの作品の例。

カスタムRVCまたはSo-VITSボイスモデルをオーディオから訓練する


カスタムRVCまたはSo-VITSボイスモデルをオーディオから訓練する

追加情報
私のプロセス
最適
使用しているツール
よくある質問
RVC(Retrieval-based Voice Conversion)は、一般的にローカルで実行するのが簡単で、コミュニティツールによって広くサポートされています。So-VITS-SVCは非常に自然な結果を生成できますが、少し複雑なローカルセットアップが必要です。不明な場合は、注文チャットでユースケースを記載してください。ガイダンスが提供されます。
最低約5分間のクリーンで一貫性のある高品質なオーディオであれば作業可能です。ただし、20分以上であれば、著しく正確で自然な響きのモデルが得られます。ソースオーディオに背景ノイズ、音楽、または強いリバーブがあると出力品質が低下するため、クリーンな録音を強く推奨します。
ご注文後、注文チャットから直接オーディオファイルをアップロードするか、チャットで共有されたクラウドストレージリンクを使用してください。対応フォーマットはWAV、FLAC、MP3です。最適な結果を得るには、44.1 kHz以上のWAVまたはFLACを推奨します。
提供されるファイルは、RVCおよびSo-VITSコミュニティインターフェースと互換性のある標準モデルチェックポイントであり、CUDA対応GPUを搭載したWindowsまたはLinux PCでローカルに実行されます。関連する推論ソフトウェアがマシンにインストールされている必要があります。開始にあたってサポートが必要な場合は、セットアップガイドアドオンをご利用いただけます。
モデルのトレーニングは創造的なプロセスではなく計算プロセスであり、出力品質は提供するデータセットに直接関係します。納品されたファイルに技術的な問題(破損したファイルや不完全なファイルなど)がある場合は、追加料金なしで解決されます。異なるデータセットや設定で再トレーニングをご希望の場合は、注文チャットでお問い合わせください。
提供する音声でモデルをトレーニングするための適切な権利と許可を保持していることを確認する責任は、お客様にあります。このサービスは、ご自身の声、オリジナル録音、または明示的な許可を得ている音声での使用を目的としています。
スターターティアは、約5~20分のクリーンなデータセットを用いた簡単な音声クローンに適しています。ブーストティアは、より大規模または多様なデータセットがあり、より洗練された結果を求める場合におすすめです。プレミアムティアは、特に20分以上の音声があり、精度が重要である場合に、最高品質の出力に最適です。
顧客レビュー
このZinnについてお客様の声をご覧ください
ありがとうございます!素晴らしい出来でした:D ⭐️⭐️⭐️⭐️⭐️
改めてありがとうございます!素晴らしいですね!:D
ボーカルモデルの注文の納品に非常に満足しました。プロセスは迅速かつスムーズで、すべてのステップで明確なコミュニケーションがありました。製品は完璧な状態で、説明どおりに届きました。そのプロフェッショナリズムと効率性から、このサービスを強くお勧めします。
このプロダクトのレビューを残すことができるのは、ログインしており、かつこの商品を購入したお客様のみです。








