Zinn Hub
0
あなたのカート
0

一目でわかる

このサービスについての重要な詳細情報です。Zinn Hubによって生成されました。売り手によるものではありません。

AIモデルタイプ

RVC (検索ベースの音声変換)
RVMPEメソッド(最高品質のF0メソッドと見なされる)を備えたRVCアーキテクチャを使用し、強力なボーカルアクセントの再現のために0.7~0.9の検索率を実現します。

データセット要件

20–25分 WAV、チューニングなし
トレーニング音声は、未加工のWAVファイル(オートチューンやボーカルチューニングなし)をGoogle Driveまたは直接チャットでZIP/RAR形式でアップロードする必要があります。

処理パイプライン

Python MDX NET HQ + 3メソッド
オーディオは Python MDX NET HQ Main を使用して処理され、モデルトレーニング開始前にソースクリーニングのために MDXVR、ARCH、DEMUCS、および ENS MODE を使用します。

納期

モデルは10時間~3日で準備完了
モデル処理には10時間から1日かかり、基本パッケージの納期は3日間です。ブーストおよびプレミアムアップグレードでは、納期が2日に短縮されます。

受け取るもの

フォーマット:
デジタルファイル
Cloud Link
オーディオファイル
ソースファイル
配送方法:
オーダーマネージャー
注: カスタムPTHモデルファイルは、ファイルサイズに応じて、注文マネージャーまたは共有クラウドリンク経由で配信されます。VO録音は高品質のオーディオファイルとして配信されます。提出前にデータセットがWAV形式と20~25分の期間要件を満たしていることを確認してください。これはモデルの品質と処理時間に直接影響します。

完全な説明

音楽プロデューサー、コンテンツクリエーター、声優、開発者など、カスタムAI音声モデルを使用すると、自分自身の声、キャラクターの声、アーティストのスタイルなど、あらゆるターゲットの声でリアルな音声出力を生成できます。このサービスは、提供されたオーディオデータセットから構築され、専用ハードウェアでプロフェッショナルツールを使用して処理された、完全にトレーニングされたRVC(Retrieval-Based Voice Conversion)モデルを提供します。

すべてのモデルは、Python MDX NET HQ Mainと3つの処理方法を使用してトレーニングされ、可能な限りクリーンなソースオーディオを実現します。AIモデル自体は、最高品質のF0推定アプローチとして広く認識されているRMVPEメソッドを使用して構築されており、ターゲット音声のユニークなアクセントと特性を維持および強化するために0.7~0.9の検索率を備えています。その結果、独自のワークフローで使用できるカスタムPTHモデルファイルが作成されます。

データセットの準備プロセスには、トレーニングを開始する前に、アーティファクト、ノイズ、またはブリードを除去するためのソース音声のクリーニングが含まれます。オーディオは、クリーンなRAW WAVファイルとして提供する必要があり、ボーカルチューニング、ピッチ補正、またはオートチューンは適用されていません。最適なモデル品質のために、期間は20分から25分の間である必要があります。データセットは、クラウドリンクを介して、またはZIPまたはRARアーカイブとして注文チャットで直接配信できます。

モデル作成に加え、本サービスではボーカル分離タスク(楽器除去およびボーカル除去)や特注のボイスオーバー(VO)録音も承ります。VO作業は、Audio-Technica AT4040コンデンサーマイク、Arturia MiniFuse 2オーディオインターフェース、ATH-M40Xモニタリングヘッドホン、Aston Haloアイソレーションシールドといったプロ仕様のスタジオ機器を使用してライブで行われ、放送品質を保証します。VOキャラクターやアーティストスタイルの音声は、男性と女性の両方で利用可能です。特定のキャラクター、アーティスト、またはパーソナリティをご希望の場合は、ご注文時にお申し付けください。

ワークフロー全体に適用される処理方法には、MDX、VR Arch、Demucs、ESNMモードが含まれており、チームは特定のソース素材に最適な分離アプローチを柔軟に選択できます。

注:ボーカルブレンドのリクエストには別途料金がかかります。該当する場合は、ご注文前にお問い合わせください。

**これは誰のためのものですか?**
オリジナルのAIボーカルレンディションを作成したい音楽プロデューサー、キャラクターボイスを構築するゲーム開発者やコンテンツクリエーター、迅速なプロトタイピングのために個人的なAIクローンを求める声優、AI音楽と音声技術を探求する愛好家。

**仕組み:**
1. ご注文いただき、クリーンなWAVデータセット(20~25分、チューニングなし)をアップロードしてください。
2. チームがソースオーディオを処理・クリーニングし、RMVPEを使用してRVCモデルをトレーニングします。
3. 完成したPTHモデルファイルは、合意された期間内に納品されます。

モデルの処理には、データセットが受領および承認されてから通常10時間から1日かかります。

Zinner クオリティ保証

✓
審査済みプロフェッショナル
すべての Zinner はプラットフォームに参加する前に審査・承認されます。
✓
品質保証
すべてのサービスは、当社の品質保証コミットメントによってサポートされています。
✓
安全な支払い
納品された作業を承認するまで、お客様の支払いは保護されます。

パッケージを比較

機能スタンダードブーストプレミアム
納期3 日2 日2 日
リビジョン111
カスタムRVC AI音声モデル(PTHファイル)✓✓✕
最大25分のトレーニングデータセット✓✓✕
ソース音声クリーニングが含まれています✓✓✕
RMVPEメソッド — 最高品質のF0推定✓✕✕
力強い声のキャラクターの検索率 0.7~0.9✓✕✕
歌唱ボーカル対応✓✕✕
スタンダードのすべて✕✓✕
優先キュー — 2日以内に納品✕✓✕
RMVPEメソッド、検索率0.7–0.9✕✓✕
Boostのすべて✕✕✓
特注のナレーション録音(選択したキャラクターまたはアーティストの声)✕✕✓
AT4040マイク、Arturia MiniFuse 2 & Aston Haloアイソレーションシールドで録音✕✕✓
男性または女性のVOスタイルが利用可能✕✕✓
インストゥルメンタルまたはボーカルの除去が含まれています✕✕✓
放送品質のオーディオ✕✕✓

ポートフォリオ

このZinnに関連するセラーの作品の例。

RVCを使用してカスタムAI音声モデルを作成

RVCを使用してカスタムAI音声モデルを作成

追加情報

私のプロセス

ステップ1 — データセットレビュー:処理を開始する前に、WAVデータセットの長さ、フォーマット準拠、オーディオのクリーンさがレビューされます。
ステップ 2 — ソース音声クリーンアップ:MDX、VR Arch、Demucs、ESNMモード分離方法を使用して、ノイズ、アーティファクト、およびブリードを除去します。
ステップ 3 — RVCモデルトレーニング:クリーンアップされたデータセットは、RMVPE F0メソッドと0.7~0.9の検索率を使用して、カスタムAI音声モデルのトレーニングに使用されます。
ステップ4 — 納品:完成したPTHモデルファイル(および該当する場合はVO録音)は、合意された期間内に注文マネージャーを通じて納品されます。

使用しているツール

AIモデルトレーニング:Python MDX NET HQ Main — RMVPE F0メソッドによるRVC、検索率0.7–0.9
オーディオ分離:MDX、VR Arch、Demucs、ESNMモード
録音機材:AT4040コンデンサーマイク、Arturia MiniFuse 2インターフェース、ATH-M40Xヘッドホン、Aston Haloアイソレーションシールド

最適

最も恩恵を受ける人:AIボーカルレンディションを作成する音楽プロデューサー|キャラクターボイスを構築するゲーム開発者やコンテンツクリエーター|個人のAIボイスクローンをプロトタイプする声優|AI音楽や音声合成を探求するアーティストや愛好家|プロフェッショナルなボーカル分離または除去が必要な人

よくある質問

データセットは WAV ファイル形式で、合計継続時間が 20 ~ 25 分である必要があります。録音は、ボーカルチューニング、ピッチ補正、オートチューンが適用されていない RAW テイクであることを確認してください。これらはモデルの品質を大幅に低下させる可能性があります。

ZIPまたはRARアーカイブとして注文チャットに直接ファイルをアップロードするか、クラウドストレージリンク(Google Driveなど)経由で共有できます。どちらの方法も同じように機能します。

データセットが受領され承認されると、処理には通常10時間から1日かかります。合計配送時間にはこの処理期間が含まれるため、記載されている全配送期間を考慮してください。

独自のPTHモデルファイルを受け取ります。これは、RVC互換の環境またはソフトウェアにロードできます。ボイスオーバーも注文した場合は、録音されたオーディオファイルを受け取ります。

RMVPE (Robust Model for Vocal Pitch Estimation) は、現在RVCモデルトレーニングで使用されている最高品質のF0ピッチ検出方法です。特に歌唱アプリケーションにおいて、他の方法と比較してより正確で自然な音声変換を生成します。

はい。プレミアムパッケージには、カスタムVO録音が含まれています。男性または女性の声をリクエストでき、アーティスト、キャラクター、またはパーソナリティスタイルを指定できます。注文時にこれらの詳細を含めてください。

ボーカルブレンドは、2つ以上の声源の要素を組み合わせたものです。これは別のサービスであり、独自の料金がかかり、ここに記載されているどのパッケージにも含まれていません。これが必要な場合は、注文前にメッセージを送ってください。

各パッケージには1回の修正が含まれています。成果物が合意された範囲を満たさない場合は、注文チャットを通じてその旨を伝えてください。チームが対応します。品質低下の最も一般的な原因は、チューニング、ノイズが含まれている、または推奨される20分よりも短いオーディオデータセットであるため、クリーンで十分なソース素材が不可欠です。

顧客レビュー

このZinnについてお客様の声をご覧ください

5.0
5レビュー
5 ⭐
5
4 ⭐
0
3 ⭐
0
2 ⭐
0
1 ⭐
0

ありがとう、相棒!

優れた製品と販売者 – 他よりも優れています。私のモデルに非常に満足しており、これで多くのプロジェクトができるようになります!

彼は自分の仕事において最高の一人です

素晴らしい仕事

彼は相変わらず素晴らしい!迅速でプロフェッショナル!

このプロダクトのレビューを残すことができるのは、ログインしており、かつこの商品を購入したお客様のみです。

カテゴリー

Zinner ポリシー

カスタムAIボイスモデルを作成(テキスト音声変換を含む)

このプロダクトのレビューを残すことができるのは、ログインしており、かつこの商品を購入したお客様のみです。

オプション&注文

Zinn Hub アプリを入手する

通知 · より速いアクセス · フルスクリーン

ブラウザで共有をタップしてください

➜ その後、"ホーム画面に追加"をタップします