Zinn Hub
0
你的购物车
0

一览

关于此服务的关键详情,帮助您做出决定。由 Zinn Hub 生成,非卖家生成。

型号

RVC v2 & GPT-SoVITS
支持两个领先的AI语音合成框架,为您提供与流行AI翻唱和语音转换工作流兼容的模型。

数据集要求

少于5分钟的音频
基本层级需要少于 5 分钟的录音数据,即使您现有的录音有限,也能轻松使用。

歌唱支持

仅限 Boost 和高级套餐
基本套餐不包含唱歌能力——需要用于歌曲翻唱的语音模型的买家应选择 Boost 或 Premium 升级。

预训练清理

包含音频清理
所有层级在训练开始前都包含专业的原始语音清理,这直接影响最终语音模型的清晰度和准确性。

您将收到

格式:
数字文件
源文件
交付方式:
订单经理
备注: 您训练好的语音模型文件将通过订单管理器交付。其中将包含关于如何加载和使用模型的简要说明。如果您需要共享大型音频数据集文件,请使用云存储链接并将其粘贴到订单聊天中——这确保上传过程中不会丢失任何内容。

完整描述

无论您是想克隆自己的声音、重现一个角色,还是构建一个独特的合成发音人,一个训练有素的 RVC V2 语音模型都是一切的基础。这项服务为您处理完整的训练流程——从清理原始音频到交付可用的模型文件。

Zinn Digital 总部位于英国伦敦,专门使用 RVC V2 和 GPT-SoVITS 进行定制 AI 语音模型训练。每个订单在训练开始前都包含专业的源音频清理,可去除背景噪音、不一致和伪影,否则会降低最终模型的质量。您只需提供您的录音;繁重的技术工作由我们完成。

入门级涵盖5分钟以下的数据集——非常适合快速语音克隆、概念测试或简单的语音到语音转换用例。升级到标准级可将覆盖范围扩展到更长的数据集,并解锁歌唱声乐训练,使其适用于音乐制作、AI翻唱和声乐合成项目。完整级提供相同的扩展范围,并具有额外的修订灵活性和最长的交付窗口,以实现彻底的微调。

RVC V2 模型用于语音到语音转换:您通过任何文本到语音系统生成语音,然后通过训练模型运行它以输出目标语音的音频。对于本地使用,建议使用兼容的 GPU(NVIDIA GTX 1000 系列或更新,或 AMD RX 6000 系列或更新,至少 4 GB 显存)和大约 10 GB 的可用存储空间。模型本身与语言无关——它可以在任何语言的录音上进行训练,尽管跨语言转换可能会显示一些性能差异。

大约 10 分钟的干净、一致的音频数据集往往会产生强大的结果。您的录音越干净、越一致,输出效果就越好——这正是为什么每个层级都将源音频清理作为标准包含在内的原因。

这项服务适用于创建AI人声翻唱的音乐制作人、构建语音启用应用程序的开发人员、需要一致合成语音的内容创作者,以及任何探索用于创意或商业项目的自定义语音合成的人。

订单下达后,只需通过订单聊天分享您的数据集,工作立即开始。

查看选项并购买 — 起价 $40.00

✓
经过审查的专业人士
每位 Zinner 在加入平台前都会经过审查和批准。
✓
质量保证
所有服务均有我们的质量保证承诺支持。
✓
安全支付
您的付款受保护,直到您批准交付的工作。

比较套餐

特色基本标准完整
交付时间1 天2 天3 天
修订011
RVC V2语音模型训练✓✓✕
数据集最长5分钟的录音✓✕✕
专业源声音音频清理✓✓✓
自定义语音训练数据准备✓✕✕
以即用型模型文件形式交付✓✕✕
适用于语音到语音的转换✓✕✕
数据集最长10分钟的录音✕✓✕
包含声乐训练✕✓✓
1 次修订包含在内✕✓✓
适用于AI翻唱、音乐制作和语音合成✕✓✕
RVC V2 或 GPT-SoVITS 语音模型训练✕✕✓
超过 10 分钟录音的数据集✕✕✓
优先处理并进行彻底的微调✕✕✓

作品集

卖家与此 Zinn 相关的工作示例。

训练自定义 RVC V2 或 GPT-SoVITS 人工智能语音模型

训练自定义 RVC V2 或 GPT-SoVITS 人工智能语音模型

额外信息

为什么选择我

所在地:英国伦敦
包含音频清理:每份订单在训练开始前都包含专业的源音频清理——不收取额外费用。
语言支持:RVC V2 模型可以训练任何语言的录音,没有限制。

我使用的工具

语音训练框架:RVC V2、GPT-SoVITS
音频处理:在模型训练之前,对所有数据集应用专业的音频清理工具。

完美适合

理想用例:AI人声翻唱和音乐制作、自定义语音到语音转换、内容创作的语音克隆、合成说话人开发、歌唱语音模型训练

常见问题

大约10分钟清晰、连贯的音频通常会产生很好的效果。基本套餐涵盖5分钟以下的录音。为获得最佳质量,请确保语音清晰,背景噪音最小,并且麦克风距离始终保持一致。

不直接——RVC V2 模型旨在用于语音到语音的转换,而不是文本到语音。典型的工作流程是使用任何文本到语音工具(使用任何声音)生成语音,然后通过您训练的 RVC 模型运行该音频,将其转换为您的目标声音。这使您可以完全控制输出。

是的,RVC V2 模型可以用任何语言的录音进行训练——训练没有语言限制。如果您计划将一种语言的语音转换为另一种语言,请注意在跨语言转换场景中可能会出现一些性能下降。

要在您自己的机器上运行模型,您需要一个至少具有 4 GB 显存和大约 10 GB 可用存储空间的 GPU。对于 NVIDIA,GTX 1000 系列或更新的显卡是合适的。对于 AMD,建议使用 RX 6000 系列或更新的显卡。

您需要提供您的录音作为数据集。音频越清晰、越一致,训练模型的表现就越好。每个层级都包含源音频清理,但没有大量背景噪音的录音总是能产生最佳效果。下订单后,只需通过订单聊天分享您的文件即可。

在培训开始前,提供的音频会被处理以去除背景噪音、伪影和不一致之处,这些可能会对模型产生负面影响。此步骤作为标准包含在每个层级中,是确保最终语音模型尽可能清晰准确的关键部分。

训练好的模型将通过订单管理器以即用型模型文件的形式交付。您将收到有关如何加载和使用它的说明,包括运行语音到语音转换的推荐本地软件。

两者都是用于语音克隆和合成的 AI 语音模型框架。RVC V2 广泛用于语音到语音转换和 AI 翻唱。GPT-SoVITS 可以提供不同的性能特征,特别适用于某些语言和用例。如果您有偏好或特定的用例,请在订单要求中提及,我们将选择最合适的框架。

客户评论

看看我们的客户对这个Zinn的评价

4.8
5评论
5 ⭐
4
4 ⭐
1
3 ⭐
0
2 ⭐
0
1 ⭐
0

很棒的工作!模型听起来真实、空灵,并且忠于张国荣的音色。谢谢,但我不知道你为什么做得这么快(1 天)。3500 个 epoch,谢谢。

完美!非常理解我的要求!

提供了当日服务。模型没有伪影,超出了我的预期。为了充分利用您的购买,建议您使用w-okada,而不是像voice.ai这样的第三方服务,因为它们通常不会考虑索引文件,而索引文件至关重要。

非常快!

非常专业,非常迅速,总是积极回应请求。我将继续合作。

只有购买过此产品的登录客户才能发表评论。

分类

Zinner 政策

为您训练 Rvc V2 或 Gpt Sovits 语音

只有购买过此产品的登录客户才能发表评论。

选项和订单

获取 Zinn Hub 应用

通知 · 更快访问 · 全屏

在浏览器中点击 分享

➜ 然后点击 "添加到主屏幕"