Zinn Hub
0
你的购物车
0

一览

关于此服务的关键详情,帮助您做出决定。由 Zinn Hub 生成,非卖家生成。

模型格式

支持 RVC 和 So-VITS
RVC (.pth +.index) 和 So-VITS (.pth,.pt, config.json) 模型类型均提供训练,为买家提供了使用哪种 AI 语音框架的灵活性。

音频要求

5–20+ 分钟的源音频
开始训练至少需要 5 分钟的高质量音频,建议 20+ 分钟以获得最佳效果。音频质量直接影响克隆输出。

可交付成果所有权

本地文件 — 无限期使用
买家收到原始模型文件,可在自己的电脑上运行,这意味着克隆语音可无限次使用,无需持续费用或平台依赖。

周转时间

2天交付(基础)
基本套餐在 2 天内交付。升级套餐将交付时间延长至 3–4 天,这可能反映了额外费用下更密集的培训配置。

您将收到

格式:
数字文件
Cloud Link
交付方式:
订单经理
注意: 所有训练好的模型文件都直接通过订单交付。对于 RVC 订单,您将收到一个.pth 文件和一个.index 文件。对于 So-VITS 订单,您将收到一个 config.json、一个.pth 文件和一个.pt 文件。为方便起见,文件可能会以压缩存档形式交付。请确保在交付日期之前安装了相关的本地推理软件。

完整描述

如果您想精确克隆语音并在自己的机器上无限重复使用,您需要一个经过适当训练的模型——而不是仓促的、低周期的尝试。此服务提供一个完全训练的RVC或So-VITS语音模型,直接从您提供的音频构建,为您提供输出的完全所有权和随时在本地运行它的自由。

语音克隆技术发展迅速,RVC(基于检索的语音转换)和So-VITS-SVC是当今最强大的两个开源框架。正确的训练——正确的预处理、适当的epoch计数和正确索引的输出文件——是实现令人信服的克隆与模糊、机器人般结果之间的区别。这正是本服务所关注的。

**您将收到什么**

对于RVC模型训练,您会收到一个`.pth`模型文件和一个`.index`文件——您需要的一切,以便将语音加载到PC上任何兼容的RVC界面中。

对于 So-VITS 模型训练,您将收到一个 `config.json` 文件、一个 `.pth` 模型文件和一个 `.pt` 文件——运行本地推理所需的完整集合。

交付后,您可以在自己的计算机上使用这些文件,将音频转换为克隆语音,次数不限,无需持续费用或平台依赖。

**流程如何运作**

1. 您提供您的音频数据集 — 理想情况下是 20 分钟或更长时间的清晰、高质量的目标语音录音。如果音频质量极佳且一致,至少 5 分钟也是可行的。
2. 使用适当的框架(RVC 或 So-VITS,您选择哪个)开始在您的数据集上进行训练。
3. 您通过订单收到已完成的模型文件,可随时加载到您的本地设置中。

**这是为谁准备的**

此服务适合希望在项目中使用特定声音的音乐家、制作人、内容创作者、开发人员和业余爱好者——无论是他们自己的声音、角色声音,还是他们拥有必要权利和许可的任何声音。它也适用于任何探索人工智能音频工具的人,他们希望获得经过适当训练的基础模型,而不是通用预设。

**为什么选择此卖家**

训练过程精心处理,确保数据集质量和输出完整性。您不会只得到一个半训练的检查点——整个过程都经过妥善运行,您将收到立即使用模型所需的完整文件集。如果对您的数据集或交付物有任何疑问,可以通过订单聊天进行清晰沟通。

查看选项并购买 — 起价 $40.00

✓
经过审查的专业人士
每位 Zinner 在加入平台前都会经过审查和批准。
✓
质量保证
所有服务均有我们的质量保证承诺支持。
✓
安全支付
您的付款受保护,直到您批准交付的工作。

比较套餐

特色入门Boost高级
交付时间2 天3 天4 天
修订000
根据您提供的音频训练一个 RVC 或 So-VITS 模型✓✕✕
RVC 输出:.pth 模型文件 +.index 文件✓✓✓
So-VITS 输出:config.json +.pth 文件 +.pt 文件✓✓✓
接受最少约5分钟的高质量音频✓✕✕
文件已准备好用于本地PC推理✓✓✕
交付后无限次本地使用训练模型✓✕✕
包含 Starter 中的所有内容,但培训范围更广✕✓✕
针对更大或更多样化的音频数据集进行优化✕✓✕
延长训练时长以提高模型准确性✕✓✕
Boost 中的所有内容,以最大训练范围✕✕✓
最高epoch计数以实现最精细的语音再现✕✕✓
最适合20分钟以上的高质量数据集✕✕✓
队列中的优先处理✕✕✓

作品集

卖家与此 Zinn 相关的工作示例。

根据您的音频训练自定义 RVC 或 So-VITS 语音模型

根据您的音频训练自定义 RVC 或 So-VITS 语音模型

额外信息

我的流程

步骤 1 — 提供您的音频:通过订单聊天上传您的语音数据集。清晰、一致的音频,时长 5–20+ 分钟效果最佳。
步骤 2 — 框架选择:指定您想要 RVC 还是 So-VITS 模型。如果不确定,请在聊天中讨论您的用例。
步骤 3 — 模型训练:训练在您的数据集上运行。您选择的层级决定了训练过程的深度和持续时间。
步骤 4 — 文件交付:您通过订单收到完整的模型文件集 — 可加载到您的本地 RVC 或 So-VITS 界面中。

完美适合

谁受益最大:想要定制 AI 声音乐器的音乐家和制作人 正在构建独特声音角色的内容创作者 正在本地试验语音转换管道的开发人员 正在探索 AI 音频工具的爱好者 任何想要克隆自己的声音用于个人项目的人

我使用的工具

框架:RVC(基于检索的语音转换)So-VITS-SVC(So-VITS)
输出文件类型:RVC:.pth 模型文件,.index 文件 So-VITS:.pth 模型文件,.pt 文件,config.json

常见问题

RVC(基于检索的语音转换)通常更容易在本地运行,并得到社区工具的广泛支持。So-VITS-SVC 可以产生非常自然的结果,但需要稍微复杂的本地设置。如果您不确定,请在订单聊天中提及您的用例,我们将提供指导。

至少约 5 分钟清晰、连贯、高质量的音频是可行的。然而,20 分钟或更长时间将产生明显更准确和自然的模型。源音频中的背景噪音、音乐或强烈混响会降低输出质量,因此强烈建议使用清晰的录音。

下订单后,请直接通过订单聊天上传您的音频文件,或使用聊天中共享的云存储链接。接受的格式包括 WAV、FLAC 和 MP3。建议使用 44.1 kHz 或更高采样率的 WAV 或 FLAC 格式以获得最佳效果。

交付的文件是标准模型检查点,与 RVC 和 So-VITS 社区界面兼容,可在装有支持 CUDA 的 GPU 的 Windows 或 Linux PC 上本地运行。您需要在机器上安装相关的推理软件。如果您需要入门帮助,可以使用设置指南插件。

模型训练是一个计算过程而非创造性过程——输出质量与您提供的数据集直接相关。如果交付的文件存在技术问题(例如文件损坏或不完整),我们将免费解决。如果您希望使用不同的数据集或设置重新训练,请通过订单聊天联系我们讨论选项。

您有责任确保您拥有适当的权利和权限来训练您提供的音频模型。此服务旨在用于您自己的声音、原始录音或您拥有明确授权的音频。

入门级适用于使用大约 5–20 分钟的干净数据集进行简单的语音克隆。当您拥有更大或更多样化的数据集并希望获得更精细的结果时,建议使用增强级。高级级是获得最高质量输出的理想选择,特别是当音频时长为 20 分钟或更长且准确性至关重要时。

客户评论

看看我们的客户对这个Zinn的评价

5.0
3评论
5 ⭐
3
4 ⭐
0
3 ⭐
0
2 ⭐
0
1 ⭐
0

谢谢!效果很棒:D ⭐️⭐️⭐️⭐️⭐️

再次感谢!听起来太棒了!:D

我对我的声乐模型订单的交付非常满意。整个过程快速而顺利,每一步都有清晰的沟通。产品完好无损地送达,与描述完全一致。我强烈推荐这项服务,因为它专业高效。

只有购买过此产品的登录客户才能发表评论。

分类

Zinner 政策

为您训练 Rvc 或 Sovitssvc 模型

只有购买过此产品的登录客户才能发表评论。

选项和订单

获取 Zinn Hub 应用

通知 · 更快访问 · 全屏

在浏览器中点击 分享

➜ 然后点击 "添加到主屏幕"