자신의 오디오 데이터셋으로 전문적으로 훈련된 RVC 또는 So-VITS 음성 모델을 받아보세요. 무제한 음성 복제를 위해 PC에서 바로 사용할 수 있도록 제공됩니다.
귀 오디오에서 맞춤형 RVC 또는 So-VITS 음성 모델 학습
오디오 데이터셋에서 훈련된 단일 RVC 또는 So-VITS 음성 모델입니다.
- 제공된 오디오에서 1개의 RVC 또는 So-VITS 모델 학습
- RVC 출력:.pth 모델 파일 +.index 파일
- So-VITS 출력: config.json +.pth 파일 +.pt 파일
- 최소 ~5분 고품질 오디오 허용
- 로컬 PC 추론을 위해 준비된 파일 전달
- 배송 후 학습된 모델의 무제한 로컬 사용
확장된 데이터셋 지원 및 향상된 음성 품질을 위한 더 긴 훈련 실행으로 향상된 훈련.
- Starter의 모든 기능이 더 높은 훈련 범위로 제공됩니다.
- 더 크거나 다양한 오디오 데이터 세트에 최적화됨
- 모델 정확도 향상을 위한 확장된 교육 기간
- RVC 출력:.pth 모델 파일 +.index 파일
- So-VITS 출력: config.json +.pth 파일 +.pt 파일
- 로컬 PC 추론을 위해 준비된 파일 전달
가장 상세하고 자연스러운 음성 모델 출력을 위한 전체 범위 교육 실행.
- Boost의 모든 기능, 최대 훈련 범위
- 가장 정교한 음성 재현을 위한 최고 에포크 수
- 20분 이상의 고품질 데이터 세트에 가장 적합합니다.
- RVC 출력:.pth 모델 파일 +.index 파일
- So-VITS 출력: config.json +.pth 파일 +.pt 파일
- 대기열 내 우선 처리
맞춤 제안 요청하기
사전 판매 질문 하기
질문을 하려면 로그인하세요
플랫폼 스팸을 줄이기 위해 사전 판매 메시지는 로그인한 사용자만 보낼 수 있습니다.
무료 계정을 만들거나 로그인하여 이 Zinner에게 직접 메시지를 보내세요.
로그인 / 가입한눈에 보기
이 서비스에 대한 주요 정보로 결정을 내리는 데 도움을 드립니다. Zinn Hub에서 생성됨, 판매자가 아님.
가치 위치
모델 형식
오디오 요구사항
납품물 소유권
처리 시간
받으실 내용
전체 설명
정밀하게 음성을 복제하고 자신의 머신에서 끝없이 재사용하려면 제대로 훈련된 모델이 필요합니다 — 서둘러 만든 저 에포크 시도가 아닙니다. 이 서비스는 제공한 오디오에서 직접 구축된 완전히 훈련된 RVC 또는 So-VITS 음성 모델을 제공하여 출력에 대한 완전한 소유권과 필요할 때마다 로컬에서 실행할 수 있는 자유를 제공합니다.
음성 복제 기술은 빠르게 발전했으며, RVC(검색 기반 음성 변환)와 So-VITS-SVC는 현재 이용 가능한 가장 강력한 오픈소스 프레임워크 중 두 가지입니다. 훈련을 올바르게 수행하기 — 올바른 전처리, 적절한 에포크 수, 제대로 인덱싱된 출력 파일 — 설득력 있는 복제와 탁하고 기계적인 결과의 차이를 만듭니다. 이것이 바로 이 서비스가 중점을 두는 부분입니다.
**받으실 내용**
RVC 모델 훈련의 경우 `.pth` 모델 파일과 `.index` 파일을 받으며, PC의 호환되는 RVC 인터페이스에 음성을 로드하는 데 필요한 모든 것이 포함됩니다.
So-VITS 모델 훈련의 경우 `config.json`, `.pth` 모델 파일 및 `.pt` 파일을 받습니다 — 로컬에서 추론을 실행하는 데 필요한 완전한 세트입니다.
배송 후 이 파일을 자신의 컴퓨터에서 사용하여 지속적인 비용이나 플랫폼 종속성 없이 원하는 만큼 여러 번 오디오를 복제된 음성으로 변환할 수 있습니다.
**프로세스 작동 방식**
1. 오디오 데이터셋을 제공합니다. 이상적으로는 대상 음성의 깨끗하고 고품질 녹음본이 20분 이상이어야 합니다. 오디오 품질이 우수하고 일관적이라면 최소 약 5분도 가능합니다.
2. 적절한 프레임워크(RVC 또는 So-VITS, 선택한 것)를 사용하여 데이터셋에 대한 훈련이 시작됩니다.
3. 완료된 모델 파일은 주문을 통해 수신되며, 로컬 설정에 로드할 준비가 됩니다.
**대상**
이 서비스는 자신의 목소리, 캐릭터 음성 또는 필요한 권리와 허가를 보유한 모든 음성을 프로젝트에 사용하려는 음악가, 프로듀서, 콘텐츠 크리에이터, 개발자 및 취미 활동가에게 적합합니다. 또한 일반 프리셋이 아닌 제대로 훈련된 기초 모델을 원하는 AI 오디오 도구를 탐색하는 모든 사람에게 이상적입니다.
**이 판매자를 선택하는 이유**
데이터셋 품질과 출력 무결성을 위해 신중하게 학습이 진행됩니다. 단순히 반쯤 학습된 체크포인트를 받는 것이 아니라, 프로세스가 제대로 실행되며 모델을 즉시 사용하는 데 필요한 전체 파일 세트를 받게 됩니다. 데이터셋 또는 결과물에 대한 질문이 발생할 경우 주문 채팅을 통해 명확한 의사소통이 가능합니다.
Zinner 품질 보증
모든 Zinner는 플랫폼에 참여하기 전에 검토 및 승인됩니다.
모든 서비스는 당사의 품질 보증 약속으로 뒷받침됩니다.
배송된 작업을 승인할 때까지 결제가 보호됩니다.
패키지 비교
| 기능 | 스타터 | Boost | 프리미엄 |
|---|---|---|---|
| 배송 시간 | 2일 | 3일 | 4일 |
| 수정 | 0 | 0 | 0 |
| 제공된 오디오에서 하나의 RVC 또는 So-VITS 모델 학습 | ✓ | ✕ | ✕ |
| RVC 출력:.pth 모델 파일 +.index 파일 | ✓ | ✓ | ✓ |
| So-VITS output: config.json +.pth file +.pt file | ✓ | ✓ | ✓ |
| 최소 ~5분 이상의 고품질 오디오 허용 | ✓ | ✕ | ✕ |
| 로컬 PC 추론을 위해 준비된 파일 전달 | ✓ | ✓ | ✕ |
| 배송 후 훈련된 모델의 무제한 로컬 사용 | ✓ | ✕ | ✕ |
| 스타터의 모든 것, 더 높은 교육 범위 | ✕ | ✓ | ✕ |
| 더 크거나 다양한 오디오 데이터세트에 최적화됨 | ✕ | ✓ | ✕ |
| 모델 정확도 향상을 위한 연장된 교육 기간 | ✕ | ✓ | ✕ |
| Boost의 모든 것, 최대 교육 범위 | ✕ | ✕ | ✓ |
| 가장 정교한 음성 재현을 위한 최고의 에포크 수 | ✕ | ✕ | ✓ |
| 20분 이상의 고품질 데이터셋에 가장 적합 | ✕ | ✕ | ✓ |
| 대기열 내 우선 처리 | ✕ | ✕ | ✓ |
포트폴리오
이 Zinn과 관련된 판매자의 작업 예시.

오디오에서 커스텀 RVC 또는 So-VITS 음성 모델 학습


오디오에서 커스텀 RVC 또는 So-VITS 음성 모델 학습

추가 정보
내 프로세스
완벽한 대상
제가 사용하는 도구
자주 묻는 질문
RVC(Retrieval-based Voice Conversion)는 일반적으로 로컬에서 실행하기 쉽고 커뮤니티 도구에서 널리 지원됩니다. So-VITS-SVC는 매우 자연스러운 결과를 생성할 수 있지만 약간 더 복잡한 로컬 설정이 필요합니다. 확실하지 않은 경우 주문 채팅에 사용 사례를 언급하면 안내를 제공합니다.
최소 약 5분 분량의 깨끗하고 일관되며 고품질 오디오는 작업 가능합니다. 그러나 20분 이상이면 눈에 띄게 더 정확하고 자연스러운 사운드 모델을 얻을 수 있습니다. 소스 오디오의 배경 소음, 음악 또는 심한 잔향은 출력 품질을 저하시키므로 깨끗한 녹음을 강력히 권장합니다.
주문 후, 주문 채팅을 통해 오디오 파일을 직접 업로드하거나 채팅에서 공유된 클라우드 저장소 링크를 사용하세요. 허용되는 형식은 WAV, FLAC, MP3입니다. 최상의 결과를 위해 44.1 kHz 이상의 WAV 또는 FLAC을 권장합니다.
전달된 파일은 Windows 또는 Linux PC에서 CUDA 지원 GPU로 로컬로 실행되는 RVC 및 So-VITS 커뮤니티 인터페이스와 호환되는 표준 모델 체크포인트입니다. 머신에 관련 추론 소프트웨어를 설치해야 합니다. 시작하는 데 도움이 필요한 경우 설정 가이드 추가 기능을 사용할 수 있습니다.
모델 훈련은 창의적인 과정이 아닌 계산 과정입니다. 출력 품질은 제공하는 데이터세트에 직접적으로 연결됩니다. 전달된 파일에 기술적 문제가 있는 경우(예: 손상되었거나 불완전한 파일), 추가 비용 없이 해결됩니다. 다른 데이터세트나 설정으로 재훈련하려면 주문 채팅을 통해 연락하여 옵션을 논의하세요.
제공하는 오디오에 대해 모델을 학습시킬 적절한 권리와 권한을 보유하고 있는지 확인할 책임은 귀하에게 있습니다. 이 서비스는 귀하의 음성, 원본 녹음 또는 명시적 승인을 받은 오디오와 함께 사용하기 위한 것입니다.
스타터 등급은 약 5~20분 분량의 깨끗한 데이터셋으로 간단한 음성 복제에 적합합니다. 부스트 등급은 더 크거나 다양한 데이터셋을 가지고 있고 더 정교한 결과를 원할 때 권장됩니다. 프리미엄 등급은 특히 20분 이상의 오디오와 정확성이 중요한 경우에 최고 품질의 출력을 위해 이상적입니다.
고객 리뷰
이 Zinn에 대해 고객들이 무엇을 말하는지 확인하세요
감사합니다! 정말 멋지게 나왔어요:D ⭐️⭐️⭐️⭐️⭐️
다시 감사합니다! 멋진데요!:D
보컬 모델 주문 배송에 매우 만족했습니다. 프로세스는 빠르고 부드러웠으며, 모든 단계에서 명확한 의사소통이 있었습니다. 제품은 완벽한 상태로 도착했으며, 설명과 정확히 일치했습니다. 이 서비스의 전문성과 효율성을 강력히 추천합니다.
이 상품을 구매한 로그인된 고객만 리뷰를 남길 수 있습니다.








