Zinn Hub
0
장바구니
0

한눈에 보기

이 서비스에 대한 주요 정보로 결정을 내리는 데 도움을 드립니다. Zinn Hub에서 생성됨, 판매자가 아님.

AI 모델 유형

RVC (검색 기반 음성 변환)
RVMPE 방법을 사용하는 RVC 아키텍처를 사용합니다. 이는 최고 품질의 F0 방법으로 간주되며, 강력한 보컬 악센트 재현을 위해 0.7–0.9의 검색률을 제공합니다.

데이터셋 요구사항

20–25분 WAV, 튜닝 없음
교육 오디오는 Google Drive 또는 직접 채팅을 통해 ZIP/RAR로 업로드된 원본, 처리되지 않은 WAV 파일(자동 튜닝 또는 보컬 튜닝 없음)이어야 합니다.

처리 파이프라인

Python MDX NET HQ + 3 메서드
오디오는 Python MDX NET HQ Main을 통해 처리되며, 모델 학습이 시작되기 전에 소스 정리를 위해 MDXVR, ARCH, DEMUCS 및 ENS MODE를 사용합니다.

소요 시간

모델 준비 완료 10시간 – 3일
모델 처리는 10시간에서 1일이 소요되며, 기본 패키지의 배송 기간은 3일입니다. 부스트 및 프리미엄 업그레이드는 배송 기간을 2일로 단축합니다.

받으실 내용

스크린샷이 포함된 버그 보고서
디지털 파일
클라우드 링크
오디오 파일
원본 파일
배송 방법:
주문 관리자
참고: 맞춤형 PTH 모델 파일은 파일 크기에 따라 주문 관리자 또는 공유 클라우드 링크를 통해 전달됩니다. VO 녹음은 고품질 오디오 파일로 전달됩니다. 제출하기 전에 데이터 세트가 WAV 형식 및 20–25분 지속 시간 요구 사항을 충족하는지 확인하십시오. 이는 모델 품질 및 처리 시간에 직접적인 영향을 미칩니다.

전체 설명

음악 프로듀서, 콘텐츠 크리에이터, 성우 또는 개발자 등 누구든 맞춤형 AI 음성 모델을 통해 자신, 캐릭터 또는 아티스트 스타일 등 어떤 대상 음성으로든 사실적인 음성 출력을 생성할 수 있습니다. 이 서비스는 제공된 오디오 데이터 세트를 기반으로 전용 하드웨어에서 전문 도구로 처리하여 완전히 훈련된 RVC(Retrieval-Based Voice Conversion) 모델을 제공합니다.

모든 모델은 Python MDX NET HQ Main과 세 가지 처리 방법을 사용하여 가능한 가장 깨끗한 소스 오디오를 위해 훈련됩니다. AI 모델 자체는 RMVPE 방법을 사용하여 구축되었으며, 이는 최고 품질의 F0 추정 접근 방식으로 널리 알려져 있으며, 대상 음성의 고유한 악센트와 특성을 보존하고 강화하기 위해 0.7–0.9의 검색률을 가집니다. 그 결과는 자체 워크플로에서 사용할 준비가 된 맞춤형 PTH 모델 파일입니다.

데이터셋 준비 과정에는 훈련이 시작되기 전에 모든 인공물, 노이즈 또는 블리드를 제거하기 위한 원본 음성 클리닝이 포함됩니다. 오디오는 깨끗한 RAW WAV 파일로 제공되어야 하며, 보컬 튜닝, 피치 보정 또는 자동 튜닝이 적용되지 않아야 합니다. 최적의 모델 품질을 위해 길이는 20분에서 25분 사이여야 합니다. 데이터셋은 클라우드 링크를 통해 또는 ZIP 또는 RAR 아카이브로 주문 채팅에 직접 전달될 수 있습니다.

모델 생성 외에도 이 서비스는 보컬 분리 작업(악기 제거 및 보컬 제거)과 맞춤형 보이스 오버(VO) 녹음을 포함합니다. VO 작업은 전문 스튜디오 장비를 사용하여 라이브로 수행됩니다. Audio-Technica AT4040 콘덴서 마이크, Arturia MiniFuse 2 오디오 인터페이스, ATH-M40X 모니터링 헤드폰, Aston Halo 아이솔레이션 쉴드를 사용하여 방송 준비가 된 품질을 보장합니다. VO 캐릭터 및 아티스트 스타일 음성은 남성 및 여성 음성 모두에 사용할 수 있습니다. 특정 캐릭터, 아티스트 또는 개성을 염두에 두고 있다면 주문 시 언급해 주십시오.

워크플로우에 적용된 처리 방법에는 MDX, VR Arch, Demucs 및 ESNM 모드가 포함되어 있어 팀이 특정 소스 자료에 최적의 분리 방식을 선택할 수 있는 유연성을 제공합니다.

참고: 보컬 블렌드 요청은 별도의 비용이 발생합니다 — 이것이 적용되는 경우 주문하기 전에 연락하세요.

**누구를 위한 것인가요?**
독창적인 AI 보컬 렌더링을 만들고 싶은 음악 프로듀서, 캐릭터 보이스를 구축하는 게임 개발자 또는 콘텐츠 제작자, 빠른 프로토타이핑을 위해 개인 AI 클론을 원하는 성우, AI 음악 및 음성 기술을 탐구하는 취미 생활자.

**작동 방식:**
1. 주문하고 정리된 WAV 데이터 세트(20–25분, 튜닝 없음)를 업로드합니다.
2. 팀이 원본 오디오를 처리하고 정리한 다음 RMVPE를 사용하여 RVC 모델을 훈련합니다.
3. 완성된 PTH 모델 파일은 합의된 기간 내에 전달됩니다.

모델 처리는 데이터 세트가 수신 및 승인된 시점부터 일반적으로 10시간에서 1일이 소요됩니다.

Zinner 품질 보증

✓
검증된 전문가
모든 Zinner는 플랫폼에 참여하기 전에 검토 및 승인됩니다.
✓
품질 보장
모든 서비스는 당사의 품질 보증 약속으로 뒷받침됩니다.
✓
안전한 결제
배송된 작업을 승인할 때까지 결제가 보호됩니다.

패키지 비교

기능표준Boost프리미엄
배송 시간3일2일2일
수정111
맞춤형 RVC AI 음성 모델(PTH 파일)✓✓✕
최대 25분 분량의 훈련 데이터 세트✓✓✕
원본 음성 클리닝 포함✓✓✕
RMVPE 방법 — 최고 품질의 F0 추정✓✕✕
강한 목소리 캐릭터에 대한 검색률 0.7–0.9✓✕✕
보컬 지원✓✕✕
표준의 모든 것✕✓✕
우선순위 대기열 — 2일 이내에 배송✕✓✕
RMVPE 방식, 검색률 0.7–0.9✕✓✕
부스트의 모든 기능✕✕✓
맞춤형 음성 녹음 (선택한 캐릭터 또는 아티스트 음성)✕✕✓
AT4040 마이크, Arturia MiniFuse 2 및 Aston Halo 격리 실드로 녹음됨✕✕✓
남성 또는 여성 VO 스타일 사용 가능✕✕✓
악기 또는 보컬 제거 포함✕✕✓
방송용 오디오 품질✕✕✓

포트폴리오

이 Zinn과 관련된 판매자의 작업 예시.

RVC를 사용하여 맞춤형 AI 음성 모델 만들기

RVC를 사용하여 맞춤형 AI 음성 모델 만들기

추가 정보

내 프로세스

5단계 1 — 데이터셋 검토:처리 시작 전에 WAV 데이터셋의 길이, 형식 준수 여부, 오디오 청결도가 검토됩니다.
단계 2 — 소스 음성 클리닝:MDX, VR Arch, Demucs 및 ESNM 모드 분리 방법을 사용하여 노이즈, 아티팩트 및 블리드를 제거합니다.
단계 3 — RVC 모델 훈련:정제된 데이터셋은 RMVPE F0 방법을 사용하여 0.7–0.9의 검색률로 맞춤형 AI 음성 모델을 훈련하는 데 사용됩니다.
단계 4 — 전달:완성된 PTH 모델 파일(및 해당되는 경우 VO 녹음 파일)은 합의된 기간 내에 주문 관리자를 통해 전달됩니다.

제가 사용하는 도구

AI 모델 훈련:Python MDX NET HQ Main — RMVPE F0 메서드를 사용한 RVC, 검색률 0.7–0.9
오디오 분리:MDX, VR Arch, Demucs, ESNM Mode
녹음 장비:AT4040 콘덴서 마이크, Arturia MiniFuse 2 인터페이스, ATH-M40X 헤드폰, Aston Halo 아이솔레이션 쉴드

완벽한 대상

가장 큰 혜택을 받는 사람:AI 보컬 렌더링을 만드는 음악 프로듀서|캐릭터 보이스를 구축하는 게임 개발자 및 콘텐츠 제작자|개인 AI 보이스 클론을 프로토타이핑하는 성우|AI 음악 및 보이스 합성을 탐구하는 아티스트 및 취미가|전문적인 보컬 분리 또는 제거가 필요한 모든 사람

자주 묻는 질문

데이터 세트는 WAV 파일 형식이어야 하며 총 길이가 20분에서 25분 사이여야 합니다. 녹음은 보컬 튜닝, 피치 보정 또는 자동 튜닝이 적용되지 않은 RAW 테이크여야 합니다. 이러한 요소는 모델 품질을 크게 저하시킬 수 있습니다.

ZIP 또는 RAR 아카이브로 주문 채팅에 직접 파일을 업로드하거나 클라우드 스토리지 링크(예: Google Drive)를 통해 공유할 수 있습니다. 두 방법 모두 동일하게 작동합니다.

데이터 세트가 접수 및 승인되면 처리는 일반적으로 10시간에서 1일 사이가 소요됩니다. 총 배송 시간은 이 처리 기간을 포함하므로 명시된 전체 배송 기간을 허용하십시오.

자신의 RVC 호환 환경 또는 소프트웨어에 로드할 수 있는 맞춤형 PTH 모델 파일을 받게 됩니다. 보이스오버도 주문한 경우 녹음된 오디오 파일을 받게 됩니다.

RMVPE(Robust Model for Vocal Pitch Estimation)는 현재 RVC 모델 훈련에 사용되는 최고 품질의 F0 피치 감지 방법입니다. 특히 노래 애플리케이션의 경우 다른 방법에 비해 더 정확하고 자연스러운 음성 변환을 생성합니다.

예 — 프리미엄 패키지에는 맞춤형 VO 녹음이 포함됩니다. 남성 또는 여성 목소리를 요청하고 아티스트, 캐릭터 또는 성격 스타일을 지정할 수 있습니다. 주문할 때 이러한 세부 정보를 포함해주세요.

보컬 블렌드는 두 개 이상의 음성 소스 요소를 결합합니다. 이는 별도의 서비스이며 자체 요금이 부과되며 여기에 나열된 어떤 패키지에도 포함되지 않습니다. 이 서비스가 필요한 경우 주문 전에 메시지를 보내주십시오.

각 패키지에는 한 번의 수정이 포함됩니다. 결과물이 합의된 범위에 미치지 못하는 경우, 주문 채팅을 통해 알려주시면 팀에서 처리해 드립니다. 품질 저하의 가장 흔한 원인은 튜닝, 노이즈가 포함되어 있거나 권장 20분보다 짧은 오디오 데이터셋이므로, 깨끗하고 충분한 원본 자료가 필수적입니다.

고객 리뷰

이 Zinn에 대해 고객들이 무엇을 말하는지 확인하세요

5.0
5 리뷰
5 ⭐
5
4 ⭐
0
3 ⭐
0
2 ⭐
0
1 ⭐
0

고마워, 친구!

훌륭한 제품과 판매자 – 다른 제품보다 우수합니다. 제 모델에 매우 만족하며 이제 많은 프로젝트를 수행할 수 있을 것입니다!

그가 하는 일에 있어서 최고 중 한 명

훌륭한 작업

평소처럼 훌륭합니다! 빠르고 전문적입니다!

이 상품을 구매한 로그인된 고객만 리뷰를 남길 수 있습니다.

카테고리

Zinner 정책

텍스트 음성 변환을 포함한 맞춤형 AI 음성 모델 만들기

이 상품을 구매한 로그인된 고객만 리뷰를 남길 수 있습니다.

옵션 & 주문

Zinn Hub 앱 다운로드

알림 · 빠른 접근 · 전체 화면

브라우저에서 공유를 탭하세요

➜ 그 다음 "홈 화면에 추가"를 탭하세요