0
आपका कार्ट
0
Zinn Hub
0
आपका कार्ट
0

एक नज़र में

यह तय करने में आपकी मदद करने के लिए इस सेवा के बारे में मुख्य विवरण। Zinn Hub द्वारा जेनरेट किया गया, विक्रेता द्वारा नहीं।

एआई मॉडल प्रकार

RVC (पुनर्प्राप्ति-आधारित आवाज रूपांतरण)
RVMPE विधि के साथ RVC आर्किटेक्चर का उपयोग करता है — जिसे उच्चतम गुणवत्ता वाली F0 विधि माना जाता है — और मजबूत मुखर उच्चारण प्रजनन के लिए 0.7–0.9 की पुनर्प्राप्ति दर।

डेटासेट आवश्यकताएँ

20–25 मिनट WAV, कोई ट्यूनिंग नहीं
आपकी प्रशिक्षण ऑडियो कच्ची, अप्रसंस्कृत WAV फ़ाइलें होनी चाहिए (कोई ऑटोट्यून या वोकल ट्यूनिंग नहीं) जिसे Google Drive या डायरेक्ट चैट के माध्यम से ZIP/RAR के रूप में अपलोड किया गया हो।

प्रसंस्करण पाइपलाइन

पायथन एमडीएक्स नेट मुख्यालय + 3 तरीके
मॉडल प्रशिक्षण शुरू होने से पहले स्रोत सफाई के लिए MDXVR, ARCH, DEMUCS, और ENS MODE का उपयोग करके ऑडियो को Python MDX NET HQ Main के माध्यम से संसाधित किया जाता है।

टर्नअराउंड टाइम

मॉडल 10 घंटे – 3 दिनों में तैयार
मॉडल प्रोसेसिंग में 10 घंटे और 1 दिन के बीच का समय लगता है, जिसमें बेस पैकेज पर 3-दिन की डिलीवरी विंडो होती है। बूस्ट और प्रीमियम अपग्रेड डिलीवरी को 2 दिनों तक कम कर देते हैं।

आपको क्या मिलेगा

प्रारूप:
डिजिटल फ़ाइलें
क्लाउड लिंक
ऑडियो फ़ाइलें
स्रोत फ़ाइलें
वितरण विधि:
ऑर्डर मैनेजर
नोट्स: आपकी कस्टम PTH मॉडल फ़ाइल फ़ाइल आकार के आधार पर ऑर्डर मैनेजर या साझा क्लाउड लिंक के माध्यम से वितरित की जाएगी। VO रिकॉर्डिंग उच्च-गुणवत्ता वाली ऑडियो फ़ाइलों के रूप में वितरित की जाती हैं। कृपया सुनिश्चित करें कि आपका डेटासेट सबमिट करने से पहले WAV प्रारूप और 20–25 मिनट की अवधि की आवश्यकता को पूरा करता है — यह सीधे मॉडल गुणवत्ता और प्रसंस्करण समय को प्रभावित करता है।

पूर्ण विवरण

चाहे आप एक संगीत निर्माता, सामग्री निर्माता, वॉयस एक्टर, या डेवलपर हों, एक कस्टम एआई वॉयस मॉडल आपको किसी भी लक्षित आवाज में यथार्थवादी मुखर आउटपुट उत्पन्न करने देता है - आपकी अपनी, एक चरित्र की, या एक कलाकार की शैली। यह सेवा आपके प्रदान किए गए ऑडियो डेटासेट से निर्मित और समर्पित हार्डवेयर पर पेशेवर उपकरणों के साथ संसाधित एक पूरी तरह से प्रशिक्षित आरवीसी (पुनर्प्राप्ति-आधारित वॉयस रूपांतरण) मॉडल प्रदान करती है।

प्रत्येक मॉडल को पायथन एमडीएक्स नेट मुख्यालय मेन और सबसे स्वच्छ संभव स्रोत ऑडियो के लिए तीन प्रसंस्करण विधियों का उपयोग करके प्रशिक्षित किया जाता है। एआई मॉडल स्वयं आरएमवीपीई विधि का उपयोग करके बनाया गया है - जिसे उच्चतम गुणवत्ता वाले एफ0 अनुमान दृष्टिकोण के रूप में व्यापक रूप से माना जाता है - आपकी लक्षित आवाज के अद्वितीय उच्चारण और चरित्र को संरक्षित और मजबूत करने के लिए 0.7–0.9 की पुनर्प्राप्ति दर के साथ। परिणाम आपके स्वयं के वर्कफ़्लो में उपयोग के लिए तैयार एक कस्टम पीटीएच मॉडल फ़ाइल है।

डेटासेट तैयार करने की प्रक्रिया में प्रशिक्षण शुरू होने से पहले किसी भी कलाकृति, शोर या रक्तस्राव को दूर करने के लिए स्रोत आवाज की सफाई शामिल है। आपके ऑडियो को एक साफ, रॉ WAV फ़ाइल के रूप में आपूर्ति किया जाना चाहिए - कोई मुखर ट्यूनिंग, पिच सुधार, या ऑटो-ट्यून लागू नहीं किया गया है - और इष्टतम मॉडल गुणवत्ता के लिए 20 और 25 मिनट के बीच की अवधि का होना चाहिए। डेटासेट को क्लाउड लिंक के माध्यम से या सीधे ऑर्डर चैट में ZIP या RAR संग्रह के रूप में वितरित किया जा सकता है।

मॉडल बनाने के अलावा, यह सेवा वोकल आइसोलेशन कार्यों (इंस्ट्रुमेंटल रिमूवल और वोकल रिमूवल) के साथ-साथ विशेष वॉयस-ओवर (VO) रिकॉर्डिंग को भी कवर करती है। VO का काम पेशेवर स्टूडियो उपकरण का उपयोग करके लाइव किया जाता है: एक ऑडियो-टेक्निका AT4040 कंडेनसर माइक्रोफोन, आर्टुरिया मिनीफ्यूज 2 ऑडियो इंटरफ़ेस, ATH-M40X मॉनिटरिंग हेडफ़ोन, और एक एस्टन हेलो आइसोलेशन शील्ड — जो प्रसारण-तैयार गुणवत्ता सुनिश्चित करता है। VO कैरेक्टर और कलाकार-शैली की आवाजें पुरुष और महिला दोनों आवाजों के लिए उपलब्ध हैं। यदि आपके मन में कोई विशिष्ट कैरेक्टर, कलाकार, या व्यक्तित्व है, तो कृपया ऑर्डर देते समय इसका उल्लेख करें।

कार्यप्रवाह में लागू की गई प्रसंस्करण विधियों में MDX, VR Arch, Demucs, और ESNM मोड शामिल हैं, जो टीम को आपकी विशिष्ट स्रोत सामग्री के लिए सर्वोत्तम पृथक्करण दृष्टिकोण चुनने की सुविधा प्रदान करते हैं।

ध्यान दें: वोकल ब्लेंड अनुरोधों के लिए एक अलग शुल्क लगता है — यदि यह आप पर लागू होता है तो कृपया ऑर्डर करने से पहले संपर्क करें।

**यह किसके लिए है?**
संगीत निर्माता जो मूल एआई वोकल रेंडरिंग बनाना चाहते हैं, गेम डेवलपर या सामग्री निर्माता जो चरित्र आवाजें बना रहे हैं, आवाज अभिनेता जो तेजी से प्रोटोटाइप के लिए एक व्यक्तिगत एआई क्लोन चाहते हैं, और शौकिया जो एआई संगीत और आवाज प्रौद्योगिकी की खोज कर रहे हैं।

**यह कैसे काम करता है:**
1. अपना ऑर्डर दें और अपना साफ़ किया गया WAV डेटासेट अपलोड करें (20–25 मिनट, कोई ट्यूनिंग नहीं)।
2. टीम आपके स्रोत ऑडियो को प्रोसेस और साफ़ करती है, फिर RMVPE का उपयोग करके आपके RVC मॉडल को प्रशिक्षित करती है।
3. आपकी तैयार PTH मॉडल फ़ाइल सहमत समय-सीमा के भीतर वितरित कर दी जाती है।

आपके डेटासेट प्राप्त होने और स्वीकृत होने के बाद मॉडल प्रोसेसिंग में आमतौर पर 10 घंटे से 1 दिन लगते हैं।

Zinner गुणवत्ता गारंटी

✓
जांचा गया पेशेवर
प्लेटफ़ॉर्म में शामिल होने से पहले हर Zinner की समीक्षा की जाती है और उसे अनुमोदित किया जाता है।
✓
गुणवत्तापूर्ण कार्य की गारंटी
सभी सेवाएँ हमारी गुणवत्ता आश्वासन प्रतिबद्धता द्वारा समर्थित हैं।
✓
सुरक्षित भुगतान
आपके द्वारा दिए गए काम को मंज़ूरी देने तक आपका भुगतान सुरक्षित है।

पैकेजों की तुलना करें

फ़ीचरमानकबढ़ावाप्रीमियम
डिलीवरी का समय3 दिन2 दिन2 दिन
संशोधन111
कस्टम आरवीसी एआई वॉयस मॉडल (पीटीएच फाइल)✓✓✕
प्रशिक्षण डेटासेट के 25 मिनट तक✓✓✕
स्रोत आवाज की सफाई शामिल है✓✓✕
RMVPE विधि — उच्चतम गुणवत्ता वाला F0 अनुमान✓✕✕
मजबूत आवाज वाले चरित्र के लिए पुनर्प्राप्ति दर 0.7–0.9✓✕✕
गायन स्वर समर्थित✓✕✕
मानक में सब कुछ✕✓✕
प्राथमिकता कतार — 2 दिनों में वितरित✕✓✕
पुनर्प्राप्ति दर 0.7–0.9 के साथ आरएमवीपीई विधि✕✓✕
बूस्ट में सब कुछ✕✕✓
बेस्पोक वॉयस-ओवर रिकॉर्डिंग (आपका चुना हुआ चरित्र या कलाकार की आवाज़)✕✕✓
AT4040 माइक, Arturia MiniFuse 2 और Aston Halo आइसोलेशन शील्ड के साथ रिकॉर्ड किया गया✕✕✓
पुरुष या महिला VO शैलियाँ उपलब्ध हैं✕✕✓
वाद्य या मुखर हटाना शामिल है✕✕✓
प्रसारण-तैयार ऑडियो गुणवत्ता✕✕✓

पोर्टफोलियो

इस Zinn से संबंधित विक्रेता के काम के उदाहरण।

RVC का उपयोग करके एक कस्टम AI वॉयस मॉडल बनाएं

RVC का उपयोग करके एक कस्टम AI वॉयस मॉडल बनाएं

अतिरिक्त जानकारी

मेरी प्रक्रिया

चरण 1 — डेटासेट समीक्षा:प्रसंस्करण शुरू होने से पहले आपके WAV डेटासेट की लंबाई, प्रारूप अनुपालन और ऑडियो स्वच्छता के लिए समीक्षा की जाती है।
चरण 2 — स्रोत ध्वनि सफाई:MDX, VR Arch, Demucs, और ESNM मोड पृथक्करण विधियों का उपयोग करके शोर, कलाकृतियों और रक्तस्राव को हटा दिया जाता है।
चरण 3 — आरवीसी मॉडल प्रशिक्षण:आपके कस्टम एआई वॉयस मॉडल को आरएमवीपीई एफ0 विधि का उपयोग करके 0.7–0.9 की पुनर्प्राप्ति दर के साथ प्रशिक्षित करने के लिए साफ किए गए डेटासेट का उपयोग किया जाता है।
चरण 4 — डिलीवरी:आपकी तैयार PTH मॉडल फ़ाइल (और यदि लागू हो तो कोई भी VO रिकॉर्डिंग) सहमत समय-सीमा के भीतर ऑर्डर मैनेजर के माध्यम से वितरित की जाती है।

मैं जिन उपकरणों का उपयोग करता हूँ

AI मॉडल प्रशिक्षण:पायथन MDX NET HQ मेन — RMVPE F0 विधि के साथ RVC, पुनर्प्राप्ति दर 0.7–0.9
ऑडियो सेपरेशन:MDX, VR Arch, Demucs, ESNM Mode
रिकॉर्डिंग उपकरण:AT4040 कंडेंसर माइक्रोफोन, आर्टुरिया मिनीफ्यूज 2 इंटरफ़ेस, ATH-M40X हेडफ़ोन, एस्टन हेलो आइसोलेशन शील्ड

इसके लिए बिल्कुल सही

किसे सबसे अधिक लाभ होता है:एआई वोकल रेंडरिंग बनाने वाले संगीत निर्माता|चरित्र आवाज़ें बनाने वाले गेम डेवलपर और सामग्री निर्माता|एक व्यक्तिगत एआई वॉयस क्लोन का प्रोटोटाइप करने वाले वॉयस एक्टर|एआई संगीत और वॉयस सिंथेसिस की खोज करने वाले कलाकार और शौकीन|पेशेवर वोकल आइसोलेशन या हटाने की आवश्यकता वाले कोई भी व्यक्ति

अक्सर पूछे जाने वाले प्रश्न

आपका डेटासेट WAV फ़ाइल स्वरूप में होना चाहिए और कुल अवधि में 20 और 25 मिनट के बीच होना चाहिए। कृपया सुनिश्चित करें कि रिकॉर्डिंग RAW टेक्स हैं जिनमें कोई वोकल ट्यूनिंग, पिच करेक्शन या ऑटो-ट्यून लागू नहीं किया गया है - ये मॉडल की गुणवत्ता को काफी कम कर सकते हैं।

आप अपनी फ़ाइलों को सीधे ऑर्डर चैट में ZIP या RAR संग्रह के रूप में अपलोड कर सकते हैं, या उन्हें क्लाउड स्टोरेज लिंक (जैसे Google Drive) के माध्यम से साझा कर सकते हैं। दोनों तरीके समान रूप से काम करते हैं।

एक बार जब आपका डेटासेट प्राप्त और स्वीकृत हो जाता है, तो प्रोसेसिंग में आमतौर पर 10 घंटे और 1 दिन लगते हैं। कुल डिलीवरी समय में यह प्रोसेसिंग विंडो शामिल है, इसलिए कृपया पूरी बताई गई डिलीवरी अवधि की अनुमति दें।

आपको अपनी कस्टम PTH मॉडल फ़ाइल प्राप्त होगी, जिसे आप अपने स्वयं के RVC-संगत वातावरण या सॉफ़्टवेयर में लोड कर सकते हैं। यदि आपने वॉयस-ओवर का भी ऑर्डर दिया है, तो आपको रिकॉर्ड की गई ऑडियो फ़ाइल प्राप्त होगी।

RMVPE (Robust Model for Vocal Pitch Estimation) F0 पिच डिटेक्शन की सबसे उच्च-गुणवत्ता वाली विधि है जिसका उपयोग वर्तमान में RVC मॉडल प्रशिक्षण में किया जाता है। यह अन्य विधियों की तुलना में अधिक सटीक और स्वाभाविक लगने वाला वॉइस रूपांतरण उत्पन्न करता है, विशेष रूप से गायन अनुप्रयोगों के लिए।

हाँ — प्रीमियम पैकेज में एक विशेष VO रिकॉर्डिंग शामिल है। आप पुरुष या महिला आवाज़ों का अनुरोध कर सकते हैं और कलाकार, चरित्र या व्यक्तित्व शैली निर्दिष्ट कर सकते हैं जो आपके दिमाग में है। कृपया अपना ऑर्डर देते समय इन विवरणों को शामिल करें।

एक वोकल ब्लेंड दो या दो से अधिक आवाज स्रोतों के तत्वों को जोड़ता है। यह अपनी फीस के साथ एक अलग सेवा है और यहां सूचीबद्ध किसी भी पैकेज में शामिल नहीं है। यदि आपको इसकी आवश्यकता है तो कृपया ऑर्डर करने से पहले संदेश भेजें।

प्रत्येक पैकेज में एक संशोधन शामिल है। यदि आउटपुट सहमत दायरे को पूरा नहीं करता है, तो कृपया इसे ऑर्डर चैट के माध्यम से उठाएं और टीम इसे संबोधित करेगी। कम गुणवत्ता का सबसे आम कारण ऑडियो डेटासेट है जिसमें ट्यूनिंग, शोर होता है, या अनुशंसित 20 मिनट से कम होता है - इसलिए स्वच्छ, पर्याप्त स्रोत सामग्री आवश्यक है।

ग्राहक समीक्षाएँ

देखें कि हमारे ग्राहक इस Zinn के बारे में क्या कहते हैं

5.0
5 समीक्षाएँ
5 ⭐
5
4 ⭐
0
3 ⭐
0
2 ⭐
0
1 ⭐
0

धन्यवाद, दोस्त!

उत्कृष्ट उत्पाद और विक्रेता – दूसरों से बेहतर। मैं अपने मॉडल से बहुत खुश हूँ और अब कई परियोजनाएँ कर पाऊँगा!

वह जो करता है उसमें सबसे अच्छा है

महान काम

वह हमेशा की तरह बहुत अच्छे हैं! त्वरित और पेशेवर!

केवल लॉग इन ग्राहक जिन्होंने यह उत्पाद खरीदा है, वे समीक्षा छोड़ सकते हैं।

श्रेणियाँ

Zinner नीतियां

टेक्स्ट टू स्पीच सहित कोई भी कस्टम एआई वॉयस मॉडल बनाएं

केवल लॉग इन ग्राहक जिन्होंने यह उत्पाद खरीदा है, वे समीक्षा छोड़ सकते हैं।

विकल्प और आदेश

Zinn Hub ऐप प्राप्त करें

सूचनाएँ · तेज़ पहुँच · पूर्ण-स्क्रीन

अपने ब्राउज़र में शेयर पर टैप करें

➜ फिर "होम स्क्रीन में जोड़ें" पर टैप करें