HsiaoYu
Female • चीनी • Taiwan
HsiaoYu Taiwan के स्वाभाविक लहजे वाली चीनी की एक उच्च गुणवत्ता वाली न्यूरल आवाज़ है, जो वीडियो और पॉडकास्ट के लिए आदर्श है।
क्लिक-टू-टेस्ट स्क्रिप्ट प्रीसेट: HsiaoYu
नीचे दिए गए लाइव सिंथेसाइज़र में सीधे लोड करने के लिए किसी भी प्रीसेट पर क्लिक करें।
साहित्यिक कहानी वाचन उदाहरण
“बंदरगाह से सुबह का कोहरा धीरे-धीरे छंट रहा था, [pause:short] जिससे खाड़ी में लंगर डाले तीन व्यापारी जहाज दिखाई देने लगे। [pause:medium] कप्तान दूरबीन से क्षितिज की ओर देख रहा था, [pause:short] यह सोचते हुए कि वे घर से क्या समाचार लाए हैं।”
प्रचार एवं व्यावसायिक वीडियो स्क्रिप्ट
“क्या आप आवाज बनाने के लिए हर महीने पैसे चुकाकर थक चुके हैं? [pause:short] Open Text to Speech आपको स्टूडियो-ग्रेड न्यूरल आवाजें देता है [pause:medium] बिल्कुल मुफ्त, [pause:short] बिना किसी साइन-अप और तुरंत डाउनलोड के साथ।”
स्वाभाविक ठहराव एवं विराम प्रदर्शन
“यह HsiaoYu की आवाज है, [pause:short] जो स्वाभाविक प्रवाह में बोल रही है। [pause:medium] देखिए कैसे विराम टैग्स सांस लेने के स्वाभाविक अंतराल बनाते हैं [pause:long] बिना किसी बनावटीपन के।”
आवाज़ का परीक्षण करें: HsiaoYu
रीयल-टाइम में HsiaoYu की आवाज़ सुनने के लिए टेक्स्ट टाइप करें।
HsiaoYu ध्वनिक लय एवं स्वर विशेषताएँ
Taiwan में चीनी भाषा के लिए कैलिब्रेटेड न्यूरल वोकोडर। Taiwan के प्रामाणिक लहजे और उच्चारण को वास्तविक रूप में प्रस्तुत करता है।
165 Hz – 255 Hz (स्पष्ट हेड रेज़ोनेंस)
बिना किसी रोबोटिक कर्कशता के शुद्ध स्वर फॉर्मैंट्स (F1-F3)
स्वाभाविक 130–150 शब्द प्रति मिनट की गति सूक्ष्म ठहराव के साथ
साउंड मिक्स में उत्कृष्ट स्पष्टता के लिए कैलिब्रेटेड हार्मोनिक वार्मथ
अनुशंसित उत्पादन क्षेत्र: HsiaoYu
इस न्यूरल आवाज के लिए सर्वोत्तम मीडिया प्रारूप जहाँ यह सबसे अधिक प्रभावशाली है।
कानों को भाने वाली मधुर आवाज जो लंबी कहानियों और साहित्य के लिए सर्वोत्तम है।
स्पष्ट उच्चारण जो पृष्ठभूमि संगीत के साथ भी हर शब्द को स्पष्ट बनाए रखता है।
सरल और स्पष्ट व्याख्यात्मक प्रवाह जो विद्यार्थियों को आसानी से समझ आता है।
गंभीर एवं प्रसारण गुणवत्ता वाली आवाज जो शो को तुरंत पहचान दिलाती है।
HsiaoYu आवाज समायोजन चीट-शीट
पिच, गति और वॉल्यूम स्तर के लिए अनुशंसित सेटिंग्स।
पिच नियंत्रण (सुर)
-10 से +15 (सर्वोत्तम: शांति के लिए -2, ऊर्जा के लिए +4)
बोलने की गति (स्पीड)
-25 से +25 (सर्वोत्तम: ऑडियोबुक के लिए -6, शॉर्ट्स के लिए +10, बातचीत के लिए 0)
डिजिटल वॉल्यूम गेन
85% (ध्यान) से 130% (संगीत पर कमर्शियल वॉयसओवर)
विराम चिह्न और गति वाक्यविन्यास
[pause:short] (~0.5s), [pause:medium] (~1.0s), [pause:long] (~1.6s) और कस्टम टैग जैसे [pause:1.5s] का समर्थन करता है।
तकनीकी ध्वनिक विनिर्देश
| सैंपलिंग आवृत्ति | मास्टर ऑडियो बिटरेट | चैनल लेआउट | शून्य बफर विलंबता | कैश प्रोटोकॉल |
|---|---|---|---|---|
| 24,000 Hz स्टूडियो न्यूरल सिंथेसिस (44.1kHz / 48kHz WAV में बदलने योग्य) | 48 kbps MP3 (स्ट्रीमिंग) / 768 kbps 16-बिट PCM WAV (मास्टरिंग) | मोनो / सेंटर चैनल (वॉयसओवर के लिए उद्योग मानक) | टियर 1 रैम LRU कैश से < 1ms / तुरंत रीयल-टाइम स्ट्रीमिंग | नियत SHA-256 सामग्री-संबोधनीय भंडारण |
चीनी की अन्य आवाजें।
चीनी की सभी आवाजें देखें →HsiaoYu (voice-65) अक्सर पूछे जाने वाले प्रश्न
व्यावसायिक लाइसेंस, ऑडियो प्रारूप और पैरामीटर समायोजन की जानकारी।
HsiaoYu एक अत्याधुनिक न्यूरल वोकोडर पर आधारित है जिसे Taiwan में चीनी के स्वाभाविक उच्चारण पर प्रशिक्षित किया गया है।
हाँ! OpenTTS पर HsiaoYu के साथ बनाई गई सभी आवाजें 100% रॉयल्टी-मुक्त हैं और व्यावसायिक उपयोग के लिए पूरी तरह स्वीकृत हैं।
पिच (-50 से +50) और गति (-50 से +50) स्लाइडर्स का उपयोग करें। कहानियों के लिए -5 और प्रचार वीडियो के लिए +8 गति आदर्श है।
हाँ, आप बिना किसी खाते या शुल्क के 16-bit Linear PCM WAV (24kHz / 48kHz), MP3, OGG, AAC और FLAC में तुरंत डाउनलोड कर सकते हैं।