पहुंच और स्क्रीन रीडर्स के लिए एआई आवाजें

पहुंच और स्क्रीन रीडर्स के लिए एआई आवाजें

स्क्रीन रीडर का अनुभव रखने वाले यूज़र अक्सर इसे सामान्य से काफी अधिक गति पर चलाते हैं। इसकी गति को 0.5 से 2.0 तक एडजस्ट किया जा सकता है, और इसमें नौ भारतीय भाषाओं को शामिल किया गया है, जहाँ पूरे उद्योग में सहायक ऑडियो की उपलब्धता काफी कम है।

एक्सेसिबिलिटी वॉइस एआई

इस उपयोग मामले के लिए आवाजें

आंद्रेईandrei
पुरुषयुवारूसी
फिनfinn
पुरुषयुवाजर्मन
चरणcharan
पुरुषयुवाभारतीय
सोलवेगsolveig
महिलायुवानॉर्वेजियन
Best for नॉर्वेजियनआवाज़ का उपयोग करें
निकोलाईnikolai
पुरुषयुवारूसी
आर्यनaryan
पुरुषयुवाभारतीय

गति सुनने वाले पर निर्भर करती है

स्क्रीन रीडर के अनुभवी उपयोगकर्ता अक्सर 1.0 से काफी अधिक की गति पसंद करते हैं, जो कि अधिकांश सामान्य दृष्टि वाले डिजाइनरों के लिए सहज नहीं होगी। गति को 0.5 से 2.0 तक समायोजित किया जा सकता है, और सही निर्णय उपयोगकर्ता की ओर से कोई डिफ़ॉल्ट चुनने के बजाय उस नियंत्रण को उपलब्ध कराना है।

व्यक्तित्व से बढ़कर पूर्वानुमेयता

सहायक ऑडियो लगातार सुनाई देता है, इसलिए एक एक्सप्रेसिव (अभिव्यंजक) आवाज़ उस तरह से थका देने वाली हो जाती है जैसी कि वह वर्णन (नरेशन) में नहीं होती। अलग-अलग रेंडर के दौरान निरंतरता का होना चरित्र से अधिक मायने रखता है। इसमें कोई भावना (इमोशन) पैरामीटर भी नहीं है, जो इस संदर्भ में एक सीमा के बजाय एक विशेषता के अधिक करीब है।

भारतीय भाषा कवरेज

नौ भारतीय भाषाओं में अनुशंसित आवाज़ें उपलब्ध हैं। तमिल, तेलुगु, कन्नड़, मलयालम, मराठी, गुजराती, पंजाबी, ओडिया और बंगाली में स्क्रीन रीडर सपोर्ट पूरे उद्योग में काफी कम है, जो इसे कैटलॉग का वह हिस्सा बनाता है जिसके पीछे स्पष्ट रूप से सुगमता (एक्सेसिबिलिटी) का तर्क है।

स्वयं अनुरूपता (conformance) बनाना

इसमें पहले से तैयार कोई सुलभता एकीकरण (एक्सेसिबिलिटी इंटीग्रेशन) नहीं है। जो उपलब्ध है, वह है गति नियंत्रण (स्पीड कंट्रोल), बारह भाषाओं और स्ट्रीमिंग ट्रांसपोर्ट वाला एक एपीआई। ऑडियो की घोषणा कैसे की जाती है और इसे कैसे रोका जाता है, इसके सहित अनुपालन (कन्फर्मेंस) का कार्य आपके एप्लिकेशन में ही रहता है। वॉयस लेयर उस कार्य को डिलीवर करने के बजाय उसका समर्थन करती है।

विनिर्देश

नमूना दर

44.1 kHz मूल, टेलीफोनी के लिए 8 kHz पर पुनः नमूनाकृत (resampled)

विलंबता

~200 ms पहले बाइट तक (p50, वॉर्म रीज़न)

आउटपुट फ़ॉर्मेट

यूलॉ (ulaw), एलॉ (alaw), पीसीएम (PCM) 16-बिट, वेव (WAV), एमपी3 (MP3)

स्ट्रीमिंग ट्रांसपोर्ट्स

वेबसॉकेट (WebSocket), HTTP चंक्ड ट्रांसफर (chunked transfer)

गति सीमा

0.5× – 2.0×, प्रति अनुरोध पर सेट

इसके जैसी आवाज़ें खोजें

पहुंच और स्क्रीन रीडर्स के लिए एआई आवाजें

ई-लर्निंग वॉइस ओवर

ई-लर्निंग के लिए एआई आवाजें

कोर्स का ऑडियो मॉड्यूल दस में भी वैसा ही सुनाई देना चाहिए जैसा मॉड्यूल एक में सुनाई देता है। ये आवाजें सभी सेशन के दौरान एक जैसी बनी रहती हैं, उच्चारण शब्दकोशों (डिक्शनरी) के ज़रिए तकनीकी शब्दावली को संभालती हैं, और अंग्रेजी के साथ-साथ नौ भारतीय भाषाओं को कवर करती हैं।

घोषणा आवाज़ जनरेटर

घोषणाओं और सार्वजनिक परिवहन के लिए एआई आवाजें

घोषणाएँ गूंजते हुए हॉलों में सुनी जाती हैं और हजारों बार दोहराई जाती हैं। उच्चारण शब्दकोश स्टेशनों और स्थानों के नामों को स्थायी रूप से तय करते हैं, यूलॉ (ulaw) और एलॉ (alaw) सीधे पब्लिक एड्रेस हार्डवेयर को फीड करते हैं, और एक ही आवाज पूरी बहुभाषी श्रृंखला को संभालती है।

ऑडियोबुक वॉयस जनरेटर

ऑडियोबुक वर्णन के लिए एआई आवाजें

एक उपन्यास हजारों अनुरोधों को आपस में सिलकर बनता है, और जहां ये जोड़ होते हैं वहीं से कहानी बिखरने लगती है। ये आवाजें पूरी किताब में एक जैसी बनी रहती हैं और नौ ऐसी भारतीय भाषाओं को कवर करती हैं जिन्हें अधिकांश विक्रेता उपलब्ध नहीं कराते हैं।

शांत एआई आवाजें

शांत आवाजें

शांति आवाज़ से ज़्यादा गति से आती है। गति घटकर 0.5 तक आ जाती है, और ठहराव किसी पैरामीटर के बजाय विराम चिह्नों से आते हैं, इसलिए स्क्रिप्ट उतना ही काम करती है जितना कि कास्टिंग।

संवादात्मक एआई आवाजें

संवादात्मक आवाजें

एक सौ पचानवे आवाज़ें बातचीत के अंदाज़ को दर्शाती हैं, जो पूरे कैटलॉग का 84 प्रतिशत है। स्ट्रीमिंग ही उन्हें लाइव होने का अहसास कराती है: वाक्य का रेंडरिंग पूरा होने से पहले ही ऑडियो बजना शुरू हो जाता है।

बहुभाषी एआई आवाजें

बहुभाषी और कोड-स्विचिंग एआई आवाजें

बहत्तर आवाजें ग्यारह भारतीय भाषाओं के साथ-साथ अंग्रेजी को कवर करती हैं, इसलिए एक ही आवाज बिना किसी बदलाव के हिंदी कॉलर और तमिल कॉलर दोनों के काम आती है। एक ही वाक्य के भीतर हिंदी और अंग्रेजी बारी-बारी से आ सकती हैं।

एआई पॉडकास्ट वॉयस जनरेटर

पॉडकास्ट बनाने के लिए एआई आवाज़ें

पॉडकास्ट प्रोडक्शन पहले से ही सेगमेंट आधारित है, जो शॉर्ट कॉल्स में जनरेशन के लिए अनुकूल है। इंट्रो और विज्ञापन रीड़स एक बार जनरेट होते हैं और कैश हो जाते हैं, और अलग-अलग आवाज़ों को मिलाने से बिना दो लोगों को बुक किए एक टू-हैंडर (दो लोगों का शो) तैयार हो जाता है।

आईवीआर (IVR) वॉयस जनरेटर

आईवीआर (IVR) और टेलीफोनी के लिए एआई (AI) आवाजें

आईवीआर (IVR) आवाज़ों को केवल ब्राउज़र में अच्छा नहीं लगना चाहिए, बल्कि उन्हें कंप्रेस्ड फोन लाइन पर भी सही से काम करना चाहिए। ये सीधे ulaw और alaw आउटपुट देते हैं, लगभग 200 मिलीसेकंड में जेनरेट होते हैं, और एक ही प्रॉम्प्ट में हिंदी और अंग्रेजी दोनों को संभाल सकते हैं।

ध्यान आवाज जनरेटर

ध्यान और कल्याण के लिए एआई आवाजें

गाइडेड ऑडियो आवाज़ के चरित्र के बजाय पेसिंग पर निर्भर करता है। स्पीड को 0.5 तक कम किया जा सकता है, ठहराव इस बात से तय होते हैं कि आप स्क्रिप्ट कैसे लिखते हैं, और क्षेत्रीय वेलनेस कंटेंट के लिए नौ भारतीय भाषाएं उपलब्ध हैं।

ग्राहक सहायता के लिए एआई वॉयस

ग्राहक सहायता स्वचालन के लिए एआई वॉयस

सपोर्ट कॉल उन लोगों तक पहुँचती हैं जो पहले से ही परेशान हैं, और अक्सर ख़राब नेटवर्क लाइन पर होते हैं। ये आवाज़ें चरित्र की तुलना में स्पष्टता को अधिक पसंद करती हैं, अलग-अलग रेंडर में स्थिर रहती हैं, और हिंदी और अंग्रेजी के बीच उसी तरह से बदलती हैं जैसे कॉल करने वाले वास्तव में करते हैं।

ई-लर्निंग वॉइस ओवर

ई-लर्निंग के लिए एआई आवाजें

कोर्स का ऑडियो मॉड्यूल दस में भी वैसा ही सुनाई देना चाहिए जैसा मॉड्यूल एक में सुनाई देता है। ये आवाजें सभी सेशन के दौरान एक जैसी बनी रहती हैं, उच्चारण शब्दकोशों (डिक्शनरी) के ज़रिए तकनीकी शब्दावली को संभालती हैं, और अंग्रेजी के साथ-साथ नौ भारतीय भाषाओं को कवर करती हैं।

घोषणा आवाज़ जनरेटर

घोषणाओं और सार्वजनिक परिवहन के लिए एआई आवाजें

घोषणाएँ गूंजते हुए हॉलों में सुनी जाती हैं और हजारों बार दोहराई जाती हैं। उच्चारण शब्दकोश स्टेशनों और स्थानों के नामों को स्थायी रूप से तय करते हैं, यूलॉ (ulaw) और एलॉ (alaw) सीधे पब्लिक एड्रेस हार्डवेयर को फीड करते हैं, और एक ही आवाज पूरी बहुभाषी श्रृंखला को संभालती है।

ऑडियोबुक वॉयस जनरेटर

ऑडियोबुक वर्णन के लिए एआई आवाजें

एक उपन्यास हजारों अनुरोधों को आपस में सिलकर बनता है, और जहां ये जोड़ होते हैं वहीं से कहानी बिखरने लगती है। ये आवाजें पूरी किताब में एक जैसी बनी रहती हैं और नौ ऐसी भारतीय भाषाओं को कवर करती हैं जिन्हें अधिकांश विक्रेता उपलब्ध नहीं कराते हैं।

शांत एआई आवाजें

शांत आवाजें

शांति आवाज़ से ज़्यादा गति से आती है। गति घटकर 0.5 तक आ जाती है, और ठहराव किसी पैरामीटर के बजाय विराम चिह्नों से आते हैं, इसलिए स्क्रिप्ट उतना ही काम करती है जितना कि कास्टिंग।

संवादात्मक एआई आवाजें

संवादात्मक आवाजें

एक सौ पचानवे आवाज़ें बातचीत के अंदाज़ को दर्शाती हैं, जो पूरे कैटलॉग का 84 प्रतिशत है। स्ट्रीमिंग ही उन्हें लाइव होने का अहसास कराती है: वाक्य का रेंडरिंग पूरा होने से पहले ही ऑडियो बजना शुरू हो जाता है।

बहुभाषी एआई आवाजें

बहुभाषी और कोड-स्विचिंग एआई आवाजें

बहत्तर आवाजें ग्यारह भारतीय भाषाओं के साथ-साथ अंग्रेजी को कवर करती हैं, इसलिए एक ही आवाज बिना किसी बदलाव के हिंदी कॉलर और तमिल कॉलर दोनों के काम आती है। एक ही वाक्य के भीतर हिंदी और अंग्रेजी बारी-बारी से आ सकती हैं।

ई-लर्निंग वॉइस ओवर

ई-लर्निंग के लिए एआई आवाजें

कोर्स का ऑडियो मॉड्यूल दस में भी वैसा ही सुनाई देना चाहिए जैसा मॉड्यूल एक में सुनाई देता है। ये आवाजें सभी सेशन के दौरान एक जैसी बनी रहती हैं, उच्चारण शब्दकोशों (डिक्शनरी) के ज़रिए तकनीकी शब्दावली को संभालती हैं, और अंग्रेजी के साथ-साथ नौ भारतीय भाषाओं को कवर करती हैं।

घोषणा आवाज़ जनरेटर

घोषणाओं और सार्वजनिक परिवहन के लिए एआई आवाजें

घोषणाएँ गूंजते हुए हॉलों में सुनी जाती हैं और हजारों बार दोहराई जाती हैं। उच्चारण शब्दकोश स्टेशनों और स्थानों के नामों को स्थायी रूप से तय करते हैं, यूलॉ (ulaw) और एलॉ (alaw) सीधे पब्लिक एड्रेस हार्डवेयर को फीड करते हैं, और एक ही आवाज पूरी बहुभाषी श्रृंखला को संभालती है।

ऑडियोबुक वॉयस जनरेटर

ऑडियोबुक वर्णन के लिए एआई आवाजें

एक उपन्यास हजारों अनुरोधों को आपस में सिलकर बनता है, और जहां ये जोड़ होते हैं वहीं से कहानी बिखरने लगती है। ये आवाजें पूरी किताब में एक जैसी बनी रहती हैं और नौ ऐसी भारतीय भाषाओं को कवर करती हैं जिन्हें अधिकांश विक्रेता उपलब्ध नहीं कराते हैं।

शांत एआई आवाजें

शांत आवाजें

शांति आवाज़ से ज़्यादा गति से आती है। गति घटकर 0.5 तक आ जाती है, और ठहराव किसी पैरामीटर के बजाय विराम चिह्नों से आते हैं, इसलिए स्क्रिप्ट उतना ही काम करती है जितना कि कास्टिंग।

संवादात्मक एआई आवाजें

संवादात्मक आवाजें

एक सौ पचानवे आवाज़ें बातचीत के अंदाज़ को दर्शाती हैं, जो पूरे कैटलॉग का 84 प्रतिशत है। स्ट्रीमिंग ही उन्हें लाइव होने का अहसास कराती है: वाक्य का रेंडरिंग पूरा होने से पहले ही ऑडियो बजना शुरू हो जाता है।

बहुभाषी एआई आवाजें

बहुभाषी और कोड-स्विचिंग एआई आवाजें

बहत्तर आवाजें ग्यारह भारतीय भाषाओं के साथ-साथ अंग्रेजी को कवर करती हैं, इसलिए एक ही आवाज बिना किसी बदलाव के हिंदी कॉलर और तमिल कॉलर दोनों के काम आती है। एक ही वाक्य के भीतर हिंदी और अंग्रेजी बारी-बारी से आ सकती हैं।

एआई पॉडकास्ट वॉयस जनरेटर

पॉडकास्ट बनाने के लिए एआई आवाज़ें

पॉडकास्ट प्रोडक्शन पहले से ही सेगमेंट आधारित है, जो शॉर्ट कॉल्स में जनरेशन के लिए अनुकूल है। इंट्रो और विज्ञापन रीड़स एक बार जनरेट होते हैं और कैश हो जाते हैं, और अलग-अलग आवाज़ों को मिलाने से बिना दो लोगों को बुक किए एक टू-हैंडर (दो लोगों का शो) तैयार हो जाता है।

आईवीआर (IVR) वॉयस जनरेटर

आईवीआर (IVR) और टेलीफोनी के लिए एआई (AI) आवाजें

आईवीआर (IVR) आवाज़ों को केवल ब्राउज़र में अच्छा नहीं लगना चाहिए, बल्कि उन्हें कंप्रेस्ड फोन लाइन पर भी सही से काम करना चाहिए। ये सीधे ulaw और alaw आउटपुट देते हैं, लगभग 200 मिलीसेकंड में जेनरेट होते हैं, और एक ही प्रॉम्प्ट में हिंदी और अंग्रेजी दोनों को संभाल सकते हैं।

अक्सर पूछे जाने वाले प्रश्न

स्पष्टता कोई टैग किया गया एट्रिब्यूट (विशेषता) नहीं है, इसलिए इसके लिए कोई फ़िल्टर नहीं है। व्यावहारिक रूप से, आवाज़ के चुनाव की तुलना में मध्यम गति अधिक मायने रखती है: आवाज़ बदलने से पहले 0.9 गति का प्रयास करें। अंग्रेजी में एंड्रिया और एलेक स्थिर हैं, हिंदी में गार्गी और हर्षिता। सभी बारह समर्थित भाषाएं स्क्रीन रीडर के उपयोग के लिए उपलब्ध हैं।

वॉयस एजेंट ऑर्केस्ट्रेशन के भविष्य का निर्माण करें

311 कैलिफ़ोर्निया स्ट्रीट, सुइट 320
सैन फ्रांसिस्को, सीए 94104

वॉयस एजेंट ऑर्केस्ट्रेशन के भविष्य का निर्माण करें

311 कैलिफ़ोर्निया स्ट्रीट, सुइट 320
सैन फ्रांसिस्को, सीए 94104

वॉयस एजेंट ऑर्केस्ट्रेशन के भविष्य का निर्माण करें

311 कैलिफ़ोर्निया स्ट्रीट, सुइट 320
सैन फ्रांसिस्को, सीए 94104