एआई फाउंडेशन
समझें कि एआई क्या है, सिस्टम कैसे सीखते हैं, वे कहां विफल होते हैं, और बिना प्रचार के दावों का न्याय कैसे करें।
निःशुल्क एआई लाइब्रेरी
117 सादे-अंग्रेजी गाइड, संरचित शिक्षण पथ और एक खुली लाइब्रेरी - एक स्वतंत्र 501(c)(3) गैर-लाभकारी संस्था द्वारा निर्मित ताकि कोई भी आधुनिक AI को समझ सके।
यहां से प्रारंभ करें
प्रत्येक पाठ्यक्रम में स्पष्ट परिणाम, मैप की गई दक्षताएं, अभ्यास गतिविधियाँ और एक लागू कैपस्टोन शामिल हैं।
समझें कि एआई क्या है, सिस्टम कैसे सीखते हैं, वे कहां विफल होते हैं, और बिना प्रचार के दावों का न्याय कैसे करें।
गोपनीयता की रक्षा करते हुए, आउटपुट की जांच करते हुए और मानवीय जवाबदेही को संरक्षित करते हुए एआई का उत्पादक रूप से उपयोग करें।
कार्यस्थल उपयोग के मामलों का मूल्यांकन करें, सुरक्षित पायलट चलाएं, मूल्य मापें और जिम्मेदारीपूर्वक परिवर्तनों का संचार करें।
अधिकारों, इक्विटी, शासन, सुरक्षा और जनहित परिणामों के माध्यम से एआई प्रणालियों का विश्लेषण करें।
व्यावहारिक सिस्टम डिज़ाइन के माध्यम से भाषा मॉडल, पुनर्प्राप्ति, एजेंटों, मूल्यांकन, लागत और परिनियोजन सुरक्षा उपायों को समझें।
विषय ट्रैक
उस क्षेत्र में कूदें जिसकी आप परवाह करते हैं। प्रत्येक ट्रैक में कई सादे-अंग्रेजी गाइड होते हैं।
पूर्ण पुस्तकालय
117 का 1019 गाइड दिखाए गए. ट्रैक के आधार पर फ़िल्टर करें या ऊपर खोजें।
कवर गीत की पहचान यह पता लगाती है कि दो बहुत अलग-अलग ध्वनि वाली रिकॉर्डिंग वास्तव में एक ही अंतर्निहित गीत हैं - एक लाइव ध्वनिक संस्करण, एक रीमिक्स ...
ऑडियो एआईडीडीएसपी (डिफरेंशियल डिजिटल सिग्नल प्रोसेसिंग) क्लासिक सिंथेसाइज़र बिल्डिंग ब्लॉक्स को तंत्रिका नेटवर्क के साथ जोड़ता है, इसलिए गहन शिक्षा ऑसिलेटर्स को नियंत्रित कर सकती है...
ऑडियो एआईवीआईटीएस एक टेक्स्ट-टू-स्पीच मॉडल है जो सामान्य दो-चरण पाइपलाइन को छोड़कर, एकल प्रशिक्षित सिस्टम में टेक्स्ट को सीधे कच्चे ऑडियो तरंगों में बदल देता है।
ऑडियो एआईफास्टस्पीच एक समय में एक फ्रेम के बजाय समानांतर में एक संपूर्ण भाषण स्पेक्ट्रोग्राम उत्पन्न करता है, जिससे संश्लेषण नाटकीय रूप से तेज और अधिक स्थिर हो जाता है।
ऑडियो एआईनेचुरलस्पीच Microsoft टीटीएस अनुसंधान की एक श्रृंखला है जिसका लक्ष्य मानव-स्तरीय भाषण गुणवत्ता है, बाद के संस्करणों में समृद्ध, प्राकृतिक उत्पन्न करने के लिए अव्यक्त प्रसार का उपयोग किया जाता है…
ऑडियो एआईस्पीच इमोशन रिकॉग्निशन (एसईआर) एआई है जो वक्ता की भावनात्मक स्थिति - क्रोध, खुशी, उदासी, निराशा - का पता उनकी आवाज की आवाज़ से लगाता है, न कि केवल...
ऑडियो एआईमोशी क्युताई का एक ओपन-सोर्स, रीयल-टाइम वॉयस एआई है जो सख्त मोड़ लेने के बजाय एक ही समय में बात करता है और सुनता है - फुल-डुप्लेक्स।
ऑडियो एआईस्पीच-टू-स्पीच ट्रांसलेशन (S2ST) एक भाषा में बोले गए शब्दों को लेता है और दूसरी भाषा में बोले गए शब्दों को तैयार करता है - आदर्श रूप से वक्ता की आवाज, टोन को संरक्षित करता है...
ऑडियो एआईHiFi-GAN एक जनरेटिव-एडवर्सेरियल वोकोडर है जो एक मेल-स्पेक्ट्रोग्राम को लगभग तुरंत ही एक कच्चे ऑडियो तरंग में बदल देता है, जिससे दूर तक स्टूडियो-क्वालिटी भाषण तैयार होता है...
ऑडियो एआईग्रैफेम-टू-फोनेम (जी2पी) रूपांतरण लिखित अक्षरों को उन ध्वनियों में अनुवादित करता है जिनका उच्चारण एक भाषण प्रणाली को वास्तव में करना चाहिए।
ऑडियो एआईपाठ सामान्यीकरण एक फ्रंट-एंड चरण है जो भाषण प्रणाली के कहने से पहले कच्चे लिखित पाठ को पूरी तरह से बोले गए शब्दों में फिर से लिखता है।
ऑडियो एआईसाउंडस्ट्रीम Google का एंड-टू-एंड न्यूरल ऑडियो कोडेक है जो गुणवत्ता को संरक्षित करते हुए भाषण और संगीत को बेहद कम बिटरेट पर संपीड़ित करता है।
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.