एआई फाउंडेशन
समझें कि एआई क्या है, सिस्टम कैसे सीखते हैं, वे कहां विफल होते हैं, और बिना प्रचार के दावों का न्याय कैसे करें।
निःशुल्क एआई लाइब्रेरी
117 सादे-अंग्रेजी गाइड, संरचित शिक्षण पथ और एक खुली लाइब्रेरी - एक स्वतंत्र 501(c)(3) गैर-लाभकारी संस्था द्वारा निर्मित ताकि कोई भी आधुनिक AI को समझ सके।
यहां से प्रारंभ करें
प्रत्येक पाठ्यक्रम में स्पष्ट परिणाम, मैप की गई दक्षताएं, अभ्यास गतिविधियाँ और एक लागू कैपस्टोन शामिल हैं।
समझें कि एआई क्या है, सिस्टम कैसे सीखते हैं, वे कहां विफल होते हैं, और बिना प्रचार के दावों का न्याय कैसे करें।
गोपनीयता की रक्षा करते हुए, आउटपुट की जांच करते हुए और मानवीय जवाबदेही को संरक्षित करते हुए एआई का उत्पादक रूप से उपयोग करें।
कार्यस्थल उपयोग के मामलों का मूल्यांकन करें, सुरक्षित पायलट चलाएं, मूल्य मापें और जिम्मेदारीपूर्वक परिवर्तनों का संचार करें।
अधिकारों, इक्विटी, शासन, सुरक्षा और जनहित परिणामों के माध्यम से एआई प्रणालियों का विश्लेषण करें।
व्यावहारिक सिस्टम डिज़ाइन के माध्यम से भाषा मॉडल, पुनर्प्राप्ति, एजेंटों, मूल्यांकन, लागत और परिनियोजन सुरक्षा उपायों को समझें।
विषय ट्रैक
उस क्षेत्र में कूदें जिसकी आप परवाह करते हैं। प्रत्येक ट्रैक में कई सादे-अंग्रेजी गाइड होते हैं।
पूर्ण पुस्तकालय
117 का 1019 गाइड दिखाए गए. ट्रैक के आधार पर फ़िल्टर करें या ऊपर खोजें।
मिमी एक तंत्रिका ऑडियो कोडेक है जो वास्तविक समय में भाषण को अलग-अलग टोकन की एक छोटी धारा में संपीड़ित करता है, ताकि एआई मॉडल बहुत धीमी गति से सुन और बोल सकें...
ऑडियो एआईसुनें, उपस्थित रहें और जादू करें (एलएएस) 2015 का एक ऐतिहासिक तंत्रिका नेटवर्क है जो बिना हाथ से निर्मित उच्चारण के भाषण को सीधे पात्रों में स्थानांतरित करता है...
ऑडियो एआईSpecAugment एक सरल लेकिन शक्तिशाली डेटा संवर्द्धन विधि है जो पहचान मॉडल को और अधिक मजबूत बनाने के लिए भाषण के स्पेक्ट्रोग्राम को मास्क और विकृत करती है।
ऑडियो एआईसंगीत ऑटो-टैगिंग किसी गीत को सुनने के लिए मशीन लर्निंग का उपयोग करती है और स्वचालित रूप से शैली, मनोदशा, वाद्ययंत्र और गति जैसे वर्णनात्मक लेबल संलग्न करती है।
ऑडियो एआईटिम्बर ट्रांसफर ऑडियो के 'टोन रंग' को दोबारा आकार देता है ताकि एक उपकरण दूसरे की तरह बज सके, गुनगुनाए गए संगीत को वायलिन या तुरही की पंक्ति में बदल दिया जा सके...
ऑडियो एआईध्वनिक दृश्य वर्गीकरण (एएससी) मशीनों को उस वातावरण को पहचानने के लिए प्रशिक्षित करता है जिसमें रिकॉर्डिंग की गई थी, एक व्यस्त सड़क, एक शांत पार्क, एक ट्रेन, एक कैफे...
ऑडियो एआईNVIDIA Riva प्रोडक्शन स्पीच AI (ASR, TTS और अनुवाद) के लिए एक GPU-त्वरित SDK है, जबकि NeMo प्रशिक्षण और फाइन-ट्यूनिंग के लिए ओपन-सोर्स टूलकिट है...
ऑडियो एआईडीपस्पीच 2014 में Baidu द्वारा पेश किया गया एक एंड-टू-एंड स्पीच रिकग्निशन मॉडल है जो आवर्ती तंत्रिका का उपयोग करके कच्चे ऑडियो सुविधाओं को सीधे टेक्स्ट में मैप करता है…
ऑडियो एआईएक्स-वेक्टर एक तंत्रिका नेटवर्क द्वारा उत्पादित वक्ता की आवाज के निश्चित-लंबाई वाले संख्यात्मक फिंगरप्रिंट हैं, जिनका उपयोग यह बताने के लिए किया जाता है कि कौन बोल रहा है, चाहे वे कुछ भी कहें।
ऑडियो एआईग्लो-टीटीएस एक टेक्स्ट-टू-स्पीच मॉडल है जो एक अलग एलाइनर की आवश्यकता को दूर करते हुए, एक चतुर खोज ट्रिक का उपयोग करके टेक्स्ट को स्पीच में संरेखित करना सीखता है।
ऑडियो एआईपैरेलल वेवगैन एक तेज़ न्यूरल वोकोडर है जो एक छोटे GAN का उपयोग करके एक मेल-स्पेक्ट्रोग्राम को एक कच्चे ऑडियो तरंग में बदल देता है, जिससे एक ही बार में सभी नमूने तैयार हो जाते हैं।
ऑडियो एआईवेवग्लो एनवीआईडीआईए का एक प्रवाह-आधारित न्यूरल वोकोडर है जो ऑटोरेग्रेशन के बिना एक ही पास में मेल-स्पेक्ट्रोग्राम से भाषण तरंगों को संश्लेषित करता है।
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.