एआई फाउंडेशन
समझें कि एआई क्या है, सिस्टम कैसे सीखते हैं, वे कहां विफल होते हैं, और बिना प्रचार के दावों का न्याय कैसे करें।
निःशुल्क एआई लाइब्रेरी
117 सादे-अंग्रेजी गाइड, संरचित शिक्षण पथ और एक खुली लाइब्रेरी - एक स्वतंत्र 501(c)(3) गैर-लाभकारी संस्था द्वारा निर्मित ताकि कोई भी आधुनिक AI को समझ सके।
यहां से प्रारंभ करें
प्रत्येक पाठ्यक्रम में स्पष्ट परिणाम, मैप की गई दक्षताएं, अभ्यास गतिविधियाँ और एक लागू कैपस्टोन शामिल हैं।
समझें कि एआई क्या है, सिस्टम कैसे सीखते हैं, वे कहां विफल होते हैं, और बिना प्रचार के दावों का न्याय कैसे करें।
गोपनीयता की रक्षा करते हुए, आउटपुट की जांच करते हुए और मानवीय जवाबदेही को संरक्षित करते हुए एआई का उत्पादक रूप से उपयोग करें।
कार्यस्थल उपयोग के मामलों का मूल्यांकन करें, सुरक्षित पायलट चलाएं, मूल्य मापें और जिम्मेदारीपूर्वक परिवर्तनों का संचार करें।
अधिकारों, इक्विटी, शासन, सुरक्षा और जनहित परिणामों के माध्यम से एआई प्रणालियों का विश्लेषण करें।
व्यावहारिक सिस्टम डिज़ाइन के माध्यम से भाषा मॉडल, पुनर्प्राप्ति, एजेंटों, मूल्यांकन, लागत और परिनियोजन सुरक्षा उपायों को समझें।
विषय ट्रैक
उस क्षेत्र में कूदें जिसकी आप परवाह करते हैं। प्रत्येक ट्रैक में कई सादे-अंग्रेजी गाइड होते हैं।
पूर्ण पुस्तकालय
117 का 1019 गाइड दिखाए गए. ट्रैक के आधार पर फ़िल्टर करें या ऊपर खोजें।
डिफ़वेव एक प्रसार-आधारित वोकोडर है जो एक मेल-स्पेक्ट्रोग्राम पर वातानुकूलित, यादृच्छिक शोर को तरंग रूप में पुनरावृत्त रूप से निरूपित करके ऑडियो को संश्लेषित करता है।
ऑडियो एआईबार्क सुनो का एक ओपन-सोर्स टेक्स्ट-टू-ऑडियो मॉडल है जो न केवल भाषण बल्कि हंसी, आह, संगीत और सीधे टेक्स्ट प्रॉम्प्ट से ध्वनि प्रभाव उत्पन्न करता है।
ऑडियो एआईकछुआ टीटीएस एक ओपन-सोर्स टेक्स्ट-टू-स्पीच प्रणाली है जो असामान्य रूप से प्राकृतिक, भावनात्मक रूप से समृद्ध आवाजों और कुछ ही समय में मजबूत आवाज क्लोनिंग के लिए बेशकीमती है...
ऑडियो एआईXTTS कोक्वी का बहुभाषी टेक्स्ट-टू-स्पीच मॉडल है जो एक छोटी क्लिप से आवाज को क्लोन कर सकता है और फिर संरक्षित करते हुए कई अलग-अलग भाषाओं में बात कर सकता है...
ऑडियो एआईसाउंडस्टॉर्म एक Google ऑडियो जेनरेशन मॉडल है जो एक समय में एक टोकन के बजाय समानांतर में भाषण और ध्वनि उत्पन्न करता है, जिससे उच्च गुणवत्ता वाला ऑडियो संश्लेषण होता है…
ऑडियो एआईAudioGen एक Meta मॉडल है जो पाठ विवरण को यथार्थवादी पर्यावरणीय ध्वनियों और ध्वनि प्रभावों में बदल देता है, जैसे 'कुत्ता भौंक रहा है जबकि पक्षी चहचहा रहे हैं।
ऑडियो एआईस्टेबल ऑडियो, स्टेबिलिटी एआई का टेक्स्ट-टू-ऑडियो सिस्टम है जो क्लिप की लंबाई पर स्पष्ट नियंत्रण के साथ संगीत और ध्वनि प्रभाव उत्पन्न करने के लिए गुप्त प्रसार का उपयोग करता है।
ऑडियो एआईकालडी एक स्वतंत्र, ओपन-सोर्स टूलकिट है जो वाक् पहचान प्रणाली के निर्माण के लिए प्रमुख अनुसंधान मंच बन गया है।
ऑडियो एआईWav2Letter Facebook AI का एक एंड-टू-एंड स्पीच रिकग्निशन सिस्टम है जो केवल कनवल्शनल न्यूरल नेटवर्क का उपयोग करता है, कोई पुनरावृत्ति नहीं।
ऑडियो एआईजैस्पर और क्वार्ट्जनेट NVIDIA के एंड-टू-एंड कन्वेन्शनल स्पीच रिकग्निशन मॉडल हैं, जिसमें क्वार्ट्जनेट एक नाटकीय रूप से छोटा, कुशल रीडिज़ाइन है...
ऑडियो एआईडिफ्यूज़न मॉडल चरण-दर-चरण शोर प्रक्रिया को उलटना सीखकर, यादृच्छिक शोर को सुसंगत भाषण, संगीत या ध्वनि प्रभावों में बदलकर ऑडियो उत्पन्न करते हैं।
ऑडियो एआईसाउंड इवेंट डिटेक्शन (SED) यह पहचानता है कि ऑडियो स्ट्रीम में कौन सी ध्वनियाँ होती हैं और वास्तव में वे कब शुरू और बंद होती हैं।
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.