AI základy
Pochopte, co je AI, jak se systémy učí, kde selhávají a jak posuzovat tvrzení bez přehánění.
AI knihovna zdarma
117 Průvodci v jednoduché angličtině, strukturované výukové programy a otevřená knihovna – vytvořené nezávislou neziskovou organizací 501(c)(3), takže moderní umělé inteligenci může porozumět každý.
Začněte zde
Každý kurz obsahuje explicitní výsledky, namapované kompetence, cvičné aktivity a aplikovaný závěrečný projekt.
Pochopte, co je AI, jak se systémy učí, kde selhávají a jak posuzovat tvrzení bez přehánění.
Používejte AI produktivně, zároveň chránit soukromí, kontrolovat výstupy a zachovávat lidskou odpovědnost.
Vyhodnocujte případy použití na pracovišti, spusávejte bezpečné pilotní projekty, měřte hodnotu a zodpovědně komunikujte změny.
Analyzovat AI systémy z hlediska práv, spravedlnosti, správy, bezpečnosti a výsledků veřejného zájmu.
Pochopte jazykové modely, vyhledávání, agenty, hodnocení, náklady a bezpečnostní opatření nasazení prostřednictvím praktického návrhu systému.
Tématické stopy
Skočte do oblasti, na které vám záleží. Každá trať má několik jednoduchých anglických průvodců.
Plná knihovna
117 z 1019 zobrazena vodítka. Filtrujte podle skladby nebo vyhledávání výše.
Identifikace převzaté písně detekuje, kdy dvě velmi odlišně znějící nahrávky jsou ve skutečnosti stejnou základní písní – živá akustická verze, remix…
Audio AIDDSP (Differentiable Digital Signal Processing) spojuje klasické stavební bloky syntezátoru s neuronovými sítěmi, takže hluboké učení může ovládat oscilátory…
Audio AIVITS je model převodu textu na řeč, který převádí text přímo na nezpracované zvukové průběhy v jediném trénovaném systému a vynechává obvyklou dvoufázovou linii.
Audio AIFastSpeech generuje celý spektrogram řeči paralelně, nikoli po jednom snímku, čímž je syntéza výrazně rychlejší a stabilnější.
Audio AINaturalSpeech je řada výzkumu Microsoft TTS zaměřená na kvalitu řeči na lidské úrovni, přičemž novější verze využívají latentní difúzi k vytváření bohaté, přirozené…
Audio AIRozpoznávání emocí řeči (SER) je umělá inteligence, která detekuje emoční stav mluvčího – hněv, radost, smutek, frustrace – ze zvuku jeho hlasu, nejen…
Audio AIMoshi je open source hlasová umělá inteligence v reálném čase od společnosti Kyutai, která mluví a poslouchá současně – plně duplexně – místo toho, aby se striktně střídala.
Audio AIPřeklad řeči do řeči (S2ST) přebírá mluvená slova v jednom jazyce a vytváří mluvená slova v jiném – v ideálním případě zachovává hlas mluvčího, tón…
Audio AIHiFi-GAN je generativní-adversariální vokodér, který téměř okamžitě přemění mel-spektrogram na surový zvukový průběh a produkuje řeč ve studiové kvalitě daleko…
Audio AIKonverze grafému na foném (G2P) převádí psaná písmena na zvuky, které by řečový systém měl skutečně vyslovovat.
Audio AINormalizace textu je úvodním krokem, který přepíše nezpracovaný psaný text na plně vyslovená slova dříve, než to řečový systém řekne.
Audio AISoundStream je end-to-end neurální zvukový kodek společnosti Google, který komprimuje řeč a hudbu na extrémně nízké přenosové rychlosti při zachování kvality.
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.