AI základy
Pochopte, co je AI, jak se systémy učí, kde selhávají a jak posuzovat tvrzení bez přehánění.
AI knihovna zdarma
117 Průvodci v jednoduché angličtině, strukturované výukové programy a otevřená knihovna – vytvořené nezávislou neziskovou organizací 501(c)(3), takže moderní umělé inteligenci může porozumět každý.
Začněte zde
Každý kurz obsahuje explicitní výsledky, namapované kompetence, cvičné aktivity a aplikovaný závěrečný projekt.
Pochopte, co je AI, jak se systémy učí, kde selhávají a jak posuzovat tvrzení bez přehánění.
Používejte AI produktivně, zároveň chránit soukromí, kontrolovat výstupy a zachovávat lidskou odpovědnost.
Vyhodnocujte případy použití na pracovišti, spusávejte bezpečné pilotní projekty, měřte hodnotu a zodpovědně komunikujte změny.
Analyzovat AI systémy z hlediska práv, spravedlnosti, správy, bezpečnosti a výsledků veřejného zájmu.
Pochopte jazykové modely, vyhledávání, agenty, hodnocení, náklady a bezpečnostní opatření nasazení prostřednictvím praktického návrhu systému.
Tématické stopy
Skočte do oblasti, na které vám záleží. Každá trať má několik jednoduchých anglických průvodců.
Plná knihovna
117 z 1019 zobrazena vodítka. Filtrujte podle skladby nebo vyhledávání výše.
DiffWave je vokodér založený na difúzi, který syntetizuje zvuk opakovaným odšumováním náhodného šumu do tvaru vlny, podmíněného mel-spektrogramem.
Audio AIBark je open source model převodu textu na zvuk od Suno, který generuje nejen řeč, ale i smích, povzdechy, hudbu a zvukové efekty přímo z textových výzev.
Audio AITortoise TTS je open source systém převodu textu na řeč ceněný pro neobvykle přirozené, emocionálně bohaté hlasy a silné klonování hlasu z několika krátkých…
Audio AIXTTS je vícejazyčný model převodu textu na řeč společnosti Coqui, který dokáže naklonovat hlas z krátkého klipu a poté hovořit v mnoha různých jazycích při zachování…
Audio AISoundStorm je model generování zvuku Google, který produkuje řeč a zvuk paralelně, nikoli po jednom tokenu, což umožňuje vysoce kvalitní syntézu zvuku…
Audio AIAudioGen je model Meta, který přeměňuje textové popisy na realistické zvuky prostředí a zvukové efekty, jako je „štěkání psů při cvrlikání ptáků“.
Audio AIStable Audio je systém převodu textu na zvuk společnosti Stability AI, který využívá latentní difúzi ke generování hudby a zvukových efektů s explicitní kontrolou nad délkou klipu.
Audio AIKaldi je bezplatná sada nástrojů s otevřeným zdrojovým kódem, která se stala dominantní výzkumnou platformou pro vytváření systémů rozpoznávání řeči.
Audio AIWav2Letter je end-to-end systém rozpoznávání řeči od Facebooku AI, který používal pouze konvoluční neuronové sítě, bez opakování.
Audio AIJasper a QuartzNet jsou komplexní modely konvolučního rozpoznávání řeči NVIDIA, přičemž QuartzNet je výrazně menší a efektivnější přepracovaný design…
Audio AIDifúzní modely generují zvuk tím, že se učí zvrátit krok za krokem proces tvorby šumu a přeměňují náhodný šum na koherentní řeč, hudbu nebo zvukové efekty.
Audio AIDetekce zvukových událostí (SED) identifikuje, jaké zvuky se vyskytují v audio streamu a kdy přesně začínají a kdy končí.
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.