AI knihovna zdarma

Audio AI průvodciNavždy zdarma.

117 Průvodci v jednoduché angličtině, strukturované výukové programy a otevřená knihovna – vytvořené nezávislou neziskovou organizací 501(c)(3), takže moderní umělé inteligenci může porozumět každý.

117Zdarma průvodci
1Tématické stopy
~2 minPodle průvodce
~4hDoba čtení

Začněte zde

Pět Kurzy založené na výsledcích

Každý kurz obsahuje explicitní výsledky, namapované kompetence, cvičné aktivity a aplikovaný závěrečný projekt.

Tématické stopy

Procházet podle stopy

Skočte do oblasti, na které vám záleží. Každá trať má několik jednoduchých anglických průvodců.

Plná knihovna

Všichni průvodci

117 z 1019 zobrazena vodítka. Filtrujte podle skladby nebo vyhledávání výše.

Audio AI

Zvukové titulky

Zvukové titulky generují větu v přirozeném jazyce popisující obsah zvukového klipu, například „troubení vlaku při průjezdu železničním přejezdem“.

2 min přečtenoPřečtěte si
Audio AI

Šeptání Rozpoznávání řeči

Whisper je otevřený systém automatického rozpoznávání řeči společnosti OpenAI, který převádí zvuk na text ve více než 90 jazycích.

2 min přečtenoPřečtěte si
Audio AI

Wav2Vec 2.0

Wav2Vec 2.0 je Meta AI model řeči s vlastním dohledem, který se učí výkonné zvukové reprezentace z nezpracovaných, neoznačených nahrávek.

2 min přečtenoPřečtěte si
Audio AI

Samokontrolovaná řeč HuBERT

HuBERT (Hidden-Unit BERT) je Meta AI model řeči s vlastním dohledem, který se učí předpovídáním seskupených zvukových jednotek pro maskované segmenty ve stylu BERT.

2 min přečtenoPřečtěte si
Audio AI

Nervové vokodéry

Nervový vokodér je model, který mění kompaktní akustickou reprezentaci, obvykle mel-spektrogram, na skutečný slyšitelný tvar vlny.

2 min přečtenoPřečtěte si
Audio AI

Neuronové zvukové kodeky

Neuronové zvukové kodeky využívají hluboké učení ke komprimaci zvuku do malých proudů diskrétních tokenů a jeho rekonstrukci s vysokou věrností.

2 min přečtenoPřečtěte si
Audio AI

Jazykové modely VALL-E a Codec

VALL-E přeformuloval převod textu na řeč jako problém modelování jazyka přes tokeny audio kodeků a umožnil klonování hlasu z pouhých tří sekund vzorku.

2 min přečtenoPřečtěte si
Audio AI

OpenAI Šeptejte

Whisper je otevřený systém automatického rozpoznávání řeči společnosti OpenAI, který přepisuje a překládá mluvený zvuk do desítek jazyků.

2 min přečtenoPřečtěte si
Audio AI

Automatický přepis hudby

Automatic Music Transscription (AMT) převádí nezpracovaný zvukový záznam hudby do symbolického zápisu, jako je notový záznam, MIDI nebo piano roll.

2 min přečtenoPřečtěte si
Audio AI

Sledování rytmu a tempa

Sledování rytmu a tempa je úkolem najít stálý pulz v hudbě: kam každý úder padá a jak rychle se skladba pohybuje v úderech za minutu (BPM).

2 min přečtenoPřečtěte si
Audio AI

Zvukové otisky prstů

Zvukové otisky vytvářejí kompaktní digitální podpis zvuku odolný proti šumu, takže jej lze později rozpoznat, a to i prostřednictvím hluku na pozadí…

2 min přečtenoPřečtěte si
Audio AI

Jukebox

Jukebox je neuronová síť OpenAI pro rok 2020, která generuje surový hudební zvuk – doplněný o zpěv, nástroje a dokonce i texty ve stylu specifických…

2 min přečtenoPřečtěte si

Dočetl jsi to? Dokaž to.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.