AI knihovna zdarma

Audio AI průvodciNavždy zdarma.

117 Průvodci v jednoduché angličtině, strukturované výukové programy a otevřená knihovna – vytvořené nezávislou neziskovou organizací 501(c)(3), takže moderní umělé inteligenci může porozumět každý.

117Zdarma průvodci
1Tématické stopy
~2 minPodle průvodce
~4hDoba čtení

Začněte zde

Pět Kurzy založené na výsledcích

Každý kurz obsahuje explicitní výsledky, namapované kompetence, cvičné aktivity a aplikovaný závěrečný projekt.

Tématické stopy

Procházet podle stopy

Skočte do oblasti, na které vám záleží. Každá trať má několik jednoduchých anglických průvodců.

Plná knihovna

Všichni průvodci

117 z 1019 zobrazena vodítka. Filtrujte podle skladby nebo vyhledávání výše.

Audio AI

Syntéza hlasu zpěvu

Singing Voice Synthesis (SVS) je umělá inteligence, která přemění napsanou melodii a text na plně zpívaný vokální výkon.

2 min přečtenoPřečtěte si
Audio AI

AudioLM

AudioLM je výzkumný rámec Google, který generuje realistický zvuk – řeč nebo klavírní hudbu – tím, že zachází se zvukem jako s jazykem a předpovídá jej token…

2 min přečtenoPřečtěte si
Audio AI

MusicGen

MusicGen je model umělé inteligence Meta, který generuje hudbu z textového popisu a volitelně z melodie, kterou si zabručíte nebo nahrajete.

2 min přečtenoPřečtěte si
Audio AI

Klíčová slova Spotting a Wake Words

Sledování klíčových slov je technologie, která neustále naslouchá a umožňuje zařízení čekat na jedinou spouštěcí frázi, jako je „Hey Siri“ nebo „Alexa“, než se spustí…

2 min přečtenoPřečtěte si
Audio AI

Nucené zarovnání

Vynucené zarovnání automaticky zarovná známý přepis se zvukem a přesně označí, kdy každé slovo nebo zvuk začíná a končí.

2 min přečtenoPřečtěte si
Audio AI

Mel spektrogramy

Mel spektrogram je obrazem zvuku v průběhu času s frekvencí rozmístěnou tak, jak lidské uši vnímají výšku tónu.

2 min přečtenoPřečtěte si
Audio AI

Konekcionistická časová klasifikace

Connectionist Temporal Classification (CTC) je ztrátová funkce a metoda dekódování, která umožňuje neuronovým sítím přeměnit dlouhou zvukovou sekvenci na text bez…

2 min přečtenoPřečtěte si
Audio AI

Modely RNN-Transducer

RNN-Transducer (RNN-T) je architektura rozpoznávání řeči přátelská ke streamování, která opravuje největší slabinu CTC – její neschopnost modelovat závislosti…

2 min přečtenoPřečtěte si
Audio AI

Konformní architektura

Conformer je blok neuronové sítě, který spojuje konvoluci s vlastní pozorností a zachycuje jak jemnozrnné místní zvukové vzory, tak kontext s dlouhým dosahem…

2 min přečtenoPřečtěte si

Dočetl jsi to? Dokaž to.

Zkontrolujte, co jste se naučili, pomocí tematického kvízu a poté prozkoumejte naše strukturované kurzy nebo se snažte získat certifikát. Každý průvodce zůstává zdarma ke čtení.