AI knihovna zdarma

Audio AI průvodciNavždy zdarma.

117 Průvodci v jednoduché angličtině, strukturované výukové programy a otevřená knihovna – vytvořené nezávislou neziskovou organizací 501(c)(3), takže moderní umělé inteligenci může porozumět každý.

117Zdarma průvodci
1Tématické stopy
~2 minPodle průvodce
~4hDoba čtení

Začněte zde

Pět Kurzy založené na výsledcích

Každý kurz obsahuje explicitní výsledky, namapované kompetence, cvičné aktivity a aplikovaný závěrečný projekt.

Tématické stopy

Procházet podle stopy

Skočte do oblasti, na které vám záleží. Každá trať má několik jednoduchých anglických průvodců.

Plná knihovna

Všichni průvodci

117 z 1019 zobrazena vodítka. Filtrujte podle skladby nebo vyhledávání výše.

Audio AI

Suno a Udio

Suno a Udio jsou dva přední spotřebitelské hudební generátory umělé inteligence, které mění krátkou textovou výzvu na plnou skladbu téměř studiové kvality – doplněnou vokály…

2 min přečtenoPřečtěte si
Audio AI

Symbolická hudební generace

Generování symbolické hudby vytváří hudbu jako strukturovaný zápis – noty, výšky, trvání a časování (často jako MIDI) – spíše než jako syrový zvuk.

2 min přečtenoPřečtěte si
Audio AI

Mel-frekvenční kepstrální koeficienty

Mel-Frequency Ceptral Coefficients (MFCC) jsou kompaktním souborem čísel, která shrnují tvar frekvenčního spektra zvuku tak, jak ho lidské uši vnímají…

2 min přečtenoPřečtěte si
Audio AI

WaveNet

WaveNet, představený společností DeepMind v roce 2016, byl průlomovou neuronovou sítí, která generuje nezpracovaný zvuk jeden vzorek po druhém a produkuje překvapivě přirozenou řeč…

2 min přečtenoPřečtěte si
Audio AI

Tacotron 2

Tacotron 2 je komplexní systém převodu textu na řeč od Google (2017), který mění psaný text přímo na mel-spektrogram, který neurální vokodér převádí…

2 min přečtenoPřečtěte si
Audio AI

Audio Deepfake Detekce

Detekce hlubokého falešného zvuku je sada technik používaných k určení, zda hlasový záznam byl namluven skutečným člověkem nebo zda byl syntetizován/klonován umělou inteligencí.

2 min přečtenoPřečtěte si
Audio AI

Prozodické modelování

Modelování prozódií učí stroje melodii řeči, rytmu, výšce, přízvuku a tempu, které jedou nad slovy.

2 min přečtenoPřečtěte si
Audio AI

Emocionální syntéza řeči

Emocionální syntéza řeči generuje hlasy, které znějí šťastně, smutně, naštvaně nebo klidně, nejen srozumitelně, ale věrohodně procítěné.

2 min přečtenoPřečtěte si
Audio AI

Konverze hlasu

Konverze hlasu transformuje nahranou řeč jedné osoby tak, aby zněla, jako by ji mluvil někdo jiný, a přitom zachovává původní slova a načasování.

2 min přečtenoPřečtěte si
Audio AI

Diarizace reproduktoru

Diarizace mluvčího odpovídá na otázku "kdo kdy mluvil?" rozdělením zvukového záznamu do segmentů označených identitou mluvčího.

2 min přečtenoPřečtěte si
Audio AI

Ověření reproduktoru

Ověření hlasu potvrzuje, zda se hlas shoduje s konkrétní deklarovanou identitou, a funguje jako hlasové heslo.

2 min přečtenoPřečtěte si
Audio AI

Detekce hlasové aktivity

Detekce hlasové aktivity (VAD) okamžik za okamžikem rozhoduje, zda zvukový signál obsahuje lidskou řeč nebo jen ticho a hluk.

2 min přečtenoPřečtěte si

Dočetl jsi to? Dokaž to.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.