Безплатна AI библиотека

Аудио AI водачиСвободен завинаги.

117 ръководства на обикновен английски език, структурирани пътеки за обучение и отворена библиотека — създадена от независима 501(c)(3) организация с нестопанска цел, така че всеки да може да разбере модерния AI.

117Безплатни ръководства
1Тематични песни
~2 minПо ръководство
~4hReading time

Започнете тук

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Тематични песни

Преглед по песен

Скочете в района, който ви интересува. Всяка песен има множество ръководства на обикновен английски.

Пълна библиотека

Всички ръководства

117 на 1019 показани ръководства. Филтрирайте по песен или потърсете по-горе.

Аудио AI

Аудио надписи

Аудио надписите генерират изречение на естествен език, описващо съдържанието на аудио клип, като например „сигнал на влак, който минава през прелез“.

2 мин. прочетеноПрочетете
Аудио AI

Разпознаване на шепот

Whisper е автоматичната система за разпознаване на OpenAI с отворен код, която превръща звука в текст на над 90 езика.

2 мин. прочетеноПрочетете
Аудио AI

Wav2Vec 2.0

Wav2Vec 2.0 е Meta самоконтролиран говорен модел на AI, който научава мощни аудио представяния от сурови, немаркирани записи.

2 мин. прочетеноПрочетете
Аудио AI

HuBERT Самоконтролирана реч

HuBERT (Hidden-Unit BERT) е Meta AI's самоконтролиран говорен модел, който се учи чрез предвиждане на групирани аудио единици за маскирани сегменти, в стил BERT.

2 мин. прочетеноПрочетете
Аудио AI

Невронни вокодери

Невронният вокодер е модел, който превръща компактно акустично представяне, обикновено мел-спектрограма, в действителна звукова форма на вълната.

2 мин. прочетеноПрочетете
Аудио AI

Невронни аудио кодеци

Невронните аудио кодеци използват дълбоко обучение, за да компресират звука в малки потоци от отделни токени и да го реконструират с висока прецизност.

2 мин. прочетеноПрочетете
Аудио AI

VALL-E и езикови модели на кодеци

VALL-E преформулира преобразуването на текст в говор като проблем с езиковото моделиране върху токените за аудио кодек, позволявайки гласово клониране само от три секунди от проба.

2 мин. прочетеноПрочетете
Аудио AI

OpenAI Шепот

Whisper е автоматична система за разпознаване на OpenAI с отворен код, която транскрибира и превежда изговорено аудио на десетки езици.

2 мин. прочетеноПрочетете
Аудио AI

Автоматична музикална транскрипция

Автоматичната музикална транскрипция (AMT) преобразува суров аудиозапис на музика в символна нотация като ноти, MIDI или пиано.

2 мин. прочетеноПрочетете
Аудио AI

Проследяване на ритъма и темпото

Проследяването на ритъма и темпото е задача за намиране на постоянен пулс в музиката: къде попада всеки ритъм и колко бързо се движи песента в удари в минута (BPM).

2 мин. прочетеноПрочетете
Аудио AI

Аудио пръстови отпечатъци

Аудио пръстовият отпечатък създава компактен, устойчив на шум цифров подпис на звук, така че да може да бъде разпознат по-късно, дори чрез фонов шум...

2 мин. прочетеноПрочетете
Аудио AI

Джубокс

Jukebox е невронната мрежа на OpenAI за 2020 г., която генерира суров музикален звук — пълен с пеещи гласове, инструменти и дори текстове в стила на специфични...

2 мин. прочетеноПрочетете

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.

Audio AI AI Guides — Page 8 of 10 | AI Understanding