Безплатна AI библиотека

Аудио AI водачиСвободен завинаги.

117 ръководства на обикновен английски език, структурирани пътеки за обучение и отворена библиотека — създадена от независима 501(c)(3) организация с нестопанска цел, така че всеки да може да разбере модерния AI.

117Безплатни ръководства
1Тематични песни
~2 minПо ръководство
~4hReading time

Започнете тук

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Тематични песни

Преглед по песен

Скочете в района, който ви интересува. Всяка песен има множество ръководства на обикновен английски.

Пълна библиотека

Всички ръководства

117 на 1019 показани ръководства. Филтрирайте по песен или потърсете по-горе.

Аудио AI

EnCodec аудио компресия

EnCodec е висококачественият невронен аудио кодек на Meta, който компресира реч и музика при много ниски битрейт с качество, съперничещо на много по-тежки формати.

2 мин. прочетеноПрочетете
Аудио AI

Остатъчно векторно квантуване

Остатъчното векторно квантуване (RVQ) е техниката, която превръща непрекъснатите аудио вграждания в компактен стек от дискретни кодове чрез многократно квантуване...

2 мин. прочетеноПрочетете
Аудио AI

ECAPA-TDNN разпознаване на високоговорители

ECAPA-TDNN е архитектура на невронна мрежа, която превръща всеки говорен клип в компактно вграждане на „гласов отпечатък“, което позволява на машините да разпознават кой говори.

2 мин. прочетеноПрочетете
Аудио AI

Speaker Anti-Spoofing и ASV spoofing

Анти-спуфингът е защитният слой, който открива фалшиви или възпроизведени гласове, опитващи се да заблудят системите за гласово удостоверяване.

2 мин. прочетеноПрочетете
Аудио AI

Демонтаж на реч с RNNoise

RNNoise е малка, бърза невронна мрежа, която премахва фоновия шум от речта в реално време.

2 мин. прочетеноПрочетете
Аудио AI

Аудио вграждания и обучение за представяне

Аудио вгражданията превръщат звука в компактни цифрови вектори, които улавят значението, така че машините да могат да сравняват, търсят и класифицират аудио по начина, по който хората разпознават...

2 мин. прочетеноПрочетете
Аудио AI

Отмяна на акустично ехо

Потискането на акустичното ехо (AEC) е технологията, която не ви позволява да чуете собствения си глас да отскача по време на разговор.

2 мин. прочетеноПрочетете
Аудио AI

Разделяне на речта и проблемът с коктейлното парти

Разделянето на речта е задача за отделяне на отделни гласове от запис, където няколко души говорят наведнъж.

2 мин. прочетеноПрочетете
Аудио AI

Пермутационно инвариантно обучение

Пермутационно инвариантно обучение (PIT) е умен трик за обучение, който позволява на модела да разделя множество гласове, без да се интересува в кой изходен слот попада всеки глас...

2 мин. прочетеноПрочетете
Аудио AI

Извличане на музикална информация

Извличането на музикална информация (MIR) е областта, която учи компютрите да анализират, разбират и търсят музика от аудио сигнали и партитури.

2 мин. прочетеноПрочетете
Аудио AI

Разделяне на музикален източник на Demucs и HT-Demucs

Научете как Demucs и HT-Demucs разделят музиката на вокали и инструменти с помощта на вълнова форма, спектрограма и моделиране на трансформатор.

2 мин. прочетеноПрочетете
Аудио AI

Разпознаване на аудио акорд

Разпознаването на аудио акорди е задачата за автоматично етикетиране на акордите, изсвирени в песен, директно от нейния звук.

2 мин. прочетеноПрочетете

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.

Audio AI AI Guides — Page 3 of 10 | AI Understanding