Безкоштовна бібліотека ШІ

Аудіо AI напрямніВільний назавжди.

117 посібники простою англійською мовою, структуровані навчальні маршрути та відкрита бібліотека — створена незалежною некомерційною організацією 501(c)(3), щоб кожен міг зрозуміти сучасний ШІ.

117Безкоштовні путівники
1Тематичні треки
~2 minЗа посібником
~4hЧас читання

Почніть тут

П'ять курси, орієнтовані на результат

Кожен курс включає чіткі результати, компетенції, практичні дії та прикладний завершальний камінь.

02

Відповідальний користувач ШІ

Використовуйте штучний інтелект продуктивно, захищаючи конфіденційність, перевіряючи результати та зберігаючи підзвітність людини.

  1. 1Prompt Engineering
  2. 2ШІ Галюцинації
  3. 3ШІ та конфіденційність
  4. 4ШІ в повсякденному житті
~5h для завершенняПереглянути курс

Тематичні треки

Перегляд за треком

Перейдіть у сферу, яка вам цікава. Кожен трек має декілька гідів простою англійською мовою.

Повна бібліотека

Всі путівники

117 з 1019 показано напрямні. Фільтруйте за треком або шукайте вище.

Аудіо AI

EnCodec Audio Compression

EnCodec — це високоточний нейронний аудіокодек Meta, який стискає мову та музику з дуже низькими бітрейтами з якістю, що конкурує з набагато важчими форматами.

2 хв. читанняПрочитайте
Аудіо AI

Залишкове векторне квантування

Залишкове векторне квантування (RVQ) — це техніка, яка перетворює безперервні вбудовування звуку в компактний стек дискретних кодів шляхом багаторазового квантування...

2 хв. читанняПрочитайте
Аудіо AI

ECAPA-TDNN розпізнавання мовця

ECAPA-TDNN — це архітектура нейронної мережі, яка перетворює будь-який мовний кліп на компактне вбудовування «відбитка голосу», що дозволяє машинам визначати, хто говорить.

2 хв. читанняПрочитайте
Аудіо AI

Speaker Anti-Spoofing і ASV spoof

Антиспуфінг — це захисний рівень, який виявляє підроблені або відтворені голоси, які намагаються обдурити системи автентифікації голосу.

2 хв. читанняПрочитайте
Аудіо AI

Приглушення мовлення за допомогою RNNoise

RNNoise — це крихітна швидка нейронна мережа, яка видаляє фоновий шум із мови в реальному часі.

2 хв. читанняПрочитайте
Аудіо AI

Вбудовування аудіо та навчання репрезентації

Вбудовані аудіо перетворюють звук на компактні числові вектори, які фіксують значення, тож машини можуть порівнювати, шукати та класифікувати аудіо так, як люди розпізнають…

2 хв. читанняПрочитайте
Аудіо AI

Приглушення акустичного відлуння

Акустичне придушення відлуння (AEC) — це технологія, яка запобігає почуттю власного голосу під час розмови.

2 хв. читанняПрочитайте
Аудіо AI

Поділ мовлення та проблема коктейльної вечірки

Розділення мовлення — це завдання виділення окремих голосів із запису, де одночасно розмовляє кілька людей.

2 хв. читанняПрочитайте
Аудіо AI

Інваріантне навчання перестановок

Інваріантне навчання перестановок (PIT) — це розумний навчальний трюк, який дозволяє моделі розділяти кілька голосів, не піклуючись про вихідний слот кожного голосу...

2 хв. читанняПрочитайте
Аудіо AI

Пошук музичної інформації

Пошук музичної інформації (MIR) — це область, яка навчає комп’ютери аналізувати, розуміти та шукати музику за аудіосигналами та нотами.

2 хв. читанняПрочитайте
Аудіо AI

Розділення музичних джерел Demucs і HT-Demucs

Дізнайтеся, як Demucs і HT-Demucs поділяють музику на вокал і інструменти за допомогою моделювання хвилі, спектрограми та трансформатора.

2 хв. читанняПрочитайте
Аудіо AI

Розпізнавання звукових акордів

Розпізнавання аудіоакордів — це завдання автоматичного позначення акордів, які грають у пісні, безпосередньо з її аудіо.

2 хв. читанняПрочитайте

Закінчив читати? Доведіть це.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.