Безкоштовна бібліотека ШІ

Аудіо AI напрямніВільний назавжди.

117 посібники простою англійською мовою, структуровані навчальні маршрути та відкрита бібліотека — створена незалежною некомерційною організацією 501(c)(3), щоб кожен міг зрозуміти сучасний ШІ.

117Безкоштовні путівники
1Тематичні треки
~2 minЗа посібником
~4hЧас читання

Почніть тут

П'ять курси, орієнтовані на результат

Кожен курс включає чіткі результати, компетенції, практичні дії та прикладний завершальний камінь.

02

Відповідальний користувач ШІ

Використовуйте штучний інтелект продуктивно, захищаючи конфіденційність, перевіряючи результати та зберігаючи підзвітність людини.

  1. 1Prompt Engineering
  2. 2ШІ Галюцинації
  3. 3ШІ та конфіденційність
  4. 4ШІ в повсякденному житті
~5h для завершенняПереглянути курс

Тематичні треки

Перегляд за треком

Перейдіть у сферу, яка вам цікава. Кожен трек має декілька гідів простою англійською мовою.

Повна бібліотека

Всі путівники

117 з 1019 показано напрямні. Фільтруйте за треком або шукайте вище.

Аудіо AI

Відокремлення стебла Spleeter

Spleeter — це інструмент із відкритим вихідним кодом від Deezer, який розділяє готову пісню на окремі треки (вокал, ударні, бас тощо) за допомогою глибокого навчання.

2 хв. читанняПрочитайте
Аудіо AI

Оцінка кроку КРЕП

CREPE — це модель глибокого навчання, яка оцінює основну частоту (висоту тону) монофонічного аудіосигналу безпосередньо з його вихідної форми.

2 хв. читанняПрочитайте
Аудіо AI

Показники якості мовлення PESQ і STOI

PESQ і STOI — це стандартні об’єктивні показники, які оцінюють, наскільки добре звучить оброблена мова та наскільки вона зрозуміла, не потребуючи слухачів.

2 хв. читанняПрочитайте
Аудіо AI

Вокодування Source-Filter і WORLD

Вокодер — це інструмент, який розбирає мову на будівельні блоки та перебудовує її.

2 хв. читанняПрочитайте
Аудіо AI

Оцінка середньої оцінки думки

Середня оцінка думки (MOS) – це середня оцінка слухачів від 1 до 5, яка визначає, наскільки добре звучить синтезований або переданий звук.

2 хв. читанняПрочитайте
Аудіо AI

Перетворення Constant-Q для аудіо

Constant-Q Transform (CQT) — це частотний аналіз, який використовує логарифмічно віддалені відрізки, узгоджені з музичною висотою, замість рівномірно розташованих відсіків…

2 хв. читанняПрочитайте
Аудіо AI

Filterbank і функції PLP

Функції банку фільтрів і перцептуального лінійного прогнозування (PLP) — це способи узагальнення мовного сигналу в компактні, перцептивно значущі числа, які обробляють...

2 хв. читанняПрочитайте
Аудіо AI

StyleTTS 2 Розповсюдження стилю

StyleTTS 2 — це модель перетворення тексту в мовлення, яка розглядає «стиль» голосу — просодію, емоції та тембр динаміка — як випадкову змінну, відібрану за допомогою моделі дифузії…

2 хв. читанняПрочитайте
Аудіо AI

FastPitch Pitch-Controlled TTS

FastPitch — це швидка неавторегресійна модель перетворення тексту в мовлення, яка чітко прогнозує висоту (основну частоту) кожного вхідного токена, дозволяючи вам…

2 хв. читанняПрочитайте
Аудіо AI

Генерація мовлення за допомогою Voicebox Flow-Matching

Voicebox — це модель генерації мовлення з текстовим керуванням Meta, навчена меті зіставлення потоку, щоб «заповнити» масковане аудіо, дозволяючи одній моделі створювати нульовий голос…

2 хв. читанняПрочитайте
Аудіо AI

Глибоке придушення шуму

Deep Noise Suppression (DNS) Challenge — це змагання Microsoft, яке спонукає дослідників до створення нейронних мереж, які усувають фоновий шум…

2 хв. читанняПрочитайте
Аудіо AI

Спектральне віднімання та фільтрація Вінера

Спектральне віднімання та фільтрація Вінера є класичними робочими конячками шумозаглушення, які передують поглибленому навчанню.

2 хв. читанняПрочитайте

Закінчив читати? Доведіть це.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Audio AI AI Guides — Page 5 of 10 | AI Understanding