Безкоштовна бібліотека ШІ

Аудіо AI напрямніВільний назавжди.

117 посібники простою англійською мовою, структуровані навчальні маршрути та відкрита бібліотека — створена незалежною некомерційною організацією 501(c)(3), щоб кожен міг зрозуміти сучасний ШІ.

117Безкоштовні путівники
1Тематичні треки
~2 minЗа посібником
~4hЧас читання

Почніть тут

П'ять курси, орієнтовані на результат

Кожен курс включає чіткі результати, компетенції, практичні дії та прикладний завершальний камінь.

02

Відповідальний користувач ШІ

Використовуйте штучний інтелект продуктивно, захищаючи конфіденційність, перевіряючи результати та зберігаючи підзвітність людини.

  1. 1Prompt Engineering
  2. 2ШІ Галюцинації
  3. 3ШІ та конфіденційність
  4. 4ШІ в повсякденному житті
~5h для завершенняПереглянути курс

Тематичні треки

Перегляд за треком

Перейдіть у сферу, яка вам цікава. Кожен трек має декілька гідів простою англійською мовою.

Повна бібліотека

Всі путівники

117 з 1019 показано напрямні. Фільтруйте за треком або шукайте вище.

Аудіо AI

Суно і Удіо

Suno та Udio є двома провідними споживчими музичними генераторами зі штучним інтелектом, які перетворюють коротке текстове повідомлення на повну пісню майже студійної якості — разом із вокалом…

2 хв. читанняПрочитайте
Аудіо AI

Символічне музичне покоління

Генерація символічної музики створює музику як структуровану нотацію — ноти, висоту, тривалість і синхронізацію (часто як MIDI), — а не як необроблений аудіо.

2 хв. читанняПрочитайте
Аудіо AI

Мел-частотні кепстральні коефіцієнти

Мел-частотні кепстральні коефіцієнти (MFCC) — це компактний набір чисел, які підсумовують форму частотного спектру звуку так, як людське вухо сприймає…

2 хв. читанняПрочитайте
Аудіо AI

WaveNet

WaveNet, представлена компанією DeepMind у 2016 році, була революційною нейронною мережею, яка генерує необроблений аудіо один семпл за раз, створюючи вражаюче природне мовлення…

2 хв. читанняПрочитайте
Аудіо AI

Такотрон 2

Tacotron 2 — це наскрізна система перетворення тексту в мовлення від Google (2017), яка перетворює письмовий текст безпосередньо в мел-спектрограму, яку перетворює нейронний вокодер…

2 хв. читанняПрочитайте
Аудіо AI

Виявлення аудіо Deepfake

Виявлення аудіопідробок — це набір методів, які використовуються для визначення того, чи був голосовий запис сказаний справжньою людиною чи синтезований/клонований ШІ.

2 хв. читанняПрочитайте
Аудіо AI

Моделювання просодії

Моделювання просодії навчає машини мелодії мовлення, ритму, висоти, наголосу та темпу, які йдуть поверх слів.

2 хв. читанняПрочитайте
Аудіо AI

Емоційний синтез мовлення

Емоційний синтез мовлення генерує голоси, які звучать радісно, ​​сумно, сердито або спокійно, не просто зрозуміло, але й правдоподібно відчуваються.

2 хв. читанняПрочитайте
Аудіо AI

Перетворення голосу

Перетворення голосу перетворює записане мовлення однієї людини так, щоб воно звучало так, ніби його вимовив хтось інший, зберігаючи оригінальні слова та час.

2 хв. читанняПрочитайте
Аудіо AI

Діаризація спікера

Діаризація спікера відповідає на запитання "хто коли говорив?" шляхом поділу аудіозапису на сегменти, позначені ідентифікатором мовця.

2 хв. читанняПрочитайте
Аудіо AI

Перевірка мовця

Перевірка мовця підтверджує, чи відповідає голос певній заявленій особистості, діючи як голосовий пароль.

2 хв. читанняПрочитайте
Аудіо AI

Виявлення голосової активності

Виявлення голосової активності (VAD) момент за моментом визначає, чи містить звуковий сигнал людську мову чи лише тишу та шум.

2 хв. читанняПрочитайте

Закінчив читати? Доведіть це.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.