Безкоштовна бібліотека ШІ

Аудіо AI напрямніВільний назавжди.

117 посібники простою англійською мовою, структуровані навчальні маршрути та відкрита бібліотека — створена незалежною некомерційною організацією 501(c)(3), щоб кожен міг зрозуміти сучасний ШІ.

117Безкоштовні путівники
1Тематичні треки
~2 minЗа посібником
~4hЧас читання

Почніть тут

П'ять курси, орієнтовані на результат

Кожен курс включає чіткі результати, компетенції, практичні дії та прикладний завершальний камінь.

02

Відповідальний користувач ШІ

Використовуйте штучний інтелект продуктивно, захищаючи конфіденційність, перевіряючи результати та зберігаючи підзвітність людини.

  1. 1Prompt Engineering
  2. 2ШІ Галюцинації
  3. 3ШІ та конфіденційність
  4. 4ШІ в повсякденному житті
~5h для завершенняПереглянути курс

Тематичні треки

Перегляд за треком

Перейдіть у сферу, яка вам цікава. Кожен трек має декілька гідів простою англійською мовою.

Повна бібліотека

Всі путівники

117 з 1019 показано напрямні. Фільтруйте за треком або шукайте вище.

Аудіо AI

Синтез співочого голосу

Singing Voice Synthesis (SVS) — це штучний інтелект, який перетворює написану мелодію та текст пісні на повністю співане вокальне виконання.

2 хв. читанняПрочитайте
Аудіо AI

AudioLM

AudioLM — це Google дослідницька структура, яка генерує реалістичне аудіо — мову чи фортепіанну музику — розглядаючи звук як мову та передбачаючи його символ…

2 хв. читанняПрочитайте
Аудіо AI

MusicGen

MusicGen — це модель штучного інтелекту Meta, яка генерує музику з текстового опису та, за бажанням, мелодії, яку ви наспівуєте або завантажуєте.

2 хв. читанняПрочитайте
Аудіо AI

Виявлення ключових слів і слова пробудження

Виявлення ключових слів — це технологія постійного прослуховування, яка дозволяє пристрою чекати однієї фрази-тригера, як-от «Hey Siri» або «Alexa», перш ніж запустити…

2 хв. читанняПрочитайте
Аудіо AI

Примусове вирівнювання

Примусове вирівнювання автоматично вирівнює відому транскрипцію з її звуком, точно позначаючи, коли кожне слово чи звук починається й закінчується.

2 хв. читанняПрочитайте
Аудіо AI

Спектрограми Мела

Мел-спектрограма — це зображення звуку в часі з частотою, розподіленою так, як людське вухо сприймає висоту.

2 хв. читанняПрочитайте
Аудіо AI

Коннекціоністська часова класифікація

Часова класифікація зв’язку (CTC) — це функція втрати та метод декодування, який дозволяє нейронним мережам перетворювати довгу аудіопослідовність на текст без…

2 хв. читанняПрочитайте
Аудіо AI

Моделі перетворювачів RNN

RNN-Transducer (RNN-T) — це архітектура розпізнавання мовлення, яка підтримує потокове передавання, і усуває найбільшу слабкість CTC — його нездатність моделювати залежності…

2 хв. читанняПрочитайте
Аудіо AI

Конформерна архітектура

Конформер — це блок нейронної мережі, який поєднує згортку з увагою до себе, вловлюючи як тонкі локальні звукові шаблони, так і дальний контекст…

2 хв. читанняПрочитайте

Закінчив читати? Доведіть це.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.