Безкоштовна бібліотека ШІ

Аудіо AI напрямніВільний назавжди.

117 посібники простою англійською мовою, структуровані навчальні маршрути та відкрита бібліотека — створена незалежною некомерційною організацією 501(c)(3), щоб кожен міг зрозуміти сучасний ШІ.

117Безкоштовні путівники
1Тематичні треки
~2 minЗа посібником
~4hЧас читання

Почніть тут

П'ять курси, орієнтовані на результат

Кожен курс включає чіткі результати, компетенції, практичні дії та прикладний завершальний камінь.

02

Відповідальний користувач ШІ

Використовуйте штучний інтелект продуктивно, захищаючи конфіденційність, перевіряючи результати та зберігаючи підзвітність людини.

  1. 1Prompt Engineering
  2. 2ШІ Галюцинації
  3. 3ШІ та конфіденційність
  4. 4ШІ в повсякденному житті
~5h для завершенняПереглянути курс

Тематичні треки

Перегляд за треком

Перейдіть у сферу, яка вам цікава. Кожен трек має декілька гідів простою англійською мовою.

Повна бібліотека

Всі путівники

117 з 1019 показано напрямні. Фільтруйте за треком або шукайте вище.

Аудіо AI

Аудіо субтитри

Аудіосубтитри генерують речення природною мовою, що описує вміст аудіозапису, наприклад «гудок поїзда реве, коли він проїжджає залізничний переїзд».

2 хв. читанняПрочитайте
Аудіо AI

Розпізнавання шепітної мови

Whisper — це система автоматичного розпізнавання мовлення з відкритим кодом OpenAI, яка перетворює аудіо на текст понад 90 мовами.

2 хв. читанняПрочитайте
Аудіо AI

Wav2Vec 2.0

Wav2Vec 2.0 — це Meta мовна модель AIU_PROTECTED_13__ з самоконтролем, яка вивчає потужні звукові представлення з необроблених записів без міток.

2 хв. читанняПрочитайте
Аудіо AI

HuBERT Самоконтрольована промова

HuBERT (Hidden-Unit BERT) — це Meta мовна модель AIU_PROTECTED_13__, яка навчається шляхом прогнозування кластерних аудіоблоків для замаскованих сегментів у стилі BERT.

2 хв. читанняПрочитайте
Аудіо AI

Нейронні вокодери

Нейронний вокодер — це модель, яка перетворює компактне акустичне представлення, як правило, мел-спектрограму, на фактичну звукову форму сигналу.

2 хв. читанняПрочитайте
Аудіо AI

Нейронні аудіокодеки

Нейронні аудіокодеки використовують глибоке навчання, щоб стискати звук у крихітні потоки окремих токенів і реконструювати його з високою точністю.

2 хв. читанняПрочитайте
Аудіо AI

VALL-E та моделі мови кодеків

VALL-E переформулював перетворення тексту в мову як проблему моделювання мови над маркерами аудіокодеків, уможлививши клонування голосу лише з трьох секунд зразка.

2 хв. читанняПрочитайте
Аудіо AI

OpenAI Шепіт

Whisper — це система автоматичного розпізнавання мовлення з відкритим кодом OpenAI, яка транскрибує та перекладає розмовне аудіо десятками мов.

2 хв. читанняПрочитайте
Аудіо AI

Автоматична транскрипція музики

Автоматична музична транскрипція (AMT) перетворює необроблений аудіозапис музики на символічну нотацію, як-от ноти, MIDI або піаніно.

2 хв. читанняПрочитайте
Аудіо AI

Відстеження ритму та темпу

Відстеження ритму та темпу — це завдання знайти рівномірний пульс у музиці: де падає кожен удар і як швидко пісня рухається в ударах на хвилину (BPM).

2 хв. читанняПрочитайте
Аудіо AI

Аудіо відбитки пальців

Аудіо відбитки пальців створюють компактний, шумостійкий цифровий підпис звуку, щоб його можна було розпізнати пізніше навіть через фоновий шум…

2 хв. читанняПрочитайте
Аудіо AI

музичний автомат

Jukebox — це нейронна мережа OpenAI 2020 року, яка генерує необроблене музичне аудіо — разом зі співочими голосами, інструментами та навіть текстами в стилі певних…

2 хв. читанняПрочитайте

Закінчив читати? Доведіть це.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.