Безкоштовна бібліотека ШІ

Аудіо AI напрямніВільний назавжди.

117 посібники простою англійською мовою, структуровані навчальні маршрути та відкрита бібліотека — створена незалежною некомерційною організацією 501(c)(3), щоб кожен міг зрозуміти сучасний ШІ.

117Безкоштовні путівники
1Тематичні треки
~2 minЗа посібником
~4hЧас читання

Почніть тут

П'ять курси, орієнтовані на результат

Кожен курс включає чіткі результати, компетенції, практичні дії та прикладний завершальний камінь.

02

Відповідальний користувач ШІ

Використовуйте штучний інтелект продуктивно, захищаючи конфіденційність, перевіряючи результати та зберігаючи підзвітність людини.

  1. 1Prompt Engineering
  2. 2ШІ Галюцинації
  3. 3ШІ та конфіденційність
  4. 4ШІ в повсякденному житті
~5h для завершенняПереглянути курс

Тематичні треки

Перегляд за треком

Перейдіть у сферу, яка вам цікава. Кожен трек має декілька гідів простою англійською мовою.

Повна бібліотека

Всі путівники

117 з 1019 показано напрямні. Фільтруйте за треком або шукайте вище.

Аудіо AI

Формування променя та мікрофонні масиви

Beamforming використовує кілька мікрофонів для прослуховування у вибраному напрямку, підсилюючи звук від цілі та пригнічуючи все інше.

2 хв. читанняПрочитайте
Аудіо AI

Рифузійна спектрограма Дифузія

Riffusion — це хитра техніка, яка генерує музику, сприймаючи звук як картинку: вона точно налаштовує модель зображення Stable Diffusion для малювання спектрограм, а потім...

2 хв. читанняПрочитайте
Аудіо AI

MusicLM: Ієрархічні семантичні та акустичні лексеми

Дізнайтеся, як Google MusicLM використовує ієрархічні семантичні й акустичні токени, SoundStream і MuLan, щоб перетворювати текстові підказки на зв’язну музику.

2 хв. читанняПрочитайте
Аудіо AI

Noise2Noise Покращення мови

Noise2Noise — це навчальний трюк, який дозволяє моделі навчитися видаляти шум, навіть не бачачи чистого посилання, навчаючись на парах різношумних...

2 хв. читанняПрочитайте
Аудіо AI

Розділення часової області Conv-TasNet

Conv-TasNet — це нейронна мережа, яка розділяє змішане аудіо (як-от двоє людей, що розмовляють одночасно), працюючи безпосередньо над необробленою звуковою формою...

2 хв. читанняПрочитайте
Аудіо AI

Розділення RNN з подвійним трактом

Dual-Path RNN (DPRNN) — це архітектура поділу аудіо, яка розбиває дуже довгу послідовність аудіофункцій на короткі частки, що перекриваються, і обробляє їх…

2 хв. читанняПрочитайте
Аудіо AI

Розділення музики «Відкрити-Розмікшувати».

Open-Unmix (UMX) — це система глибокого навчання з відкритим кодом, яка розділяє пісню на частини: вокал, ударні, бас та інші інструменти.

2 хв. читанняПрочитайте
Аудіо AI

Вирівнювання слів із міткою часу Whisper

Вирівнювання слів пошепки прикріплює кожне транскрибоване слово до точного часу початку та кінця в аудіо.

2 хв. читанняПрочитайте
Аудіо AI

Позначення музики за допомогою Transformers

Додавання тегів до музики використовує моделі трансформаторів для прослуховування пісні та прогнозування описових міток, таких як жанр, настрій, інструменти та темп.

2 хв. читанняПрочитайте
Аудіо AI

Виявлення початку в аудіо

Виявлення початку виявляє точні моменти, коли в аудіосигналі починаються ноти, удари або звуки.

2 хв. читанняПрочитайте
Аудіо AI

Генеративний вокодер MelGAN

MelGAN — це повністю згортковий вокодер на базі GAN, який перетворює мел-спектрограми на необроблені звукові сигнали за один швидкий прохід вперед.

2 хв. читанняПрочитайте
Аудіо AI

UnivNet Multi-Resolution Vocoder

UnivNet — це вокодер GAN, який оцінює згенероване аудіо за допомогою кількох спектрограм, обчислених із різною роздільною здатністю STFT, покращуючи високочастотні деталі.

2 хв. читанняПрочитайте

Закінчив читати? Доведіть це.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.