Бесплатная библиотека искусственного интеллекта

Аудио ИИ гидыБесплатно навсегда.

117 простые руководства на английском языке, структурированные схемы обучения и открытая библиотека, созданная независимой некоммерческой организацией 501(c)(3), чтобы каждый мог понять современный искусственный интеллект.

117Бесплатные гиды
1Тематические треки
~2 minЗа руководство
~4hВремя чтения

Начните здесь

Пять курсы, ориентированные на результат

Каждый курс включает в себя явные результаты, обозначенные компетенции, практические занятия и прикладной завершающий этап.

01

Фонды искусственного интеллекта

Поймите, что такое ИИ, как системы учатся, где они терпят неудачу и как оценивать претензии без шумихи.

  1. 1Что такое ИИ?
  2. 2Как учится ИИ
  3. 3Объяснение моделей искусственного интеллекта
  4. 4Тесты искусственного интеллекта
~4ч, чтобы завершитьПосмотреть курс
03

ИИ в работе

Оценивайте варианты использования на рабочем месте, запускайте безопасные пилотные проекты, измеряйте ценность и ответственно сообщайте об изменениях.

  1. 1Автоматизация рабочих процессов с использованием искусственного интеллекта
  2. 2Тесты искусственного интеллекта
  3. 3ИИ и рабочие места
  4. 4Управление ИИ
~6ч, чтобы завершитьПосмотреть курс
04

Политика и общество в области искусственного интеллекта

Анализируйте системы ИИ с точки зрения прав, справедливости, управления, безопасности и результатов, отвечающих общественным интересам.

  1. 1Этика ИИ
  2. 2ИИ и конфиденциальность
  3. 3Регулирование ИИ
  4. 4Мифы об искусственном интеллекте
~6ч, чтобы завершитьПосмотреть курс
05

Строительство с использованием систем искусственного интеллекта

Понимание языковых моделей, поиска, агентов, оценки, стоимости и гарантий развертывания посредством практического проектирования системы.

  1. 1ChatGPT и LLM
  2. 2Качество поиска
  3. 3ИИ-агенты
  4. 4Тесты искусственного интеллекта
~8ч, чтобы завершитьПосмотреть курс

Тематические треки

Просмотр по треку

Прыгайте в область, которая вас волнует. У каждого трека есть несколько путеводителей на простом английском языке.

Полная библиотека

Все руководства

117 из 1019 показаны направляющие. Фильтруйте по треку или выполните поиск выше.

Аудио ИИ

Формирование луча и микрофонные решетки

Технология Beamforming использует несколько микрофонов для прослушивания в выбранном направлении, усиливая звук от цели и подавляя все остальное.

2 минута чтенияЧитать
Аудио ИИ

Спектрограмма Риффузии. Диффузия.

Riffusion — это хитрый хак, который генерирует музыку, рассматривая звук как изображение: он настраивает модель изображения Stable Diffusion для рисования спектрограмм, а затем…

2 минута чтенияЧитать
Аудио ИИ

MusicLM: иерархические семантические и акустические токены

Узнайте, как Google MusicLM использует иерархические семантические и акустические токены, SoundStream и MuLan для преобразования текстовых подсказок в связную музыку.

2 минута чтенияЧитать
Аудио ИИ

Улучшение речи Noise2Noise

Noise2Noise — это обучающий прием, который позволяет модели научиться удалять шум, даже не видя чистого эталона, путем обучения на парах с разным уровнем шума…

2 минута чтенияЧитать
Аудио ИИ

Разделение во временной области Conv-TasNet

Conv-TasNet — это нейронная сеть, которая разделяет смешанный звук (например, когда два человека говорят одновременно), работая непосредственно с необработанным звуковым сигналом…

2 минута чтенияЧитать
Аудио ИИ

Двухпутевое разделение RNN

Dual-Path RNN (DPRNN) — это архитектура разделения звука, которая разбивает очень длинную последовательность аудиофункций на короткие перекрывающиеся фрагменты и обрабатывает их…

2 минута чтенияЧитать
Аудио ИИ

Разделение музыки Open-Unmix

Open-Unmix (UMX) — это система глубокого обучения с открытым исходным кодом, которая разбивает песню на части: вокал, ударные, бас и другие инструменты.

2 минута чтенияЧитать
Аудио ИИ

Выравнивание слов с меткой времени

Функция выравнивания слов шепота привязывает каждое транскрибируемое слово к точному времени начала и окончания аудиозаписи.

2 минута чтенияЧитать
Аудио ИИ

Музыкальные теги с помощью трансформеров

Маркировка музыки использует модели трансформеров для прослушивания песни и прогнозирования описательных меток, таких как жанр, настроение, инструменты и темп.

2 минута чтенияЧитать
Аудио ИИ

Обнаружение начала в аудио

Обнаружение начала определяет точные моменты, когда в аудиосигнале начинаются ноты, доли или звуки.

2 минута чтенияЧитать
Аудио ИИ

Генеративный вокодер MelGAN

MelGAN — это полностью сверточный вокодер на основе GAN, который превращает мел-спектрограммы в необработанные аудиосигналы за один проход вперед.

2 минута чтенияЧитать
Аудио ИИ

Вокодер UnivNet с несколькими разрешениями

UnivNet — это вокодер GAN, который оценивает сгенерированный звук с помощью нескольких спектрограмм, рассчитанных с разным разрешением STFT, повышая четкость высокочастотных деталей.

2 минута чтенияЧитать

Закончили читать? Докажите это.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.