Бесплатная библиотека искусственного интеллекта

Аудио ИИ гидыБесплатно навсегда.

117 простые руководства на английском языке, структурированные схемы обучения и открытая библиотека, созданная независимой некоммерческой организацией 501(c)(3), чтобы каждый мог понять современный искусственный интеллект.

117Бесплатные гиды
1Тематические треки
~2 minЗа руководство
~4hВремя чтения

Начните здесь

Пять курсы, ориентированные на результат

Каждый курс включает в себя явные результаты, обозначенные компетенции, практические занятия и прикладной завершающий этап.

01

Фонды искусственного интеллекта

Поймите, что такое ИИ, как системы учатся, где они терпят неудачу и как оценивать претензии без шумихи.

  1. 1Что такое ИИ?
  2. 2Как учится ИИ
  3. 3Объяснение моделей искусственного интеллекта
  4. 4Тесты искусственного интеллекта
~4ч, чтобы завершитьПосмотреть курс
03

ИИ в работе

Оценивайте варианты использования на рабочем месте, запускайте безопасные пилотные проекты, измеряйте ценность и ответственно сообщайте об изменениях.

  1. 1Автоматизация рабочих процессов с использованием искусственного интеллекта
  2. 2Тесты искусственного интеллекта
  3. 3ИИ и рабочие места
  4. 4Управление ИИ
~6ч, чтобы завершитьПосмотреть курс
04

Политика и общество в области искусственного интеллекта

Анализируйте системы ИИ с точки зрения прав, справедливости, управления, безопасности и результатов, отвечающих общественным интересам.

  1. 1Этика ИИ
  2. 2ИИ и конфиденциальность
  3. 3Регулирование ИИ
  4. 4Мифы об искусственном интеллекте
~6ч, чтобы завершитьПосмотреть курс
05

Строительство с использованием систем искусственного интеллекта

Понимание языковых моделей, поиска, агентов, оценки, стоимости и гарантий развертывания посредством практического проектирования системы.

  1. 1ChatGPT и LLM
  2. 2Качество поиска
  3. 3ИИ-агенты
  4. 4Тесты искусственного интеллекта
~8ч, чтобы завершитьПосмотреть курс

Тематические треки

Просмотр по треку

Прыгайте в область, которая вас волнует. У каждого трека есть несколько путеводителей на простом английском языке.

Полная библиотека

Все руководства

117 из 1019 показаны направляющие. Фильтруйте по треку или выполните поиск выше.

Аудио ИИ

Кодек потокового аудио Mimi

Mimi — это нейронный аудиокодек, который сжимает речь в крошечный поток дискретных токенов в реальном времени, поэтому модели ИИ могут слушать и говорить с очень низкой…

2 минута чтенияЧитать
Аудио ИИ

Слушай, посещай и произноси

Listen, Attend and Spell (LAS) — это знаковая нейронная сеть 2015 года, которая транскрибирует речь непосредственно в символы, без ручного произношения…

2 минута чтенияЧитать
Аудио ИИ

SpecAugment для распознавания речи

SpecAugment — это простой, но мощный метод дополнения данных, который маскирует и искажает спектрограмму речи, чтобы сделать модели распознавания более надежными.

2 минута чтенияЧитать
Аудио ИИ

Автоматическая пометка музыки

Автоматическая пометка музыки использует машинное обучение для прослушивания песни и автоматически присваивает описательные метки, такие как жанр, настроение, инструменты и темп.

2 минута чтенияЧитать
Аудио ИИ

Передача музыкального тембра

Передача тембра меняет «цвет тона» звука, так что один инструмент звучит как другой, превращая напеваемую мелодию в партию скрипки или трубы…

2 минута чтенияЧитать
Аудио ИИ

Классификация акустических сцен

Классификация акустических сцен (ASC) обучает машины распознавать среду, в которой была сделана запись: оживленная улица, тихий парк, поезд, кафе…

2 минута чтенияЧитать
Аудио ИИ

Выступление NVIDIA Riva и NeMo

NVIDIA Riva — это SDK с графическим ускорением для промышленного речевого искусственного интеллекта (ASR, TTS и перевод), а NeMo — набор инструментов с открытым исходным кодом для обучения и тонкой настройки…

2 минута чтенияЧитать
Аудио ИИ

Архитектура DeepSpeech

DeepSpeech — это модель сквозного распознавания речи, представленная Baidu в 2014 году, которая сопоставляет необработанные аудиофункции непосредственно с текстом с помощью рекуррентного нейронного…

2 минута чтенияЧитать
Аудио ИИ

Встраивание динамиков X-Vector

X-векторы — это числовые отпечатки голоса говорящего фиксированной длины, создаваемые нейронной сетью и используемые для определения того, кто говорит, независимо от того, что он говорит.

2 минута чтенияЧитать
Аудио ИИ

Монотонное выравнивание Glow-TTS

Glow-TTS — это модель преобразования текста в речь, которая самостоятельно учится выравнивать текст по речи с помощью умного трюка поиска, устраняя необходимость в отдельном выравнивателе.

2 минута чтенияЧитать
Аудио ИИ

Параллельный вокодер WaveGAN

Parallel WaveGAN — это быстрый нейронный вокодер, который превращает мел-спектрограмму в необработанный звуковой сигнал с помощью небольшого GAN, генерируя все сэмплы одновременно.

2 минута чтенияЧитать
Аудио ИИ

Поточный вокодер WaveGlow

WaveGlow — это нейронный вокодер на основе потока от NVIDIA, который синтезирует речевые сигналы из мел-спектрограмм за один проход без авторегрессии.

2 минута чтенияЧитать

Закончили читать? Докажите это.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.