Бесплатная библиотека искусственного интеллекта

Аудио ИИ гидыБесплатно навсегда.

117 простые руководства на английском языке, структурированные схемы обучения и открытая библиотека, созданная независимой некоммерческой организацией 501(c)(3), чтобы каждый мог понять современный искусственный интеллект.

117Бесплатные гиды
1Тематические треки
~2 minЗа руководство
~4hВремя чтения

Начните здесь

Пять курсы, ориентированные на результат

Каждый курс включает в себя явные результаты, обозначенные компетенции, практические занятия и прикладной завершающий этап.

01

Фонды искусственного интеллекта

Поймите, что такое ИИ, как системы учатся, где они терпят неудачу и как оценивать претензии без шумихи.

  1. 1Что такое ИИ?
  2. 2Как учится ИИ
  3. 3Объяснение моделей искусственного интеллекта
  4. 4Тесты искусственного интеллекта
~4ч, чтобы завершитьПосмотреть курс
03

ИИ в работе

Оценивайте варианты использования на рабочем месте, запускайте безопасные пилотные проекты, измеряйте ценность и ответственно сообщайте об изменениях.

  1. 1Автоматизация рабочих процессов с использованием искусственного интеллекта
  2. 2Тесты искусственного интеллекта
  3. 3ИИ и рабочие места
  4. 4Управление ИИ
~6ч, чтобы завершитьПосмотреть курс
04

Политика и общество в области искусственного интеллекта

Анализируйте системы ИИ с точки зрения прав, справедливости, управления, безопасности и результатов, отвечающих общественным интересам.

  1. 1Этика ИИ
  2. 2ИИ и конфиденциальность
  3. 3Регулирование ИИ
  4. 4Мифы об искусственном интеллекте
~6ч, чтобы завершитьПосмотреть курс
05

Строительство с использованием систем искусственного интеллекта

Понимание языковых моделей, поиска, агентов, оценки, стоимости и гарантий развертывания посредством практического проектирования системы.

  1. 1ChatGPT и LLM
  2. 2Качество поиска
  3. 3ИИ-агенты
  4. 4Тесты искусственного интеллекта
~8ч, чтобы завершитьПосмотреть курс

Тематические треки

Просмотр по треку

Прыгайте в область, которая вас волнует. У каждого трека есть несколько путеводителей на простом английском языке.

Полная библиотека

Все руководства

117 из 1019 показаны направляющие. Фильтруйте по треку или выполните поиск выше.

Аудио ИИ

Диффузионный вокодер DiffWave

DiffWave — это вокодер на основе диффузии, который синтезирует звук путем итеративного шумоподавления случайного шума в форму волны, обусловленную мел-спектрограммой.

2 минута чтенияЧитать
Аудио ИИ

Генеративная аудиомодель Bark

Bark — это модель преобразования текста в аудио с открытым исходным кодом от Suno, которая генерирует не только речь, но и смех, вздохи, музыку и звуковые эффекты непосредственно из текстовых подсказок.

2 минута чтенияЧитать
Аудио ИИ

Авторегрессионный синтез TTS черепахи

Tortoise TTS — это система преобразования текста в речь с открытым исходным кодом, которая ценится за необычайно естественные, эмоционально насыщенные голоса и сильное клонирование голоса всего из нескольких коротких…

2 минута чтенияЧитать
Аудио ИИ

Межъязыковое клонирование голоса XTTS

XTTS — это многоязычная модель преобразования текста в речь Coqui, которая может клонировать голос из короткого клипа, а затем говорить на многих разных языках, сохраняя при этом…

2 минута чтенияЧитать
Аудио ИИ

Параллельная генерация звука SoundStorm

SoundStorm — это модель генерации звука Google, которая воспроизводит речь и звук параллельно, а не по одному токену за раз, обеспечивая высококачественный синтез звука…

2 минута чтенияЧитать
Аудио ИИ

AudioGen Синтез текста в аудио

AudioGen — это модель Meta, которая превращает текстовые описания в реалистичные звуки окружающей среды и звуковые эффекты, например «лай собаки под щебетание птиц».

2 минута чтенияЧитать
Аудио ИИ

Стабильная скрытая диффузия звука

Stable Audio — это система преобразования текста в аудио от Stability AI, которая использует скрытую диффузию для создания музыки и звуковых эффектов с явным контролем длины клипа.

2 минута чтенияЧитать
Аудио ИИ

Набор инструментов для распознавания речи Kaldi

Kaldi — это бесплатный набор инструментов с открытым исходным кодом, который стал доминирующей исследовательской платформой для создания систем распознавания речи.

2 минута чтенияЧитать
Аудио ИИ

Сверточный ASR Wav2Letter

Wav2Letter — это комплексная система распознавания речи от Facebook AI, которая использовала только сверточные нейронные сети, без повторений.

2 минута чтенияЧитать
Аудио ИИ

Джаспер и QuartzNet ASR

Jasper и QuartzNet — это комплексные модели сверточного распознавания речи NVIDIA, причем QuartzNet представляет собой значительно меньшую и эффективную модернизированную версию…

2 минута чтенияЧитать
Аудио ИИ

Модели диффузии для аудио

Модели диффузии генерируют звук, обучаясь шаг за шагом обращать вспять процесс зашумления, превращая случайный шум в связную речь, музыку или звуковые эффекты.

2 минута чтенияЧитать
Аудио ИИ

Обнаружение звуковых событий

Обнаружение звуковых событий (SED) определяет, какие звуки возникают в аудиопотоке и когда именно они начинаются и прекращаются.

2 минута чтенияЧитать

Закончили читать? Докажите это.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Audio AI AI Guides — Page 7 of 10 | AI Understanding