Фонды искусственного интеллекта
Поймите, что такое ИИ, как системы учатся, где они терпят неудачу и как оценивать претензии без шумихи.
Бесплатная библиотека искусственного интеллекта
117 простые руководства на английском языке, структурированные схемы обучения и открытая библиотека, созданная независимой некоммерческой организацией 501(c)(3), чтобы каждый мог понять современный искусственный интеллект.
Начните здесь
Каждый курс включает в себя явные результаты, обозначенные компетенции, практические занятия и прикладной завершающий этап.
Поймите, что такое ИИ, как системы учатся, где они терпят неудачу и как оценивать претензии без шумихи.
Продуктивно используйте ИИ, защищая конфиденциальность, проверяя результаты и сохраняя ответственность человека.
Оценивайте варианты использования на рабочем месте, запускайте безопасные пилотные проекты, измеряйте ценность и ответственно сообщайте об изменениях.
Анализируйте системы ИИ с точки зрения прав, справедливости, управления, безопасности и результатов, отвечающих общественным интересам.
Понимание языковых моделей, поиска, агентов, оценки, стоимости и гарантий развертывания посредством практического проектирования системы.
Тематические треки
Прыгайте в область, которая вас волнует. У каждого трека есть несколько путеводителей на простом английском языке.
Полная библиотека
117 из 1019 показаны направляющие. Фильтруйте по треку или выполните поиск выше.
Mimi — это нейронный аудиокодек, который сжимает речь в крошечный поток дискретных токенов в реальном времени, поэтому модели ИИ могут слушать и говорить с очень низкой…
Аудио ИИListen, Attend and Spell (LAS) — это знаковая нейронная сеть 2015 года, которая транскрибирует речь непосредственно в символы, без ручного произношения…
Аудио ИИSpecAugment — это простой, но мощный метод дополнения данных, который маскирует и искажает спектрограмму речи, чтобы сделать модели распознавания более надежными.
Аудио ИИАвтоматическая пометка музыки использует машинное обучение для прослушивания песни и автоматически присваивает описательные метки, такие как жанр, настроение, инструменты и темп.
Аудио ИИПередача тембра меняет «цвет тона» звука, так что один инструмент звучит как другой, превращая напеваемую мелодию в партию скрипки или трубы…
Аудио ИИКлассификация акустических сцен (ASC) обучает машины распознавать среду, в которой была сделана запись: оживленная улица, тихий парк, поезд, кафе…
Аудио ИИNVIDIA Riva — это SDK с графическим ускорением для промышленного речевого искусственного интеллекта (ASR, TTS и перевод), а NeMo — набор инструментов с открытым исходным кодом для обучения и тонкой настройки…
Аудио ИИDeepSpeech — это модель сквозного распознавания речи, представленная Baidu в 2014 году, которая сопоставляет необработанные аудиофункции непосредственно с текстом с помощью рекуррентного нейронного…
Аудио ИИX-векторы — это числовые отпечатки голоса говорящего фиксированной длины, создаваемые нейронной сетью и используемые для определения того, кто говорит, независимо от того, что он говорит.
Аудио ИИGlow-TTS — это модель преобразования текста в речь, которая самостоятельно учится выравнивать текст по речи с помощью умного трюка поиска, устраняя необходимость в отдельном выравнивателе.
Аудио ИИParallel WaveGAN — это быстрый нейронный вокодер, который превращает мел-спектрограмму в необработанный звуковой сигнал с помощью небольшого GAN, генерируя все сэмплы одновременно.
Аудио ИИWaveGlow — это нейронный вокодер на основе потока от NVIDIA, который синтезирует речевые сигналы из мел-спектрограмм за один проход без авторегрессии.
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.