Фонды искусственного интеллекта
Поймите, что такое ИИ, как системы учатся, где они терпят неудачу и как оценивать претензии без шумихи.
Бесплатная библиотека искусственного интеллекта
117 простые руководства на английском языке, структурированные схемы обучения и открытая библиотека, созданная независимой некоммерческой организацией 501(c)(3), чтобы каждый мог понять современный искусственный интеллект.
Начните здесь
Каждый курс включает в себя явные результаты, обозначенные компетенции, практические занятия и прикладной завершающий этап.
Поймите, что такое ИИ, как системы учатся, где они терпят неудачу и как оценивать претензии без шумихи.
Продуктивно используйте ИИ, защищая конфиденциальность, проверяя результаты и сохраняя ответственность человека.
Оценивайте варианты использования на рабочем месте, запускайте безопасные пилотные проекты, измеряйте ценность и ответственно сообщайте об изменениях.
Анализируйте системы ИИ с точки зрения прав, справедливости, управления, безопасности и результатов, отвечающих общественным интересам.
Понимание языковых моделей, поиска, агентов, оценки, стоимости и гарантий развертывания посредством практического проектирования системы.
Тематические треки
Прыгайте в область, которая вас волнует. У каждого трека есть несколько путеводителей на простом английском языке.
Полная библиотека
117 из 1019 показаны направляющие. Фильтруйте по треку или выполните поиск выше.
DiffWave — это вокодер на основе диффузии, который синтезирует звук путем итеративного шумоподавления случайного шума в форму волны, обусловленную мел-спектрограммой.
Аудио ИИBark — это модель преобразования текста в аудио с открытым исходным кодом от Suno, которая генерирует не только речь, но и смех, вздохи, музыку и звуковые эффекты непосредственно из текстовых подсказок.
Аудио ИИTortoise TTS — это система преобразования текста в речь с открытым исходным кодом, которая ценится за необычайно естественные, эмоционально насыщенные голоса и сильное клонирование голоса всего из нескольких коротких…
Аудио ИИXTTS — это многоязычная модель преобразования текста в речь Coqui, которая может клонировать голос из короткого клипа, а затем говорить на многих разных языках, сохраняя при этом…
Аудио ИИSoundStorm — это модель генерации звука Google, которая воспроизводит речь и звук параллельно, а не по одному токену за раз, обеспечивая высококачественный синтез звука…
Аудио ИИAudioGen — это модель Meta, которая превращает текстовые описания в реалистичные звуки окружающей среды и звуковые эффекты, например «лай собаки под щебетание птиц».
Аудио ИИStable Audio — это система преобразования текста в аудио от Stability AI, которая использует скрытую диффузию для создания музыки и звуковых эффектов с явным контролем длины клипа.
Аудио ИИKaldi — это бесплатный набор инструментов с открытым исходным кодом, который стал доминирующей исследовательской платформой для создания систем распознавания речи.
Аудио ИИWav2Letter — это комплексная система распознавания речи от Facebook AI, которая использовала только сверточные нейронные сети, без повторений.
Аудио ИИJasper и QuartzNet — это комплексные модели сверточного распознавания речи NVIDIA, причем QuartzNet представляет собой значительно меньшую и эффективную модернизированную версию…
Аудио ИИМодели диффузии генерируют звук, обучаясь шаг за шагом обращать вспять процесс зашумления, превращая случайный шум в связную речь, музыку или звуковые эффекты.
Аудио ИИОбнаружение звуковых событий (SED) определяет, какие звуки возникают в аудиопотоке и когда именно они начинаются и прекращаются.
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.