Фонды искусственного интеллекта
Поймите, что такое ИИ, как системы учатся, где они терпят неудачу и как оценивать претензии без шумихи.
Бесплатная библиотека искусственного интеллекта
117 простые руководства на английском языке, структурированные схемы обучения и открытая библиотека, созданная независимой некоммерческой организацией 501(c)(3), чтобы каждый мог понять современный искусственный интеллект.
Начните здесь
Каждый курс включает в себя явные результаты, обозначенные компетенции, практические занятия и прикладной завершающий этап.
Поймите, что такое ИИ, как системы учатся, где они терпят неудачу и как оценивать претензии без шумихи.
Продуктивно используйте ИИ, защищая конфиденциальность, проверяя результаты и сохраняя ответственность человека.
Оценивайте варианты использования на рабочем месте, запускайте безопасные пилотные проекты, измеряйте ценность и ответственно сообщайте об изменениях.
Анализируйте системы ИИ с точки зрения прав, справедливости, управления, безопасности и результатов, отвечающих общественным интересам.
Понимание языковых моделей, поиска, агентов, оценки, стоимости и гарантий развертывания посредством практического проектирования системы.
Тематические треки
Прыгайте в область, которая вас волнует. У каждого трека есть несколько путеводителей на простом английском языке.
Полная библиотека
117 из 1019 показаны направляющие. Фильтруйте по треку или выполните поиск выше.
Технология Beamforming использует несколько микрофонов для прослушивания в выбранном направлении, усиливая звук от цели и подавляя все остальное.
Аудио ИИRiffusion — это хитрый хак, который генерирует музыку, рассматривая звук как изображение: он настраивает модель изображения Stable Diffusion для рисования спектрограмм, а затем…
Аудио ИИУзнайте, как Google MusicLM использует иерархические семантические и акустические токены, SoundStream и MuLan для преобразования текстовых подсказок в связную музыку.
Аудио ИИNoise2Noise — это обучающий прием, который позволяет модели научиться удалять шум, даже не видя чистого эталона, путем обучения на парах с разным уровнем шума…
Аудио ИИConv-TasNet — это нейронная сеть, которая разделяет смешанный звук (например, когда два человека говорят одновременно), работая непосредственно с необработанным звуковым сигналом…
Аудио ИИDual-Path RNN (DPRNN) — это архитектура разделения звука, которая разбивает очень длинную последовательность аудиофункций на короткие перекрывающиеся фрагменты и обрабатывает их…
Аудио ИИOpen-Unmix (UMX) — это система глубокого обучения с открытым исходным кодом, которая разбивает песню на части: вокал, ударные, бас и другие инструменты.
Аудио ИИФункция выравнивания слов шепота привязывает каждое транскрибируемое слово к точному времени начала и окончания аудиозаписи.
Аудио ИИМаркировка музыки использует модели трансформеров для прослушивания песни и прогнозирования описательных меток, таких как жанр, настроение, инструменты и темп.
Аудио ИИОбнаружение начала определяет точные моменты, когда в аудиосигнале начинаются ноты, доли или звуки.
Аудио ИИMelGAN — это полностью сверточный вокодер на основе GAN, который превращает мел-спектрограммы в необработанные аудиосигналы за один проход вперед.
Аудио ИИUnivNet — это вокодер GAN, который оценивает сгенерированный звук с помощью нескольких спектрограмм, рассчитанных с разным разрешением STFT, повышая четкость высокочастотных деталей.
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.