Фонды искусственного интеллекта
Поймите, что такое ИИ, как системы учатся, где они терпят неудачу и как оценивать претензии без шумихи.
Бесплатная библиотека искусственного интеллекта
117 простые руководства на английском языке, структурированные схемы обучения и открытая библиотека, созданная независимой некоммерческой организацией 501(c)(3), чтобы каждый мог понять современный искусственный интеллект.
Начните здесь
Каждый курс включает в себя явные результаты, обозначенные компетенции, практические занятия и прикладной завершающий этап.
Поймите, что такое ИИ, как системы учатся, где они терпят неудачу и как оценивать претензии без шумихи.
Продуктивно используйте ИИ, защищая конфиденциальность, проверяя результаты и сохраняя ответственность человека.
Оценивайте варианты использования на рабочем месте, запускайте безопасные пилотные проекты, измеряйте ценность и ответственно сообщайте об изменениях.
Анализируйте системы ИИ с точки зрения прав, справедливости, управления, безопасности и результатов, отвечающих общественным интересам.
Понимание языковых моделей, поиска, агентов, оценки, стоимости и гарантий развертывания посредством практического проектирования системы.
Тематические треки
Прыгайте в область, которая вас волнует. У каждого трека есть несколько путеводителей на простом английском языке.
Полная библиотека
117 из 1019 показаны направляющие. Фильтруйте по треку или выполните поиск выше.
Suno и Udio — два ведущих потребительских музыкальных генератора с искусственным интеллектом, которые превращают короткую текстовую подсказку в полноценную песню почти студийного качества — с вокалом…
Аудио ИИГенерация символической музыки создает музыку в виде структурированной нотации — нот, высоты тона, длительности и тайминга (часто в формате MIDI), а не в виде необработанного звука.
Аудио ИИМел-частотные кепстральные коэффициенты (MFCC) представляют собой компактный набор чисел, которые суммируют форму частотного спектра звука так, как воспринимает человеческое ухо…
Аудио ИИWaveNet, представленная DeepMind в 2016 году, представляла собой революционную нейронную сеть, которая генерирует необработанный звук по одному сэмплу за раз, создавая поразительно естественную речь…
Аудио ИИTacotron 2 — это комплексная система преобразования текста в речь от Google (2017), которая превращает письменный текст непосредственно в мел-спектрограмму, которую преобразует нейронный вокодер…
Аудио ИИОбнаружение дипфейков звука — это набор методов, используемых для определения того, была ли голосовая запись произнесена реальным человеком или синтезирована/клонирована искусственным интеллектом.
Аудио ИИМоделирование просодии обучает машины мелодии речи, ритму, высоте звука, ударению и темпу, которые накладываются на слова.
Аудио ИИЭмоциональный синтез речи генерирует голоса, которые звучат счастливо, грустно, сердито или спокойно, не просто разборчиво, но и правдоподобно ощущаются.
Аудио ИИПреобразование голоса преобразует записанную речь одного человека так, как будто ее произнес кто-то другой, сохраняя при этом исходные слова и время.
Аудио ИИДиаризация спикера отвечает на вопрос «кто и когда говорил?» путем разделения аудиозаписи на сегменты, помеченные личностью говорящего.
Аудио ИИПроверка говорящего подтверждает, соответствует ли голос конкретной заявленной личности, действуя как голосовой пароль.
Аудио ИИОбнаружение голосовой активности (VAD) момент за моментом решает, содержит ли аудиосигнал человеческую речь или просто тишину и шум.
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.