Фонды искусственного интеллекта
Поймите, что такое ИИ, как системы учатся, где они терпят неудачу и как оценивать претензии без шумихи.
Бесплатная библиотека искусственного интеллекта
117 простые руководства на английском языке, структурированные схемы обучения и открытая библиотека, созданная независимой некоммерческой организацией 501(c)(3), чтобы каждый мог понять современный искусственный интеллект.
Начните здесь
Каждый курс включает в себя явные результаты, обозначенные компетенции, практические занятия и прикладной завершающий этап.
Поймите, что такое ИИ, как системы учатся, где они терпят неудачу и как оценивать претензии без шумихи.
Продуктивно используйте ИИ, защищая конфиденциальность, проверяя результаты и сохраняя ответственность человека.
Оценивайте варианты использования на рабочем месте, запускайте безопасные пилотные проекты, измеряйте ценность и ответственно сообщайте об изменениях.
Анализируйте системы ИИ с точки зрения прав, справедливости, управления, безопасности и результатов, отвечающих общественным интересам.
Понимание языковых моделей, поиска, агентов, оценки, стоимости и гарантий развертывания посредством практического проектирования системы.
Тематические треки
Прыгайте в область, которая вас волнует. У каждого трека есть несколько путеводителей на простом английском языке.
Полная библиотека
117 из 1019 показаны направляющие. Фильтруйте по треку или выполните поиск выше.
Идентификация кавер-версии позволяет обнаружить, что две совершенно разные по звучанию записи на самом деле представляют собой одну и ту же песню — концертную акустическую версию, ремикс…
Аудио ИИDDSP (дифференцируемая цифровая обработка сигналов) объединяет классические строительные блоки синтезаторов с нейронными сетями, поэтому глубокое обучение может управлять генераторами…
Аудио ИИVITS — это модель преобразования текста в речь, которая преобразует текст непосредственно в необработанные аудиосигналы в единой обученной системе, минуя обычный двухэтапный конвейер.
Аудио ИИFastSpeech генерирует всю речевую спектрограмму параллельно, а не по одному кадру за раз, что делает синтез значительно быстрее и стабильнее.
Аудио ИИNaturalSpeech — это направление исследований Microsoft TTS, направленное на качество речи человеческого уровня, а в более поздних версиях используется скрытая диффузия для создания богатых, естественных…
Аудио ИИРаспознавание эмоций речи (SER) — это искусственный интеллект, который определяет эмоциональное состояние говорящего — гнев, радость, печаль, разочарование — по звуку его голоса, а не только…
Аудио ИИMoshi — это голосовой искусственный интеллект с открытым исходным кодом, работающий в реальном времени от компании Kyutai, который говорит и слушает одновременно — в полнодуплексном режиме — вместо того, чтобы делать резкие повороты.
Аудио ИИПеревод речи в речь (S2ST) берет произнесенные слова на одном языке и воспроизводит произнесенные слова на другом — в идеале сохраняя голос говорящего, тон…
Аудио ИИHiFi-GAN — это генеративно-состязательный вокодер, который почти мгновенно превращает мел-спектрограмму в необработанный звуковой сигнал, воспроизводя речь студийного качества далеко…
Аудио ИИПреобразование графемы в фонему (G2P) переводит письменные буквы в звуки, которые речевая система должна произносить.
Аудио ИИНормализация текста — это предварительный этап, который переписывает необработанный письменный текст в полностью произнесенные слова до того, как его произнесет речевая система.
Аудио ИИSoundStream — это сквозной нейронный аудиокодек Google, который сжимает речь и музыку до чрезвычайно низкого битрейта, сохраняя при этом качество.
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.