Бесплатная библиотека искусственного интеллекта

Визуальный ИИ гидыБесплатно навсегда.

133 простые руководства на английском языке, структурированные схемы обучения и открытая библиотека, созданная независимой некоммерческой организацией 501(c)(3), чтобы каждый мог понять современный искусственный интеллект.

133Бесплатные гиды
1Тематические треки
~2 minЗа руководство
~4hВремя чтения

Начните здесь

Пять курсы, ориентированные на результат

Каждый курс включает в себя явные результаты, обозначенные компетенции, практические занятия и прикладной завершающий этап.

01

Фонды искусственного интеллекта

Поймите, что такое ИИ, как системы учатся, где они терпят неудачу и как оценивать претензии без шумихи.

  1. 1Что такое ИИ?
  2. 2Как учится ИИ
  3. 3Объяснение моделей искусственного интеллекта
  4. 4Тесты искусственного интеллекта
~4ч, чтобы завершитьПосмотреть курс
03

ИИ в работе

Оценивайте варианты использования на рабочем месте, запускайте безопасные пилотные проекты, измеряйте ценность и ответственно сообщайте об изменениях.

  1. 1Автоматизация рабочих процессов с использованием искусственного интеллекта
  2. 2Тесты искусственного интеллекта
  3. 3ИИ и рабочие места
  4. 4Управление ИИ
~6ч, чтобы завершитьПосмотреть курс
04

Политика и общество в области искусственного интеллекта

Анализируйте системы ИИ с точки зрения прав, справедливости, управления, безопасности и результатов, отвечающих общественным интересам.

  1. 1Этика ИИ
  2. 2ИИ и конфиденциальность
  3. 3Регулирование ИИ
  4. 4Мифы об искусственном интеллекте
~6ч, чтобы завершитьПосмотреть курс
05

Строительство с использованием систем искусственного интеллекта

Понимание языковых моделей, поиска, агентов, оценки, стоимости и гарантий развертывания посредством практического проектирования системы.

  1. 1ChatGPT и LLM
  2. 2Качество поиска
  3. 3ИИ-агенты
  4. 4Тесты искусственного интеллекта
~8ч, чтобы завершитьПосмотреть курс

Тематические треки

Просмотр по треку

Прыгайте в область, которая вас волнует. У каждого трека есть несколько путеводителей на простом английском языке.

Полная библиотека

Все руководства

133 из 1019 показаны направляющие. Фильтруйте по треку или выполните поиск выше.

Визуальный ИИ

Гармонизация изображений и композитинг

Гармонизация изображения автоматически настраивает вставленный объект переднего плана так, чтобы его цвет, освещение и тон соответствовали новому фону, благодаря чему композиции выглядят реалистично.

2 минута чтенияЧитать
Визуальный ИИ

SDXL и каскадная диффузия

SDXL — это модель Stability AI для преобразования текста в изображение высокого разрешения, которая сочетает в себе мощный базовый генератор и очиститель, а каскадная диффузия объединяет несколько…

2 минута чтенияЧитать
Визуальный ИИ

ГЛИГЕН Заземленное поколение

GLIGEN (Grounded-Language-to-Image Generation) позволяет вам точно контролировать, где объекты появляются в сгенерированном изображении, задавая ограничивающие рамки модели…

2 минута чтенияЧитать
Визуальный ИИ

T2I-адаптер для многоусловного контроля диффузии

Изучите T2I-адаптер для управления многоусловной диффузией: как он управляет стабильной диффузией с помощью краев, глубины, позы и других условий с помощью легкого…

2 минута чтенияЧитать
Визуальный ИИ

Инверсия нулевого текста

Инверсия нулевого текста — это метод, который позволяет редактировать реальную фотографию с помощью модели диффузии, управляемой текстом, такой как Stable Diffusion, сохраняя при этом все, что вы…

2 минута чтенияЧитать
Визуальный ИИ

Пользовательский мультиконцептуальный тюнинг Diffusion

Custom Diffusion — это легкий метод тонкой настройки, который обучает модель преобразования текста в изображение новым личным понятиям, таким как ваша собака или конкретный стул, всего лишь…

2 минута чтенияЧитать
Визуальный ИИ

Скрытое смешивание и интерполяция изображений

Скрытое смешивание смешивает изображения путем объединения их сжатых представлений внутри скрытого пространства модели, а не усреднения необработанных пикселей.

2 минута чтенияЧитать
Визуальный ИИ

Модели «видение-язык-действие» для робототехники

Модели Vision-Language-Action (VLA) представляют собой большие нейронные сети, которые принимают изображения с камеры плюс письменные инструкции и напрямую выдают команды двигателя робота.

2 минута чтенияЧитать
Визуальный ИИ

Политика распространения управления роботами

Политика диффузии применяет ту же идею шумоподавления, что и генераторы изображений, такие как Stable Diffusion, для управления роботами: вместо прогнозирования одного следующего действия…

2 минута чтенияЧитать
Визуальный ИИ

Преобразование текста в видео

Make-A-Video — это система Meta 2022 года, которая превращает текстовую подсказку в короткий видеоклип без необходимости обучения помеченным парам текст-видео.

2 минута чтенияЧитать
Визуальный ИИ

Изображение Видео Каскады

Imagen Video — это система преобразования текста в видео Google 2022 года, которая создает клип с помощью каскада из семи моделей диффузии, каждая из которых добавляет больше кадров или большее разрешение.

2 минута чтенияЧитать
Визуальный ИИ

CogVideo и CogVideoX

CogVideo (2022 г.) была первой крупномасштабной моделью преобразования текста в видео с открытым исходным кодом, а CogVideoX (2024 г.) — ее гораздо более функциональным преемником с открытым исходным кодом от Tsinghua/Zhipu AI.

2 минута чтенияЧитать

Закончили читать? Докажите это.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.