Безкоштовна бібліотека ШІ

Візуальний ШІ напрямніВільний назавжди.

133 посібники простою англійською мовою, структуровані навчальні маршрути та відкрита бібліотека — створена незалежною некомерційною організацією 501(c)(3), щоб кожен міг зрозуміти сучасний ШІ.

133Безкоштовні путівники
1Тематичні треки
~2 minЗа посібником
~4hЧас читання

Почніть тут

П'ять курси, орієнтовані на результат

Кожен курс включає чіткі результати, компетенції, практичні дії та прикладний завершальний камінь.

02

Відповідальний користувач ШІ

Використовуйте штучний інтелект продуктивно, захищаючи конфіденційність, перевіряючи результати та зберігаючи підзвітність людини.

  1. 1Prompt Engineering
  2. 2ШІ Галюцинації
  3. 3ШІ та конфіденційність
  4. 4ШІ в повсякденному житті
~5h для завершенняПереглянути курс

Тематичні треки

Перегляд за треком

Перейдіть у сферу, яка вам цікава. Кожен трек має декілька гідів простою англійською мовою.

Повна бібліотека

Всі путівники

133 з 1019 показано напрямні. Фільтруйте за треком або шукайте вище.

Візуальний ШІ

Оптичне розпізнавання символів

Оптичне розпізнавання символів (OCR) перетворює текстові зображення — відскановані документи, фотографії вивісок, PDF-файли — у машиночитаний і редагований текст.

2 хв. читанняПрочитайте
Візуальний ШІ

Оптичний потік

Оптичний потік оцінює, як кожен піксель переміщується між послідовними відеокадрами, створюючи щільну карту векторів руху.

2 хв. читанняПрочитайте
Візуальний ШІ

Монокулярна оцінка глибини

Монокулярна оцінка глибини передбачає відстань кожного пікселя від окремої звичайної фотографії — стереокамера, лідар або датчик глибини не потрібні.

2 хв. читанняПрочитайте
Візуальний ШІ

Моделі латентної дифузії

Моделі латентної дифузії генерують зображення, запускаючи процес дифузії в стиснутому латентному просторі замість необроблених пікселів, що скорочує витрати на обчислення.

2 хв. читанняПрочитайте
Візуальний ШІ

ControlNet

ControlNet — це доповнення, яке надає моделям генерації зображень точний структурний контроль, дозволяючи вам керувати результатом за допомогою країв, поз, карт глибини або каракулів.

2 хв. читанняПрочитайте
Візуальний ШІ

Керівництво без класифікатора

Вказівки без класифікаторів — це техніка, яка змушує дифузійні моделі фактично слідувати вашим підказкам, обмінюючи деяку різноманітність на набагато більшу прихильність.

2 хв. читанняПрочитайте
Візуальний ШІ

Візуальний SLAM

Visual SLAM дозволяє рухомій камері побудувати карту невідомого простору, одночасно відстежуючи власне положення на цій карті.

2 хв. читанняПрочитайте
Візуальний ШІ

Sora та Text-to-Video

Sora — це модель перетворення тексту у відео OpenAI, яка перетворює письмову підказку на короткий відеокліп із високою роздільною здатністю.

2 хв. читанняПрочитайте
Візуальний ШІ

Моделі розповсюдження відео

Моделі дифузії відео генерують рухомі зображення шляхом поступового перетворення випадкового шуму на когерентні кадри, поширюючи ідею дифузії від зображень до часу.

2 хв. читанняПрочитайте
Візуальний ШІ

Генерація тексту в 3D

Генерація тексту в 3D перетворює письмову підказку, як-от «вінтажне шкіряне крісло», на повну 3D-модель, яку можна обертати, освітлювати та опускати в гру чи сцену.

2 хв. читанняПрочитайте
Візуальний ШІ

Диференційована візуалізація

Диференційована візуалізація робить процес перетворення 3D-сцени на 2D-зображення повністю диференційованим, тож ви можете обчислювати градієнти з відрендерених пікселів…

2 хв. читанняПрочитайте
Візуальний ШІ

Архітектура U-Net

U-Net — це згорточна нейронна мережа у формі літери «U», яка чудово справляється з отриманням піксельно-точних результатів, спочатку для сегментації біомедичних зображень.

2 хв. читанняПрочитайте

Закінчив читати? Доведіть це.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Visual AI AI Guides — Page 10 of 12 | AI Understanding