Biblioteca de IA gratuita

IA visual guíasGratis para siempre.

133 Guías en inglés sencillo, rutas de aprendizaje estructuradas y una biblioteca abierta, creada por una organización sin fines de lucro independiente 501(c)(3) para que cualquiera pueda comprender la IA moderna.

133Guías gratuitas
1Pistas temáticas
~2 minPor guía
~4hReading time

Empieza aquí

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Pistas temáticas

Navegar por pista

Salta al área que te interesa. Cada pista tiene varias guías en inglés sencillo.

biblioteca completa

Todas las guías

133 de 1019 guías mostradas. Filtrar por pista o buscar arriba.

IA visual

Comprensión del vídeo

Video understanding analyzes visual and sometimes audio information across time.

2 lectura mínimaleer
IA visual

Búsqueda multimodal

Multimodal search retrieves information across forms such as text, images, audio, and video.

2 lectura mínimaleer
IA visual

Documento AI

Document AI extracts and interprets information from files such as forms, reports, invoices, and scanned pages.

2 lectura mínimaleer
IA visual

Wasserstein GAN

Wasserstein GAN (WGAN) es un rediseño del objetivo de entrenamiento de GAN que utiliza la distancia de Wasserstein en lugar de la pérdida mínima-máxima original.

2 lectura mínimaleer
IA visual

GAN condicionales

Las GAN condicionales (cGAN) amplían las GAN ordinarias al introducir información adicional, como una etiqueta de clase o texto, tanto en el generador como en el discriminador.

2 lectura mínimaleer
IA visual

Traducción de imagen a imagen de Pix2Pix

Pix2Pix es una GAN condicional que aprende a traducir un tipo de imagen en otro, como convertir un boceto en una fotografía o un mapa en una vista de satélite.

2 lectura mínimaleer
IA visual

Colorización de imágenes

La coloración de imágenes utiliza IA para agregar colores plausibles y realistas a fotografías y películas en blanco y negro.

2 lectura mínimaleer
IA visual

Estructura del movimiento

Structure from Motion (SfM) reconstruye la geometría de la escena 3D y las posiciones de la cámara a partir de un conjunto de fotografías 2D superpuestas tomadas desde diferentes puntos de vista.

2 lectura mínimaleer
IA visual

Estéreo multivista

Multi-View Stereo (MVS) toma muchas fotografías calibradas de una escena y produce una reconstrucción 3D densa al estimar la profundidad en casi cada píxel.

2 lectura mínimaleer
IA visual

Muestreadores DDPM y DDIM

DDPM y DDIM son dos formas de ejecutar el proceso inverso de un modelo de difusión, convirtiendo el ruido aleatorio en una imagen paso a paso.

2 lectura mínimaleer
IA visual

Modelos generativos basados ​​en puntuaciones

Los modelos generativos basados ​​en puntuaciones crean datos aprendiendo el gradiente de la distribución de datos, la dirección que hace que cualquier muestra ruidosa parezca más real...

2 lectura mínimaleer
IA visual

Distancia de inicio de Fréchet

La distancia de inicio de Fréchet (FID) es la métrica estándar para juzgar qué tan realista y variado es un conjunto de imágenes generadas.

2 lectura mínimaleer

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.

Visual AI AI Guides — Page 2 of 12 | AI Understanding