Biblioteca de IA gratuita

IA visual guíasGratis para siempre.

133 Guías en inglés sencillo, rutas de aprendizaje estructuradas y una biblioteca abierta, creada por una organización sin fines de lucro independiente 501(c)(3) para que cualquiera pueda comprender la IA moderna.

133Guías gratuitas
1Pistas temáticas
~2 minPor guía
~4hReading time

Empieza aquí

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Pistas temáticas

Navegar por pista

Salta al área que te interesa. Cada pista tiene varias guías en inglés sencillo.

biblioteca completa

Todas las guías

133 de 1019 guías mostradas. Filtrar por pista o buscar arriba.

IA visual

Campos de radiación neuronal

Los campos de radiación neuronal (NeRF) reconstruyen una escena 3D completa a partir de un puñado de fotografías normales, lo que le permite volar la cámara hacia puntos de vista completamente nuevos.

2 lectura mínimaleer
IA visual

Salpicadura gaussiana

Gaussian Splatting representa una escena 3D con millones de pequeñas manchas de colores semitransparentes que se pueden renderizar en tiempo real.

2 lectura mínimaleer
IA visual

Codificadores automáticos enmascarados

Los codificadores automáticos enmascarados (MAE) son un método autosupervisado que enseña a un modelo de visión a reconstruir imágenes después de que la mayor parte de la imagen se ha ocultado.

2 lectura mínimaleer
IA visual

Subtítulos de imágenes

Los subtítulos de imágenes son la tarea de generar automáticamente una oración en lenguaje natural que describa lo que hay en una imagen.

2 lectura mínimaleer
IA visual

Respuesta visual a preguntas

La respuesta visual a preguntas (VQA) permite que un sistema responda preguntas en lenguaje natural y de forma libre sobre una imagen, como "¿Cuántas personas llevan sombreros?"

2 lectura mínimaleer
IA visual

Detección en tiempo real de YOLO

YOLO (Solo miras una vez) es una familia de modelos de detección de objetos que encuentran y etiquetan cada objeto en una imagen con un solo paso de red neuronal, lo suficientemente rápido...

2 lectura mínimaleer
IA visual

Segmentación panóptica

La segmentación panóptica le da a cada píxel de una imagen una etiqueta, unificando "qué es esta región" con "qué objeto específico es este".

2 lectura mínimaleer
IA visual

Estimación de la postura humana

La estimación de la postura humana detecta las posiciones de las articulaciones del cuerpo, como codos, rodillas y hombros, para construir un esqueleto digital de una persona a partir de imágenes...

2 lectura mínimaleer
IA visual

Modelos de imagen FLUX

FLUX es una familia de modelos abiertos de conversión de texto a imagen de Black Forest Labs conocidos por sus detalles nítidos, su fuerte seguimiento de indicaciones y su texto renderizado sorprendentemente preciso.

2 lectura mínimaleer
IA visual

Redes Residuales

Las redes residuales (ResNets) son redes neuronales profundas que agregan "conexiones de salto" permitiendo que las capas aprendan pequeños ajustes en lugar de transformaciones completas.

2 lectura mínimaleer
IA visual

CNN basadas en regiones

Las CNN basadas en regiones (R-CNN) son una familia de detectores de objetos que primero proponen regiones candidatas en una imagen, luego usan una CNN para clasificar y encuadrar con precisión...

2 lectura mínimaleer
IA visual

Transformador giratorio

Swin Transformer es un transformador de visión que procesa imágenes en ventanas jerárquicas desplazadas, haciendo que la atención sea lo suficientemente eficiente como para escalar...

2 lectura mínimaleer

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.