Biblioteca de IA gratuita

IA visual guíasGratis para siempre.

133 Guías en inglés sencillo, rutas de aprendizaje estructuradas y una biblioteca abierta, creada por una organización sin fines de lucro independiente 501(c)(3) para que cualquiera pueda comprender la IA moderna.

133Guías gratuitas
1Pistas temáticas
~2 minPor guía
~4hReading time

Empieza aquí

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Pistas temáticas

Navegar por pista

Salta al área que te interesa. Cada pista tiene varias guías en inglés sencillo.

biblioteca completa

Todas las guías

133 de 1019 guías mostradas. Filtrar por pista o buscar arriba.

IA visual

Tubería de texto a 3D Magic3D

Magic3D es la respuesta de dos etapas de NVIDIA a DreamFusion, que produce contenido 3D más detallado y de mayor resolución con mayor rapidez.

2 lectura mínimaleer
IA visual

Eliminación de ruido y desenfoque de redes

Las redes de eliminación de ruido y desenfoque son modelos neuronales que limpian imágenes ruidosas o borrosas, recuperando detalles nítidos de entradas desordenadas.

2 lectura mínimaleer
IA visual

Restauración facial GFPGAN

GFPGAN es un modelo especializado que restaura fotografías de rostros antiguas, borrosas o de baja calidad en retratos nítidos y realistas.

2 lectura mínimaleer
IA visual

Recuperación facial robusta de CodeFormer

CodeFormer es un modelo de restauración de rostros creado para manejar la degradación extrema, recuperando rostros reconocibles a partir de entradas muy dañadas, pequeñas o borrosas.

2 lectura mínimaleer
IA visual

Generadores escalados GigaGAN

GigaGAN es una GAN de mil millones de parámetros que demuestra que las redes generativas adversarias pueden escalar a la generación de texto a imagen, rivalizando con los modelos de difusión...

2 lectura mínimaleer
IA visual

VQGAN y síntesis de imágenes de libro de códigos

VQGAN comprime imágenes en una cuadrícula de tokens discretos extraídos de un libro de códigos aprendido, permitiendo que un transformador genere imágenes de la misma manera que los modelos de lenguaje...

2 lectura mínimaleer
IA visual

Decodificación de tokens paralelos MaskGIT

MaskGIT genera imágenes prediciendo muchos tokens a la vez y completando primero los más seguros, reemplazando la generación lenta de izquierda a derecha...

2 lectura mínimaleer
IA visual

Difusión de vistas novedosas de cero 1 a 3

Zero-1-to-3 convierte una única foto de un objeto en imágenes de ese mismo objeto visto desde cualquier ángulo nuevo, utilizando un modelo de difusión condicionado a la cámara...

2 lectura mínimaleer
IA visual

Representación 3D híbrida DMTet

DMTet (Deep Marching Tetrahedra) es una representación de forma híbrida en 3D que combina una cuadrícula tetraédrica deformable con un campo de distancia con signo tan neuronal...

2 lectura mínimaleer
IA visual

Codificación hash NGP instantánea

Instant-NGP es la técnica de NVIDIA que entrena Neural Radiance Fields y otras primitivas de gráficos neuronales en segundos en lugar de horas almacenando datos aprendibles...

2 lectura mínimaleer
IA visual

ProfundidadCualquier cosa Profundidad monocular

DepthAnything es un modelo básico que estima qué tan lejos está cada píxel de una sola foto normal, sin hardware especial.

2 lectura mínimaleer
IA visual

Estimación de la profundidad de difusión de la caléndula

Marigold reutiliza un modelo de difusión de generación de imágenes previamente entrenado (difusión estable) para predecir mapas de profundidad muy detallados.

2 lectura mínimaleer

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.