Biblioteca de IA gratuita

IA visual guíasGratis para siempre.

133 Guías en inglés sencillo, rutas de aprendizaje estructuradas y una biblioteca abierta, creada por una organización sin fines de lucro independiente 501(c)(3) para que cualquiera pueda comprender la IA moderna.

133Guías gratuitas
1Pistas temáticas
~2 minPor guía
~4hReading time

Empieza aquí

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Pistas temáticas

Navegar por pista

Salta al área que te interesa. Cada pista tiene varias guías en inglés sencillo.

biblioteca completa

Todas las guías

133 de 1019 guías mostradas. Filtrar por pista o buscar arriba.

IA visual

Síntesis de vista novedosa

La síntesis de vistas novedosas genera imágenes fotorrealistas de una escena desde puntos de vista que nunca fueron fotografiados.

2 lectura mínimaleer
IA visual

Imágenes generativas enmascaradas de Muse

Muse es un modelo de conversión de texto a imagen de Google que genera imágenes completando tokens de imágenes enmascaradas de una sola vez, lo que lo hace mucho más rápido que paso a paso...

2 lectura mínimaleer
IA visual

Imágenes autorregresivas de vías parciales

Parti (Pathways Autoregressive Text-to-Image) genera imágenes de la misma manera que los modelos de lenguaje escriben oraciones: un token de imagen a la vez, prediciendo la siguiente...

2 lectura mínimaleer
IA visual

Imagen 2 y difusión optimizada para recompensas

Imagen 2 es el modelo fotorrealista de texto a imagen basado en difusión de Google, refinado con ajuste de recompensa para que sus resultados coincidan mejor con lo que la gente realmente quiere.

2 lectura mínimaleer
IA visual

Resolución LaMa: pintura interna robusta

LaMa (Large Mask inpainting) es una red neuronal rápida y liviana que llena limpiamente regiones faltantes o eliminadas de una imagen, incluso cuando el agujero es enorme.

2 lectura mínimaleer
IA visual

Difusión de vídeo estable

Stable Video Diffusion (SVD) es el modelo básico abierto de Stability AI que convierte una única imagen fija en un videoclip corto que se mueve suavemente.

2 lectura mínimaleer
IA visual

Generación de vídeo espacio-tiempo Lumiere

Lumiere es un modelo de difusión de texto a video de Google Research que genera un videoclip completo a la vez utilizando una U-Net espacio-temporal.

2 lectura mínimaleer
IA visual

Mip-NeRF y campos de radiación antialias

Mip-NeRF corrige los artefactos borrosos y irregulares que afectan al NeRF original cuando renderiza escenas a diferentes distancias o resoluciones.

2 lectura mínimaleer
IA visual

Plenoxels y campos de radiación voxel

Plenoxels demostró que se puede reconstruir una escena 3D con resultados de calidad NeRF sin ninguna red neuronal, solo una cuadrícula de vóxeles que almacenan color...

2 lectura mínimaleer
IA visual

DUSt3R Reconstrucción 3D Densa

DUSt3R reconstruye geometría 3D densa a partir de un puñado de fotografías ordinarias sin necesidad de calibrar ni posiciones conocidas de la cámara.

2 lectura mínimaleer
IA visual

Edición One-Shot de Tune-A-Video

Tune-A-Video ajusta un modelo de difusión de texto a imagen previamente entrenado en un solo vídeo para que pueda volver a editar ese clip a partir de nuevas indicaciones de texto.

2 lectura mínimaleer
IA visual

DreamFusion y muestreo de destilación de partituras

DreamFusion genera objetos 3D a partir de texto utilizando un modelo de difusión de imágenes 2D como crítico, sin entrenar nunca con datos 3D.

2 lectura mínimaleer

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.

Visual AI AI Guides — Page 5 of 12 | AI Understanding