Biblioteca de IA gratuita

IA visual guíasGratis para siempre.

133 Guías en inglés sencillo, rutas de aprendizaje estructuradas y una biblioteca abierta, creada por una organización sin fines de lucro independiente 501(c)(3) para que cualquiera pueda comprender la IA moderna.

133Guías gratuitas
1Pistas temáticas
~2 minPor guía
~4hReading time

Empieza aquí

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Pistas temáticas

Navegar por pista

Salta al área que te interesa. Cada pista tiene varias guías en inglés sencillo.

biblioteca completa

Todas las guías

133 de 1019 guías mostradas. Filtrar por pista o buscar arriba.

IA visual

Controles deslizantes LoRA para edición de imágenes

Los controles deslizantes LoRA son pequeños módulos complementarios que le brindan un dial continuo para empujar un único atributo de una imagen hacia arriba o hacia abajo, como la edad, la sonrisa o el óxido, sin...

2 lectura mínimaleer
IA visual

Edición de instrucciones de InstructPix2Pix

InstructPix2Pix te permite editar una foto escribiendo un comando simple como "hacer que sea invierno" o "convertir al gato en perro", sin necesidad de máscaras ni herramientas de selección.

2 lectura mínimaleer
IA visual

Edición de atención cruzada de mensaje a mensaje

Prompt-to-Prompt edita una imagen generada modificando su mensaje de texto mientras reutiliza los mapas de atención internos del modelo, por lo que al cambiar una palabra se intercambia...

2 lectura mínimaleer
IA visual

Súper resolución ESRGAN y GAN

ESRGAN utiliza un concurso de generador versus discriminador para inventar detalles realistas al ampliar imágenes, yendo más allá de la interpolación borrosa.

2 lectura mínimaleer
IA visual

Restauración práctica Real-ESRGAN

Real-ESRGAN amplía ESRGAN para manejar las degradaciones desordenadas y desconocidas de las fotografías del mundo real en lugar del desenfoque sintético limpio.

2 lectura mínimaleer
IA visual

Restauración del transformador SwinIR

SwinIR aplica la atención de ventana desplazada del Swin Transformer a tareas de restauración de imágenes como superresolución, eliminación de ruido y eliminación de artefactos JPEG.

2 lectura mínimaleer
IA visual

Modelos de consistencia latente

Los modelos de consistencia latente (LCM) son una técnica que permite a los generadores de imágenes de difusión producir imágenes de alta calidad en solo uno a cuatro pasos...

2 lectura mínimaleer
IA visual

Transformadores de visión

Vision Transformers (ViT) aplica la arquitectura de transformador que alimenta ChatGPT a las imágenes, tratando una imagen como una secuencia de parches en lugar de una cuadrícula...

2 lectura mínimaleer
IA visual

Stable Diffusion

Stable Diffusion es un modelo de texto a imagen de código abierto, lanzado por Stability AI en 2022, que genera imágenes eliminando gradualmente el ruido de un modo aleatorio...

2 lectura mínimaleer
IA visual

Midjourney

Midjourney es un popular servicio comercial de conversión de texto a imagen conocido por sus resultados sorprendentes y altamente estéticos y sus orígenes como un bot de Discord.

2 lectura mínimaleer
IA visual

DALL-E

DALL-E es la familia de modelos de texto a imagen de OpenAI que convierte una descripción escrita en una imagen original.

2 lectura mínimaleer
IA visual

CLIP y modelos visión-lenguaje

CLIP es un modelo de OpenAI que aprende a conectar imágenes y texto colocándolos en el mismo espacio matemático.

2 lectura mínimaleer

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.

Visual AI AI Guides — Page 8 of 12 | AI Understanding