Biblioteca de IA gratuita

IA visual guíasGratis para siempre.

133 Guías en inglés sencillo, rutas de aprendizaje estructuradas y una biblioteca abierta, creada por una organización sin fines de lucro independiente 501(c)(3) para que cualquiera pueda comprender la IA moderna.

133Guías gratuitas
1Pistas temáticas
~2 minPor guía
~4hReading time

Empieza aquí

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Pistas temáticas

Navegar por pista

Salta al área que te interesa. Cada pista tiene varias guías en inglés sencillo.

biblioteca completa

Todas las guías

133 de 1019 guías mostradas. Filtrar por pista o buscar arriba.

IA visual

Armonización y composición de imágenes

La armonización de imágenes ajusta automáticamente un objeto de primer plano pegado para que su color, iluminación y tono coincidan con el nuevo fondo, haciendo que las composiciones parezcan reales.

2 lectura mínimaleer
IA visual

SDXL y difusión en cascada

SDXL es el modelo de texto a imagen de alta resolución de Stability AI que combina un potente generador de base con un refinador, mientras que cadenas de difusión en cascada múltiples...

2 lectura mínimaleer
IA visual

Generación conectada a tierra GLIGEN

GLIGEN (Grounded-Language-to-Image Generation) le permite controlar exactamente dónde aparecen los objetos en una imagen generada alimentando los cuadros delimitadores del modelo...

2 lectura mínimaleer
IA visual

Adaptador T2I para control de difusión multicondicional

Aprenda el adaptador T2I para el control de difusión multicondicional: cómo dirige la difusión estable con bordes, profundidad, postura y otras condiciones utilizando un peso ligero...

2 lectura mínimaleer
IA visual

Inversión de texto nulo

La inversión de texto nulo es una técnica que te permite editar una foto real con un modelo de difusión basado en texto como Difusión estable mientras mantienes todo lo que...

2 lectura mínimaleer
IA visual

Ajuste personalizado de múltiples conceptos de difusión

Custom Diffusion es un método de ajuste ligero que enseña a un modelo de texto a imagen nuevos conceptos personales, como su perro o una silla específica, desde simplemente...

2 lectura mínimaleer
IA visual

Mezcla latente e interpolación de imágenes

La combinación latente mezcla imágenes combinando sus representaciones comprimidas dentro del espacio latente de un modelo en lugar de promediar píxeles sin procesar.

2 lectura mínimaleer
IA visual

Modelos de visión-lenguaje-acción para robótica

Los modelos Visión-Lenguaje-Acción (VLA) son grandes redes neuronales que toman imágenes de la cámara además de una instrucción escrita y emiten directamente comandos del motor del robot.

2 lectura mínimaleer
IA visual

Política de Difusión para el Control de Robots

La política de difusión aplica la misma idea de eliminación de ruido detrás de los generadores de imágenes como Stable Diffusion al control del robot: en lugar de predecir una única acción siguiente...

2 lectura mínimaleer
IA visual

Hacer un video Texto a video

Make-A-Video es el sistema 2022 de Meta que convierte un mensaje de texto en un videoclip corto sin siquiera entrenar en pares de texto y video etiquetados.

2 lectura mínimaleer
IA visual

Imagen Vídeo Cascadas

Imagen Video es el sistema de conversión de texto a video de Google de 2022 que crea un clip a través de una cascada de siete modelos de difusión, cada uno de los cuales agrega más fotogramas o más resolución.

2 lectura mínimaleer
IA visual

CogVideo y CogVideoX

CogVideo (2022) fue el primer modelo abierto de conversión de texto a vídeo a gran escala, y CogVideoX (2024) es su sucesor de código abierto mucho más capaz de Tsinghua/Zhipu AI.

2 lectura mínimaleer

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.