Biblioteca de IA gratuita

IA visual guiasLivre para sempre.

133 guias em inglês simples, caminhos de aprendizagem estruturados e uma biblioteca aberta — criada por uma organização sem fins lucrativos 501(c)(3) independente para que qualquer pessoa possa entender a IA moderna.

133Guias gratuitos
1Faixas de tópico
~2 minPor guia
~4hTempo de leitura

Comece aqui

Cinco cursos baseados em resultados

Cada curso inclui resultados explícitos, competências mapeadas, atividades práticas e um objetivo final aplicado.

Faixas de tópico

Navegue por faixa

Entre na área de seu interesse. Cada faixa tem vários guias em inglês simples.

Biblioteca completa

Todos os guias

133 de 1019 guias mostrados. Filtre por faixa ou pesquise acima.

IA visual

Harmonização e composição de imagens

A harmonização de imagem ajusta automaticamente um objeto colado em primeiro plano para que sua cor, iluminação e tom correspondam ao novo plano de fundo, fazendo com que as composições pareçam reais.

2 minutos de leituraLeia
IA visual

SDXL e difusão em cascata

SDXL é o modelo de texto para imagem de alta resolução do Stability AI que combina um poderoso gerador de base com um refinador, enquanto a difusão em cascata encadeia vários…

2 minutos de leituraLeia
IA visual

Geração Aterrada GLIGEN

GLIGEN (Grounded-Language-to-Image Generation) permite controlar exatamente onde os objetos aparecem em uma imagem gerada, alimentando as caixas delimitadoras do modelo…

2 minutos de leituraLeia
IA visual

Adaptador T2I para controle de difusão multicondicional

Aprenda o adaptador T2I para controle de difusão multicondicional: como ele orienta a difusão estável com bordas, profundidade, pose e outras condições usando um leve…

2 minutos de leituraLeia
IA visual

Inversão de texto nulo

A inversão de texto nulo é uma técnica que permite editar uma foto real com um modelo de difusão baseado em texto, como Stable Diffusion, mantendo tudo o que você…

2 minutos de leituraLeia
IA visual

Ajuste multiconceito de difusão personalizada

Difusão Personalizada é um método leve de ajuste fino que ensina a um modelo de texto para imagem novos conceitos pessoais, como seu cachorro ou uma cadeira específica, a partir de apenas…

2 minutos de leituraLeia
IA visual

Mesclagem latente e interpolação de imagens

A combinação latente mistura imagens combinando suas representações compactadas dentro do espaço latente de um modelo, em vez de calcular a média de pixels brutos.

2 minutos de leituraLeia
IA visual

Modelos de visão-linguagem-ação para robótica

Os modelos de visão-linguagem-ação (VLA) são grandes redes neurais que captam imagens de câmeras, além de uma instrução escrita e emitem diretamente comandos motores do robô.

2 minutos de leituraLeia
IA visual

Política de difusão para controle de robôs

A Política de Difusão aplica a mesma ideia de eliminação de ruído por trás de geradores de imagem como Stable Diffusion para controle de robôs: em vez de prever uma única próxima ação…

2 minutos de leituraLeia
IA visual

Faça um vídeo de texto para vídeo

Make-A-Video é o sistema 2022 de Meta que transforma um prompt de texto em um pequeno videoclipe sem nunca treinar em pares texto-vídeo rotulados.

2 minutos de leituraLeia
IA visual

Cascatas de vídeo de imagens

Imagen Video é o sistema de texto para vídeo 2022 de Google que cria um clipe por meio de uma cascata de sete modelos de difusão, cada um adicionando mais quadros ou mais resolução.

2 minutos de leituraLeia
IA visual

CogVideo e CogVideoX

CogVideo (2022) foi o primeiro modelo de texto para vídeo aberto em grande escala, e CogVideoX (2024) é seu sucessor de código aberto muito mais capaz da Tsinghua/Zhipu AI.

2 minutos de leituraLeia

Terminou de ler? Prove.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.