Biblioteca de IA gratuita

IA visual guiasLivre para sempre.

133 guias em inglês simples, caminhos de aprendizagem estruturados e uma biblioteca aberta — criada por uma organização sem fins lucrativos 501(c)(3) independente para que qualquer pessoa possa entender a IA moderna.

133Guias gratuitos
1Faixas de tópico
~2 minPor guia
~4hTempo de leitura

Comece aqui

Cinco cursos baseados em resultados

Cada curso inclui resultados explícitos, competências mapeadas, atividades práticas e um objetivo final aplicado.

Faixas de tópico

Navegue por faixa

Entre na área de seu interesse. Cada faixa tem vários guias em inglês simples.

Biblioteca completa

Todos os guias

133 de 1019 guias mostrados. Filtre por faixa ou pesquise acima.

IA visual

Controles deslizantes LoRA para edição de imagens

Os controles deslizantes LoRA são pequenos módulos complementares que fornecem um dial contínuo para aumentar ou diminuir um único atributo de uma imagem, como idade, sorriso ou ferrugem, sem…

2 minutos de leituraLeia
IA visual

Edição de instruções InstructPix2Pix

O InstructPix2Pix permite editar uma foto digitando um comando simples como 'fazer inverno' ou 'transformar o gato em cachorro', sem necessidade de máscaras ou ferramentas de seleção.

2 minutos de leituraLeia
IA visual

Edição de atenção cruzada prompt a prompt

Prompt-to-Prompt edita uma imagem gerada ajustando seu prompt de texto enquanto reutiliza os mapas de atenção internos do modelo, alterando assim as trocas de uma palavra…

2 minutos de leituraLeia
IA visual

Super-resolução ESRGAN e GAN

ESRGAN usa um concurso gerador versus discriminador para inventar detalhes realistas ao aumentar a escala de imagens, indo além da interpolação borrada.

2 minutos de leituraLeia
IA visual

Restauração Prática Real-ESRGAN

O Real-ESRGAN estende o ESRGAN para lidar com degradações confusas e desconhecidas de fotos do mundo real, em vez de desfoque sintético limpo.

2 minutos de leituraLeia
IA visual

Restauração do transformador SwinIR

O SwinIR aplica a atenção de janela deslocada do Swin Transformer para tarefas de restauração de imagens, como super-resolução, remoção de ruído e remoção de artefatos JPEG.

2 minutos de leituraLeia
IA visual

Modelos de consistência latente

Modelos de consistência latente (LCMs) são uma técnica que permite que geradores de imagens de difusão produzam imagens de alta qualidade em apenas uma a quatro etapas…

2 minutos de leituraLeia
IA visual

Transformadores de visão

Vision Transformers (ViTs) aplicam a arquitetura do transformador que alimenta ChatGPT às imagens, tratando uma imagem como uma sequência de patches em vez de uma grade…

2 minutos de leituraLeia
IA visual

Stable Diffusion

Stable Diffusion é um modelo de texto para imagem de código aberto, lançado pela Stability AI em 2022, que gera imagens removendo gradualmente o ruído de um aleatório…

2 minutos de leituraLeia
IA visual

Midjourney

Midjourney é um serviço comercial popular de conversão de texto em imagem, conhecido por seus resultados impressionantes e altamente estéticos e por suas origens como um bot Discord.

2 minutos de leituraLeia
IA visual

DALL-E

DALL-E é a família de modelos de texto para imagem de OpenAI que transformam uma descrição escrita em uma imagem original.

2 minutos de leituraLeia
IA visual

Modelos CLIP e Vision-Language

CLIP é um modelo de OpenAI que aprende a conectar imagens e texto colocando ambos no mesmo espaço matemático.

2 minutos de leituraLeia

Terminou de ler? Prove.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.