Biblioteca de IA gratuita

IA visual guiasLivre para sempre.

133 guias em inglês simples, caminhos de aprendizagem estruturados e uma biblioteca aberta — criada por uma organização sem fins lucrativos 501(c)(3) independente para que qualquer pessoa possa entender a IA moderna.

133Guias gratuitos
1Faixas de tópico
~2 minPor guia
~4hTempo de leitura

Comece aqui

Cinco cursos baseados em resultados

Cada curso inclui resultados explícitos, competências mapeadas, atividades práticas e um objetivo final aplicado.

Faixas de tópico

Navegue por faixa

Entre na área de seu interesse. Cada faixa tem vários guias em inglês simples.

Biblioteca completa

Todos os guias

133 de 1019 guias mostrados. Filtre por faixa ou pesquise acima.

IA visual

Reconhecimento óptico de caracteres

O reconhecimento óptico de caracteres (OCR) transforma imagens de texto – documentos digitalizados, fotos de sinais, PDFs – em texto editável e legível por máquina.

2 minutos de leituraLeia
IA visual

Fluxo Óptico

O fluxo óptico estima como cada pixel se move entre quadros de vídeo consecutivos, produzindo um mapa denso de vetores de movimento.

2 minutos de leituraLeia
IA visual

Estimativa de profundidade monocular

A estimativa de profundidade monocular prevê a que distância cada pixel está de uma única foto comum – sem necessidade de câmera estéreo, lidar ou sensor de profundidade.

2 minutos de leituraLeia
IA visual

Modelos de Difusão Latente

Os modelos de difusão latente geram imagens executando o processo de difusão em um espaço latente compactado em vez de pixels brutos, reduzindo os custos de computação.

2 minutos de leituraLeia
IA visual

ControlNet

ControlNet é um complemento que fornece aos modelos de geração de imagens um controle estrutural preciso, permitindo direcionar a saída com bordas, poses, mapas de profundidade ou rabiscos.

2 minutos de leituraLeia
IA visual

Orientação sem classificador

A orientação sem classificador é a técnica que faz com que os modelos de difusão realmente sigam seu prompt, trocando alguma diversidade por uma adesão muito mais forte.

2 minutos de leituraLeia
IA visual

SLAM visual

O Visual SLAM permite que uma câmera em movimento construa um mapa de um espaço desconhecido enquanto rastreia simultaneamente sua própria posição dentro desse mapa.

2 minutos de leituraLeia
IA visual

Sora e conversão de texto em vídeo

Sora é o modelo de texto para vídeo de OpenAI que transforma um prompt escrito em um videoclipe curto e de alta resolução.

2 minutos de leituraLeia
IA visual

Modelos de difusão de vídeo

Os modelos de difusão de vídeo geram imagens em movimento transformando gradualmente o ruído aleatório em quadros coerentes, estendendo a ideia de difusão das imagens ao tempo.

2 minutos de leituraLeia
IA visual

Geração de texto para 3D

A geração de texto para 3D transforma um prompt escrito como 'uma poltrona de couro vintage' em um modelo 3D completo que você pode girar, iluminar e colocar em um jogo ou cena.

2 minutos de leituraLeia
IA visual

Renderização diferenciável

A renderização diferenciável torna o processo de transformar uma cena 3D em uma imagem 2D totalmente diferenciável, para que você possa calcular gradientes a partir dos pixels renderizados…

2 minutos de leituraLeia
IA visual

Arquitetura U-Net

U-Net é uma rede neural convolucional em forma de 'U' que se destaca na produção de resultados com precisão de pixels, originalmente para segmentação de imagens biomédicas.

2 minutos de leituraLeia

Terminou de ler? Prove.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.