Biblioteca de IA gratuita

IA visual guiasLivre para sempre.

133 guias em inglês simples, caminhos de aprendizagem estruturados e uma biblioteca aberta — criada por uma organização sem fins lucrativos 501(c)(3) independente para que qualquer pessoa possa entender a IA moderna.

133Guias gratuitos
1Faixas de tópico
~2 minPor guia
~4hTempo de leitura

Comece aqui

Cinco cursos baseados em resultados

Cada curso inclui resultados explícitos, competências mapeadas, atividades práticas e um objetivo final aplicado.

Faixas de tópico

Navegue por faixa

Entre na área de seu interesse. Cada faixa tem vários guias em inglês simples.

Biblioteca completa

Todos os guias

133 de 1019 guias mostrados. Filtre por faixa ou pesquise acima.

IA visual

Compreensão do vídeo

Video understanding analyzes visual and sometimes audio information across time.

2 minutos de leituraLeia
IA visual

Pesquisa multimodal

Multimodal search retrieves information across forms such as text, images, audio, and video.

2 minutos de leituraLeia
IA visual

Documento IA

Document AI extracts and interprets information from files such as forms, reports, invoices, and scanned pages.

2 minutos de leituraLeia
IA visual

Wasserstein GAN

Wasserstein GAN (WGAN) é um redesenho do objetivo de treinamento GAN que usa a distância de Wasserstein em vez da perda min-max original.

2 minutos de leituraLeia
IA visual

GANs condicionais

GANs condicionais (cGANs) estendem GANs comuns, alimentando informações extras, como um rótulo de classe ou texto, tanto no gerador quanto no discriminador.

2 minutos de leituraLeia
IA visual

Tradução imagem para imagem Pix2Pix

Pix2Pix é um GAN condicional que aprende a traduzir um tipo de imagem em outro, como transformar um esboço em uma foto ou um mapa em uma visualização de satélite.

2 minutos de leituraLeia
IA visual

Colorização de imagens

A colorização de imagens usa IA para adicionar cores plausíveis e realistas a fotos e filmes em preto e branco.

2 minutos de leituraLeia
IA visual

Estrutura do Movimento

Structure from Motion (SfM) reconstrói a geometria da cena 3D e as posições da câmera a partir de um conjunto de fotos 2D sobrepostas tiradas de diferentes pontos de vista.

2 minutos de leituraLeia
IA visual

Estéreo multivisualização

Multi-View Stereo (MVS) tira muitas fotos calibradas de uma cena e produz uma reconstrução 3D densa, estimando a profundidade em quase cada pixel.

2 minutos de leituraLeia
IA visual

Amostradores DDPM e DDIM

DDPM e DDIM são duas maneiras de executar o processo reverso de um modelo de difusão, transformando passo a passo o ruído aleatório em uma imagem.

2 minutos de leituraLeia
IA visual

Modelos generativos baseados em pontuação

Modelos generativos baseados em pontuação criam dados aprendendo o gradiente da distribuição de dados – a direção que faz qualquer amostra ruidosa parecer mais real…

2 minutos de leituraLeia
IA visual

Distância de início de Fréchet

Fréchet Inception Distance (FID) é a métrica padrão para avaliar o quão realista e variado é um conjunto de imagens geradas.

2 minutos de leituraLeia

Terminou de ler? Prove.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.