Biblioteca de IA gratuita

IA visual guiasLivre para sempre.

133 guias em inglês simples, caminhos de aprendizagem estruturados e uma biblioteca aberta — criada por uma organização sem fins lucrativos 501(c)(3) independente para que qualquer pessoa possa entender a IA moderna.

133Guias gratuitos
1Faixas de tópico
~2 minPor guia
~4hTempo de leitura

Comece aqui

Cinco cursos baseados em resultados

Cada curso inclui resultados explícitos, competências mapeadas, atividades práticas e um objetivo final aplicado.

Faixas de tópico

Navegue por faixa

Entre na área de seu interesse. Cada faixa tem vários guias em inglês simples.

Biblioteca completa

Todos os guias

133 de 1019 guias mostrados. Filtre por faixa ou pesquise acima.

IA visual

Pipeline de texto para 3D Magic3D

Magic3D é a resposta de dois estágios da NVIDIA ao DreamFusion, produzindo conteúdo 3D mais detalhado e de alta resolução com mais rapidez.

2 minutos de leituraLeia
IA visual

Denoising e Deblurring Redes

Redes de remoção de ruído e desfoque são modelos neurais que limpam imagens barulhentas ou borradas, recuperando detalhes nítidos de entradas confusas.

2 minutos de leituraLeia
IA visual

Restauração facial GFPGAN

GFPGAN é um modelo especializado que restaura fotos de rosto antigas, desfocadas ou de baixa qualidade em retratos nítidos e realistas.

2 minutos de leituraLeia
IA visual

Recuperação facial robusta CodeFormer

CodeFormer é um modelo de restauração facial desenvolvido para lidar com degradação extrema, recuperando rostos reconhecíveis de entradas muito danificadas, minúsculas ou borradas.

2 minutos de leituraLeia
IA visual

Geradores em escala GigaGAN

GigaGAN é um GAN de bilhões de parâmetros que prova que redes adversárias generativas podem escalar para geração de texto para imagem, rivalizando com modelos de difusão…

2 minutos de leituraLeia
IA visual

Síntese de imagens VQGAN e Codebook

VQGAN compacta imagens em uma grade de tokens discretos extraídos de um livro de códigos aprendido, permitindo que um transformador gere imagens da mesma forma que os modelos de linguagem…

2 minutos de leituraLeia
IA visual

Decodificação de token paralelo MaskGIT

MaskGIT gera imagens prevendo muitos tokens de uma vez e preenchendo primeiro os mais confiáveis, substituindo a geração lenta da esquerda para a direita…

2 minutos de leituraLeia
IA visual

Difusão de visão de romance zero-1 a 3

Zero-1-to-3 transforma uma única foto de um objeto em imagens desse mesmo objeto visto de qualquer novo ângulo, usando um modelo de difusão condicionado na câmera…

2 minutos de leituraLeia
IA visual

Representação 3D Híbrida DMTet

DMTet (Deep Marching Tetrahedra) é uma representação híbrida de forma 3D que combina uma grade tetraédrica deformável com um campo de distância sinalizado tão neural…

2 minutos de leituraLeia
IA visual

Codificação de hash NGP instantânea

Instant-NGP é uma técnica da NVIDIA que treina Neural Radiance Fields e outras primitivas gráficas neurais em segundos, em vez de horas, armazenando…

2 minutos de leituraLeia
IA visual

Profundidade Monocular DepthAnything

DepthAnything é um modelo básico que estima a distância de cada pixel de uma única foto comum, sem nenhum hardware especial.

2 minutos de leituraLeia
IA visual

Estimativa de profundidade de difusão de calêndula

Marigold reaproveita um modelo de difusão de geração de imagem pré-treinado (Stable Diffusion) para prever mapas de profundidade altamente detalhados.

2 minutos de leituraLeia

Terminou de ler? Prove.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.