Biblioteca de IA gratuita

Técnico guiasLivre para sempre.

177 guias em inglês simples, caminhos de aprendizagem estruturados e uma biblioteca aberta — criada por uma organização sem fins lucrativos 501(c)(3) independente para que qualquer pessoa possa entender a IA moderna.

177Guias gratuitos
1Faixas de tópico
~2 minPor guia
~6hTempo de leitura

Comece aqui

Cinco cursos baseados em resultados

Cada curso inclui resultados explícitos, competências mapeadas, atividades práticas e um objetivo final aplicado.

Faixas de tópico

Navegue por faixa

Entre na área de seu interesse. Cada faixa tem vários guias em inglês simples.

Biblioteca completa

Todos os guias

177 de 1019 guias mostrados. Filtre por faixa ou pesquise acima.

Técnico

Detecção de desvio de modelo

A detecção de desvio de modelo é a prática de monitorar um modelo de aprendizado de máquina implantado para detectar quando sua precisão se degrada silenciosamente porque o mundo real…

2 minutos de leituraLeia
Técnico

Teste A/B para modelos de ML

O teste A/B para modelos de ML significa rotear o tráfego ao vivo para duas versões de modelo ao mesmo tempo e medir qual delas realmente tem melhor desempenho em usuários reais e reais…

2 minutos de leituraLeia
Técnico

Formatos de serialização de modelo

A serialização de modelo é como um modelo de aprendizado de máquina treinado é salvo em disco para que possa ser carregado e executado posteriormente, em uma máquina diferente ou em uma máquina diferente.

2 minutos de leituraLeia
Técnico

Treinamento de precisão mista

O treinamento de precisão mista acelera o treinamento da rede neural e reduz o uso de memória, realizando a maior parte da matemática em ponto flutuante de 16 bits em vez de 32 bits.

2 minutos de leituraLeia
Técnico

Decodificação Especulativa

A decodificação especulativa faz com que grandes modelos de linguagem gerem texto mais rapidamente usando um modelo de 'rascunho' pequeno e rápido para adivinhar vários tokens à frente e, em seguida, ter o grande…

2 minutos de leituraLeia
Técnico

Otimização de Cache KV

O cache KV armazena as chaves e os valores que um transformador já computou, de modo que não refaz o trabalho para cada novo token – mas pode aumentar para gigabytes.

2 minutos de leituraLeia
Técnico

Atenção instantânea

Flash Attention é uma maneira inteligente de calcular o passo de atenção dentro dos Transformers sem nunca escrever a matriz gigante de atenção para diminuir a memória.

2 minutos de leituraLeia
Técnico

Poda de modelo

A poda de modelo reduz uma rede neural removendo pesos ou estruturas inteiras que contribuem pouco para sua saída.

2 minutos de leituraLeia
Técnico

Tokenização e codificação de pares de bytes

A tokenização divide o texto em pequenas unidades que um modelo de linguagem realmente lê, e a codificação de pares de bytes (BPE) é o método popular para construir…

2 minutos de leituraLeia

Terminou de ler? Prove.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.