Biblioteca de IA gratuita

Técnico guiasLivre para sempre.

177 guias em inglês simples, caminhos de aprendizagem estruturados e uma biblioteca aberta — criada por uma organização sem fins lucrativos 501(c)(3) independente para que qualquer pessoa possa entender a IA moderna.

177Guias gratuitos
1Faixas de tópico
~2 minPor guia
~6hTempo de leitura

Comece aqui

Cinco cursos baseados em resultados

Cada curso inclui resultados explícitos, competências mapeadas, atividades práticas e um objetivo final aplicado.

Faixas de tópico

Navegue por faixa

Entre na área de seu interesse. Cada faixa tem vários guias em inglês simples.

Biblioteca completa

Todos os guias

177 de 1019 guias mostrados. Filtre por faixa ou pesquise acima.

Técnico

Streaming especulativo e previsão de vários tokens

O streaming especulativo e a previsão de vários tokens aceleram a geração de modelos de linguagem, adivinhando vários tokens futuros de uma só vez e verificando-os em uma única…

2 minutos de leituraLeia
Técnico

BERTScore e avaliação semântica

O BERTScore mede até que ponto o texto gerado por máquina corresponde a uma referência, comparando o significado, não as palavras exatas.

2 minutos de leituraLeia
Técnico

Atenção Linear e Kernels de Performer

A atenção linear substitui a atenção quadrática softmax em Transformers por um truque matemático que escala linearmente com o comprimento da sequência.

2 minutos de leituraLeia
Técnico

YaRN e extensão de comprimento de contexto

YaRN (Yet another RoPE extensioN) é uma técnica eficiente para estender a janela de contexto utilizável de um modelo muito além do que foi treinado.

2 minutos de leituraLeia
Técnico

Interpolação posicional para contexto longo

A interpolação posicional (PI) é uma técnica simples e influente que estende a janela de contexto de um Transformer, comprimindo novos índices de posição no intervalo…

2 minutos de leituraLeia
Técnico

Mistura de especialistas LoRA

Mixture of LoRA Experts (MoLE) combina muitos adaptadores pequenos e baratos com um roteador aprendido para que um único modelo básico possa se especializar com flexibilidade em…

2 minutos de leituraLeia
Técnico

Edições especulativas para modelos de código

As edições especulativas tornam a edição do código de IA instantânea, prevendo que a maior parte de um arquivo permanecerá inalterada e verificando apenas as pequenas partes que diferem.

2 minutos de leituraLeia
Técnico

Engenharia de Direção e Representação de Ativação

A direção de ativação estimula o comportamento de um modelo adicionando ou subtraindo diretamente vetores dentro de suas ativações ocultas em tempo de execução, sem necessidade de novo treinamento.

2 minutos de leituraLeia
Técnico

Autoencoders esparsos para interpretabilidade

Autoencoders esparsos (SAEs) são uma ferramenta que separa as ativações internas emaranhadas de uma rede neural em um conjunto muito maior de limpadores…

2 minutos de leituraLeia
Técnico

Superposição e polissemanticidade na interpretabilidade da IA

Aprenda sobreposição e polissemanticidade na interpretabilidade da IA: por que os modelos agrupam recursos em direções compartilhadas, por que os neurônios se tornam polissemânticos…

2 minutos de leituraLeia
Técnico

Lente Logit e Lente Afinada

As lentes logit e as lentes sintonizadas são técnicas de interpretabilidade que espiam os estados ocultos de um transformador, camada por camada, para ver o que o modelo está 'pensando'...

2 minutos de leituraLeia
Técnico

Pilhas de treinamento DeepSpeed ​​​​e Megatron

DeepSpeed ​​(Microsoft) e Megatron-LM (NVIDIA) são as pilhas de software que criam modelos de treinamento com bilhões de parâmetros em milhares de GPUs…

2 minutos de leituraLeia

Terminou de ler? Prove.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.