Biblioteca de IA gratuita

Técnico guíasGratis para siempre.

177 Guías en inglés sencillo, rutas de aprendizaje estructuradas y una biblioteca abierta, creada por una organización sin fines de lucro independiente 501(c)(3) para que cualquiera pueda comprender la IA moderna.

177Guías gratuitas
1Pistas temáticas
~2 minPor guía
~6hReading time

Empieza aquí

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Pistas temáticas

Navegar por pista

Salta al área que te interesa. Cada pista tiene varias guías en inglés sencillo.

biblioteca completa

Todas las guías

177 de 1019 guías mostradas. Filtrar por pista o buscar arriba.

Técnico

Streaming especulativo y predicción de tokens múltiples

La transmisión especulativa y la predicción de múltiples tokens aceleran la generación de modelos de lenguaje al adivinar varios tokens futuros a la vez y verificarlos en un solo...

2 lectura mínimaleer
Técnico

BERTScore y evaluación semántica

BERTScore mide qué tan bien el texto generado por máquina coincide con una referencia comparando el significado, no las palabras exactas.

2 lectura mínimaleer
Técnico

Atención lineal y núcleos de intérprete

La atención lineal reemplaza la atención cuadrática softmax en Transformers con un truco matemático que escala linealmente con la longitud de la secuencia.

2 lectura mínimaleer
Técnico

YaRN y extensión de longitud de contexto

YaRN (Otra extensión de RoPE) es una técnica eficaz para ampliar la ventana de contexto utilizable de un modelo mucho más allá de aquello en lo que fue entrenado.

2 lectura mínimaleer
Técnico

Interpolación posicional para contexto largo

La interpolación posicional (PI) es una técnica simple e influyente que extiende la ventana de contexto de un transformador comprimiendo nuevos índices de posición en el rango...

2 lectura mínimaleer
Técnico

Mezcla de expertos de LoRA

La combinación de expertos de LoRA (MoLE) combina muchos adaptadores pequeños y capacitados de forma económica con un enrutador aprendido para que un único modelo base pueda especializarse de manera flexible en...

2 lectura mínimaleer
Técnico

Ediciones especulativas para modelos de código

Las ediciones especulativas hacen que la edición de código con IA parezca instantánea al predecir que la mayor parte de un archivo permanecerá sin cambios y solo verificar las pequeñas partes que difieren.

2 lectura mínimaleer
Técnico

Ingeniería de Dirección y Representación de Activación

La dirección de activación modifica el comportamiento de un modelo agregando o restando directamente vectores dentro de sus activaciones ocultas en tiempo de ejecución, sin necesidad de volver a entrenar.

2 lectura mínimaleer
Técnico

Codificadores automáticos dispersos para la interpretabilidad

Los codificadores automáticos dispersos (SAE) son una herramienta que separa las activaciones internas enredadas de una red neuronal en un conjunto mucho más grande de más limpios...

2 lectura mínimaleer
Técnico

Superposición y polisemanticidad en la interpretabilidad de la IA

Aprenda la superposición y la polisemanticidad en la interpretabilidad de la IA: por qué los modelos agrupan características en direcciones compartidas, por qué las neuronas se vuelven polisemánticas...

2 lectura mínimaleer
Técnico

Lente Logit y lente sintonizada

La lente logit y la lente sintonizada son técnicas de interpretabilidad que observan los estados ocultos de un transformador capa por capa para ver qué está "pensando" el modelo...

2 lectura mínimaleer
Técnico

Pilas de entrenamiento DeepSpeed ​​y Megatron

DeepSpeed ​​(Microsoft) y Megatron-LM (NVIDIA) son las pilas de software que crean modelos de entrenamiento con miles de millones de parámetros en miles de GPU...

2 lectura mínimaleer

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.

Technical AI Guides — Page 10 of 15 | AI Understanding