Aumento de datos
El aumento de datos amplía artificialmente un conjunto de entrenamiento mediante la creación de copias modificadas de ejemplos existentes, como voltear o recortar imágenes.
Descripción general
It matters because more varied data reduces overfitting and helps models generalize to inputs they have not seen.
Buceo profundo
El aumento de datos genera nuevos ejemplos de capacitación mediante la aplicación de transformaciones que conservan etiquetas a los datos que ya tiene. Para las imágenes, eso significa rotaciones, volteos, recortes, cambios de color, desenfoque y adición de ruido: cambios que alteran los píxeles pero no la respuesta correcta (un gato volteado sigue siendo un gato). Para el texto, las técnicas incluyen el reemplazo de sinónimos, la retrotraducción (traducir a otro idioma y viceversa) y la eliminación o el intercambio aleatorio de palabras. Para el audio, puede agregar ruido de fondo, cambiar el tono o ampliar el tiempo de los clips. El objetivo es enseñarle al modelo las invariancias que importan: que la identidad de un objeto no depende de su posición, iluminación o fraseo. Esto hace que los modelos sean más robustos y es especialmente valioso cuando los datos etiquetados son escasos, ya que cada ejemplo real efectivamente se convierte en muchos. Los canales modernos a menudo asignan aumentos aleatorios sobre la marcha durante cada época de entrenamiento.
Información técnica
El aumento funciona porque inyecta conocimiento previo sobre las invarianzas directamente en el entrenamiento: al mostrarle al modelo muchas versiones transformadas de un ejemplo, lo alienta a aprender características que ignoran la variación irrelevante. Fundamentalmente, las transformaciones deben preservar la etiqueta: convertir un '6' en un '9' enseñaría algo equivocado. Los métodos avanzados van más allá de las simples ediciones: Mixup combina dos imágenes y sus etiquetas, regiones de máscaras de recorte y políticas aprendidas como AutoAugment buscan las mejores combinaciones de transformación para un conjunto de datos determinado.
Impacto Estratégico
Decisiones más claras
Le ayuda a separar las afirmaciones técnicas claras del lenguaje de marketing.
Costo y presupuesto
Puede hacer mejores preguntas sobre implementación antes de gastar dinero o tiempo.
Equipo y flujo de trabajo
Los equipos con conocimientos compartidos toman mejores decisiones sobre productos, políticas y aprendizaje.
El futuro del aumento de datos
La frontera es el aumento generativo y aprendido: utilizar modelos de difusión o GAN para sintetizar ejemplos de entrenamiento completamente nuevos y realistas en lugar de simplemente transformar los antiguos. La búsqueda de aumento automatizada (AutoAugment, RandAugment) está reduciendo el ajuste manual, y el aumento ahora es fundamental para el aprendizaje autosupervisado, donde los modelos aprenden reconociendo que dos vistas aumentadas de la misma entrada deben coincidir. Espere que el aumento siga desdibujando la línea con la generación de datos sintéticos, especialmente para clases raras y dominios sensibles a la privacidad donde la recopilación de datos reales es difícil.
Implementación en el mundo real
Un clasificador de imágenes se entrena con fotografías rotadas, recortadas y con cambios de color aleatoriamente para reconocer objetos independientemente del ángulo o la iluminación.
Un equipo de PNL utiliza la traducción inversa (del inglés al alemán y viceversa) para parafrasear oraciones y ampliar un pequeño conjunto de datos de análisis de sentimientos.
Un modelo de voz agrega ruido de fondo de café y cambia el tono de las grabaciones para que se mantenga preciso en condiciones ruidosas del mundo real.
Una IA médica aplica deformaciones elásticas y cambia a un conjunto limitado de exploraciones de resonancia magnética para multiplicar los escasos ejemplos etiquetados sin nuevos pacientes.
Riesgos y barandillas
Diferentes equipos pueden usar el mismo término de manera diferente, por lo tanto, defina el alcance con anticipación.
Los puntos de referencia pueden parecer sólidos, mientras que el desempeño en el mundo real es desigual.
Ignorar la calidad de los datos y los planes de evaluación a menudo genera resultados frágiles.
Hoja de ruta de implementación
Comience con una definición en lenguaje sencillo del resultado que necesita.
Elija una métrica de éxito y una condición de fracaso antes de realizar la prueba.
Ejecute un pequeño piloto con datos representativos, no un conjunto de demostración pulido.
Documente dónde ayuda el aumento de datos y dónde son mejores los métodos más simples.
Sigue explorando
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Data Augmentation quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Siguiente guía
IA y datos
Preguntas frecuentes
What is Data Augmentation?
El aumento de datos amplía artificialmente un conjunto de entrenamiento mediante la creación de copias modificadas de ejemplos existentes, como voltear o recortar imágenes. Es importante porque los datos más variados reducen el sobreajuste y ayudan a los modelos a generalizar a entradas que no han visto.
¿Cuál es el propósito principal del aumento de datos?
El aumento crea copias variadas y modificadas de datos existentes para reducir el sobreajuste y ayudar al modelo a manejar entradas invisibles.
¿Cuál de estas es una técnica común de aumento de imágenes?
Voltear, recortar, rotar y cambiar de color son aumentos de imagen estándar que cambian los píxeles conservando la etiqueta.
¿Qué hace la retrotraducción en el aumento de texto?
La retrotraducción ejecuta el texto en otro idioma y viceversa, lo que produce una versión reformulada que conserva el significado.
¿Por qué los aumentos deben "conservar la etiqueta"?
Una transformación no debería cambiar la respuesta correcta; convertir un '6' en un '9', por ejemplo, etiquetaría mal el ejemplo.
¿Qué hace la técnica Mixup?
Mixup crea nuevas muestras combinando linealmente pares de entradas y sus etiquetas, lo que fomenta límites de decisión más fluidos.