GUÍA DE FUNDAMENTOS

Matrices de confusión

Una matriz de confusión es una tabla simple que divide las predicciones de un clasificador en recuentos correctos e incorrectos para cada clase.

2 minutos de lecturaÚltima actualización

Descripción general

It is the raw scoreboard from which nearly every other classification metric is calculated.

Buceo profundo

Una matriz de confusión es una cuadrícula que compara etiquetas previstas con etiquetas reales. Para la clasificación binaria, tiene cuatro celdas: Verdaderos Positivos (positivos correctamente predichos), Verdaderos Negativos (negativos predichos correctamente), Falsos Positivos (negativos marcados erróneamente como positivos, un 'error de Tipo I') y Falsos Negativos (positivos que se omitieron, un 'error de Tipo II'). De estos cuatro números se deriva la precisión ((TP+TN)/total), la precisión (TP/(TP+FP)), la recuperación o sensibilidad (TP/(TP+FN)), la especificidad (TN/(TN+FP)) y la puntuación F1 (la media armónica de precisión y recuperación). Para problemas con más de dos clases, la matriz se convierte en N por N, donde la diagonal contiene predicciones correctas y las celdas fuera de la diagonal revelan exactamente qué clases se confunden con otras.

Información técnica

El poder de la matriz es que preserva la estructura de errores que oculta un único número de precisión. Dos modelos con una precisión idéntica del 90% pueden tener tasas de falsos negativos tremendamente diferentes, lo que importa enormemente cuando un diagnóstico de cáncer fallido cuesta más que una falsa alarma. Por convención, las filas a menudo representan clases verdaderas y las columnas clases predichas (aunque algunas bibliotecas invierten esto), así que siempre verifique las etiquetas de los ejes antes de calcular la precisión versus la recuperación de las celdas.

Impacto Estratégico

Decisiones más claras

Le ayuda a separar las afirmaciones técnicas claras del lenguaje de marketing.

Costo y presupuesto

Puede hacer mejores preguntas sobre implementación antes de gastar dinero o tiempo.

Equipo y flujo de trabajo

Los equipos con conocimientos compartidos toman mejores decisiones sobre productos, políticas y aprendizaje.

El futuro de las matrices de confusión

Las matrices de confusión seguirán siendo fundamentales, pero las herramientas las están enriqueciendo: mapas de calor normalizados e interactivos, desgloses por clase para grandes conjuntos de etiquetas y matrices ponderadas por costos que multiplican cada tipo de error por su penalización en el mundo real. En la auditoría de equidad, los profesionales ahora calculan matrices de confusión separadas por subgrupo demográfico para exponer tasas de error desiguales. Espere una integración continua en los paneles de modelos donde al hacer clic en una celda se muestran los ejemplos reales mal clasificados para su inspección.

Implementación en el mundo real

Diagnosticar dónde falla un clasificador de imágenes al ver que con frecuencia confunde perros esquimales con lobos en las celdas fuera de la diagonal

Auditar una herramienta de detección médica mediante el examen de falsos negativos: pacientes con la enfermedad que el modelo declaró sanos

Comparar dos filtros de spam de correo electrónico que comparten la misma precisión pero difieren en la cantidad de correos electrónicos reales que bloquean erróneamente (falsos positivos)

Evaluación de un reconocedor de dígitos escritos a mano de varias clases para descubrir que los 4 y los 9 se confunden con mayor frecuencia entre sí

Riesgos y barandillas

Diferentes equipos pueden usar el mismo término de manera diferente, por lo tanto, defina el alcance con anticipación.

Los puntos de referencia pueden parecer sólidos, mientras que el desempeño en el mundo real es desigual.

Ignorar la calidad de los datos y los planes de evaluación a menudo genera resultados frágiles.

Hoja de ruta de implementación

1

Comience con una definición en lenguaje sencillo del resultado que necesita.

2

Elija una métrica de éxito y una condición de fracaso antes de realizar la prueba.

3

Ejecute un pequeño piloto con datos representativos, no un conjunto de demostración pulido.

4

Documente dónde ayudan las matrices de confusión y dónde son mejores los métodos más simples.

Sigue explorando

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Confusion Matrices quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Iniciar prueba

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Preguntas frecuentes

What is Confusion Matrices?

Una matriz de confusión es una tabla simple que divide las predicciones de un clasificador en recuentos correctos e incorrectos para cada clase. Es el marcador en bruto a partir del cual se calculan casi todas las demás métricas de clasificación.

En una matriz de confusión binaria, ¿qué es un falso negativo?

Un Falso Negativo es un positivo real que el modelo pasó por alto al etiquetarlo como negativo; por ejemplo, un paciente enfermo declarado sano.

¿Qué métrica mide la proporción de positivos reales que el modelo identifica correctamente?

La recuperación (también llamada sensibilidad o tasa de verdaderos positivos) es TP / (TP + FN): la proporción de positivos reales que captó el modelo.

En una matriz de confusión para un problema con 5 clases, ¿qué representan las celdas diagonales?

En una matriz N por N, la diagonal contiene casos en los que la clase predicha coincide con la clase verdadera, es decir, predicciones correctas.

¿Por qué la precisión por sí sola puede ser engañosa sin una matriz de confusión?

Dos modelos con la misma precisión pueden distribuir sus errores de manera muy diferente; la matriz de confusión expone si los errores son en su mayoría falsas alarmas o positivos perdidos.

¿La puntuación F1 es la media armónica de qué dos métricas?

F1 combina precisión y recuperación en un número utilizando la media armónica, lo que penaliza grandes desequilibrios entre los dos.