Matrizes de confusão
Uma matriz de confusão é uma tabela simples que divide as previsões de um classificador em contagens corretas e incorretas para cada classe.
Visão geral
It is the raw scoreboard from which nearly every other classification metric is calculated.
Mergulho profundo
Uma matriz de confusão é uma grade que compara rótulos previstos com rótulos reais. Para classificação binária, ele tem quatro células: Verdadeiros Positivos (positivo previsto corretamente), Verdadeiros Negativos (negativo previsto corretamente), Falsos Positivos (negativos sinalizados erroneamente como positivos, um 'erro Tipo I') e Falsos Negativos (positivos que foram perdidos, um 'erro Tipo II'). A partir desses quatro números você obtém exatidão ((TP+TN)/total), precisão (TP/(TP+FP)), recall ou sensibilidade (TP/(TP+FN)), especificidade (TN/(TN+FP)) e a pontuação F1 (a média harmônica de precisão e recall). Para problemas com mais de duas classes, a matriz torna-se N por N, onde a diagonal contém previsões corretas e as células fora da diagonal revelam exatamente quais classes são confundidas com outras.
Visão Técnica
O poder da matriz é preservar a estrutura de erros que um único número de precisão esconde. Dois modelos com uma precisão idêntica de 90% podem ter taxas de falso-negativos totalmente diferentes, o que é extremamente importante quando um diagnóstico de cancro falhado custa mais do que um alarme falso. Por convenção, as linhas geralmente representam classes verdadeiras e colunas de classes previstas (embora algumas bibliotecas invertam isso), portanto, sempre verifique os rótulos dos eixos antes de calcular a precisão versus a recuperação das células.
Impacto Estratégico
Decisões mais claras
Ajuda a separar afirmações técnicas claras da linguagem de marketing.
Custo e orçamento
Você pode fazer perguntas melhores sobre implementação antes de gastar dinheiro ou tempo.
Equipe e fluxo de trabalho
Equipes com entendimento compartilhado tomam melhores decisões sobre produtos, políticas e aprendizado.
O futuro das matrizes de confusão
As matrizes de confusão continuarão sendo fundamentais, mas as ferramentas estão tornando-as mais ricas: mapas de calor interativos e normalizados, detalhamentos por classe para grandes conjuntos de rótulos e matrizes de custo ponderado que multiplicam cada tipo de erro por sua penalidade no mundo real. Na auditoria de imparcialidade, os profissionais calculam agora matrizes de confusão separadas por subgrupo demográfico para expor taxas de erro desiguais. Espere uma integração contínua nos painéis do modelo, onde clicar em uma célula mostra os exemplos reais classificados incorretamente para inspeção.
Implementação no mundo real
Diagnosticar onde um classificador de imagens falha ao ver que ele frequentemente confunde huskies com lobos nas células fora da diagonal
Auditar uma ferramenta de triagem médica examinando falsos negativos – pacientes com a doença que o modelo declarou saudáveis
Comparando dois filtros de spam de e-mail que compartilham a mesma precisão, mas diferem na quantidade de e-mails reais que eles bloqueiam erroneamente (falsos positivos)
Avaliando um reconhecedor de dígitos manuscritos multiclasse para descobrir que 4 e 9 são mais frequentemente confundidos um com o outro
Riscos e guarda-corpos
Equipes diferentes podem usar o mesmo termo de maneira diferente, portanto, defina o escopo com antecedência.
Os benchmarks podem parecer fortes, enquanto o desempenho no mundo real é irregular.
Ignorar a qualidade dos dados e os planos de avaliação cria frequentemente resultados frágeis.
Roteiro de implementação
Comece com uma definição em linguagem simples do resultado que você precisa.
Escolha uma métrica de sucesso e uma condição de falha antes de testar.
Execute um pequeno piloto com dados representativos, não um conjunto de demonstração sofisticado.
Documente onde o Confusion Matrices ajuda e onde os métodos mais simples são melhores.
Continue explorando
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Confusion Matrices quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Próximo guia
Validação Cruzada
Perguntas frequentes
What is Confusion Matrices?
Uma matriz de confusão é uma tabela simples que divide as previsões de um classificador em contagens corretas e incorretas para cada classe. É o placar bruto a partir do qual quase todas as outras métricas de classificação são calculadas.
Em uma matriz de confusão binária, o que é um falso negativo?
Um falso negativo é um positivo real que o modelo não percebeu ao rotulá-lo como negativo – por exemplo, um paciente doente declarado saudável.
Qual métrica mede a proporção de positivos reais que o modelo identifica corretamente?
A recuperação (também chamada de sensibilidade ou taxa de verdadeiros positivos) é TP / (TP + FN) – a parcela de positivos reais que o modelo capturou.
Numa matriz de confusão para um problema com 5 classes, o que representam as células diagonais?
Em uma matriz N por N, a diagonal contém casos em que a classe prevista corresponde à classe verdadeira – ou seja, previsões corretas.
Por que a precisão por si só pode ser enganosa sem uma matriz de confusão?
Dois modelos com a mesma precisão podem distribuir seus erros de maneira muito diferente; a matriz de confusão expõe se os erros são, em sua maioria, alarmes falsos ou positivos perdidos.
A pontuação F1 é a média harmônica de quais duas métricas?
F1 combina precisão e recuperação em um número usando a média harmônica, que penaliza grandes desequilíbrios entre os dois.