GUIA de fundamentos

Suavização de rótulos

A suavização de rótulos é um truque simples de regularização que suaviza metas de treinamento one-hot, informando ao modelo que a resposta correta é muito provável, mas não 100% certa.

2 minutos de leituraÚltima atualização

Visão geral

It improves calibration and generalization across image and language models with almost no extra cost.

Mergulho profundo

Normalmente, um classificador é treinado em rótulos one-hot: a classe verdadeira obtém o alvo 1,0 e todo o resto 0,0. Combinado com entropia cruzada e softmax, isso leva o modelo a tornar o logit correto infinitamente maior que o resto, incentivando o excesso de confiança e o overfitting. A suavização de rótulo substitui o alvo por (1 - épsilon) para a classe verdadeira e épsilon/(K-1) espalhado pelas outras classes K, onde épsilon é pequeno (geralmente 0,1). O modelo agora visa uma distribuição confiável, mas não absoluta. Introduzido no trabalho Inception-v3 de 2016 e posteriormente analisado pelo grupo de Hinton, melhorou a precisão do ImageNet e é padrão em Transformers, onde o artigo original Atenção é tudo que você precisa usava épsilon de 0,1.

Visão Técnica

Com rótulos rígidos, minimizar a entropia cruzada leva o logit correto ao infinito positivo em relação aos outros, o que é inatingível e leva os pesos a extremos. A suavização define uma lacuna ideal finita entre o logit correto e o resto, de modo que os logits permanecem limitados e o modelo deixa de ser extremamente confiável. Estudos mostram que isso estreita os clusters da mesma classe e produz probabilidades melhor calibradas, e a confiança prevista corresponde à precisão real. A desvantagem: pode apagar informações refinadas sobre semelhanças entre classes, o que às vezes prejudica a destilação do conhecimento onde essas relações suaves são importantes.

Impacto Estratégico

Decisões mais claras

Ajuda a separar afirmações técnicas claras da linguagem de marketing.

Custo e orçamento

Você pode fazer perguntas melhores sobre implementação antes de gastar dinheiro ou tempo.

Equipe e fluxo de trabalho

Equipes com entendimento compartilhado tomam melhores decisões sobre produtos, políticas e aprendizado.

O futuro da suavização de etiquetas

A suavização de rótulos continua sendo um padrão no treinamento em larga escala, mas a pesquisa está avançando em direção a uma suavização adaptativa e aprendida que ajusta o épsilon por exemplo ou classe, em vez de usar um valor fixo. Métodos focados em calibração, como perda focal e escala de temperatura, são frequentemente comparados ou combinados com eles. À medida que os modelos crescem e as estimativas de incerteza fiáveis ​​se tornam críticas para a segurança, espera-se que a suavização seja uma ferramenta entre muitas para produzir pontuações de confiança fiáveis, com especial atenção ao seu conhecido conflito com a destilação.

Implementação no mundo real

Classificação ImageNet: Inception-v3 usou suavização de rótulo (épsilon 0.1) para aumentar a precisão do primeiro lugar e reduzir o excesso de confiança.

Tradução automática: o Transformer original aplicou suavização de rótulo de 0,1, trocando um pouco de perplexidade por pontuações BLEU mais altas.

Reconhecimento de fala: alvos suavizados reduzem reconhecimentos incorretos e melhoram a calibração em áudio ruidoso.

Modelos de imagens médicas: a suavização produz probabilidades melhor calibradas, o que é importante quando uma pontuação de confiança informa decisões clínicas.

Riscos e guarda-corpos

Equipes diferentes podem usar o mesmo termo de maneira diferente, portanto, defina o escopo com antecedência.

Os benchmarks podem parecer fortes, enquanto o desempenho no mundo real é irregular.

Ignorar a qualidade dos dados e os planos de avaliação cria frequentemente resultados frágeis.

Roteiro de implementação

1

Comece com uma definição em linguagem simples do resultado que você precisa.

2

Escolha uma métrica de sucesso e uma condição de falha antes de testar.

3

Execute um pequeno piloto com dados representativos, não um conjunto de demonstração sofisticado.

4

Documente onde o Label Smoothing ajuda e onde métodos mais simples são melhores.

Continue explorando

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Label Smoothing quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Iniciar teste

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Perguntas frequentes

What is Label Smoothing?

A suavização de rótulos é um truque simples de regularização que suaviza metas de treinamento one-hot, informando ao modelo que a resposta correta é muito provável, mas não 100% certa. Ele melhora a calibração e generalização em modelos de imagem e linguagem quase sem custo extra.

O que a suavização de rótulos muda nas metas de treinamento?

Em vez de um alvo rígido de 1,0/0,0, a suavização de rótulo atribui (1 - épsilon) à classe verdadeira e espalha o épsilon pelas outras.

Que problema com rótulos one-hot rígidos a suavização resolve?

Minimizar a entropia cruzada em alvos únicos leva o logit correto ao infinito em relação aos outros, incentivando o excesso de confiança e o ajuste excessivo.

Quais arquiteturas marcantes ajudaram a popularizar a suavização de rótulos?

A suavização de rótulo foi introduzida no artigo Inception-v3 de 2016 e adotada pelo Transformer (Attention Is All You Need) com épsilon 0.1.

Além da precisão, por qual benefício a suavização de etiquetas é conhecida?

A suavização melhora a calibração, a confiança prevista alinha-se mais de perto com a verdadeira probabilidade de estar correta.

Qual é a desvantagem documentada da suavização de rótulos?

Ao estreitar os clusters e nivelar as relações flexíveis entre as classes, a suavização pode remover informações das quais depende a destilação do conhecimento.