Máquinas de vetores de suporte
Uma máquina de vetores de suporte (SVM) é um algoritmo clássico que separa dois grupos desenhando o limite mais amplo possível entre eles.
Visão geral
Era um dos classificadores mais poderosos antes do deep learning e ainda é forte em conjuntos de dados pequenos e limpos.
Mergulho profundo
Um SVM encontra o limite de decisão, denominado hiperplano, que maximiza a margem, a lacuna entre o limite e os pontos de dados mais próximos de cada classe. Esses pontos mais próximos são os 'vetores de suporte' e, por si só, definem o limite, o que torna o modelo compacto e resistente a valores discrepantes distantes da borda. Quando os dados não podem ser divididos por uma linha reta, o truque do kernel os mapeia para um espaço de dimensão superior onde existe uma separação clara, sem nunca calcular essas coordenadas diretamente. Uma margem suave permite alguns erros de classificação, controlados por um parâmetro C, de modo que o modelo equilibra uma ampla margem contra erros de treinamento. Os SVMs se destacam quando os recursos são muitos, mas os exemplos são poucos, como na classificação de textos e na bioinformática.
Visão Técnica
Maximizar a margem é um problema de otimização convexo, portanto os SVMs têm um único ótimo global, diferentemente das redes neurais. O truque do kernel substitui produtos escalares entre pontos de dados por uma função de kernel, como a função de base radial (RBF) ou kernel polinomial, que calcula implicitamente a similaridade em um espaço de dimensão superior. Isso permite que um método linear desenhe limites curvos de maneira barata. Dois hiperparâmetros dominam o ajuste: C, que negocia a largura da margem com erros, e gama no kernel RBF, que define até onde chega a influência de cada ponto.
Impacto Estratégico
Decisões mais claras
Ajuda a separar afirmações técnicas claras da linguagem de marketing.
Custo e orçamento
Você pode fazer perguntas melhores sobre implementação antes de gastar dinheiro ou tempo.
Equipe e fluxo de trabalho
Equipes com entendimento compartilhado tomam melhores decisões sobre produtos, políticas e aprendizado.
O futuro das máquinas de vetores de suporte
Os SVMs foram amplamente ultrapassados pelo aprendizado profundo e pelas árvores com gradiente aumentado para conjuntos de dados grandes e complexos, mas continuam sendo uma escolha confiável quando os dados são escassos, altamente dimensionais ou precisam de uma linha de base forte e bem compreendida. Eles permanecem comuns no ensino, em bioinformática e tarefas de texto, e em ambientes com recursos limitados, onde um modelo pequeno e rápido supera uma rede pesada. Esperemos que os SVM persistam como uma ferramenta clássica confiável e uma referência, em vez de uma fronteira de novas pesquisas.
Implementação no mundo real
Classificação de texto e spam, onde os documentos possuem milhares de recursos de palavras, mas exemplos limitados.
Classificação de imagens em pequenos conjuntos de dados antes que o aprendizado profundo se tornasse dominante.
Classificação do câncer e da expressão gênica em bioinformática com muitas características e poucas amostras.
Reconhecimento de dígitos manuscritos, um benchmark SVM clássico no conjunto de dados MNIST.
Riscos e guarda-corpos
Equipes diferentes podem usar o mesmo termo de maneira diferente, portanto, defina o escopo com antecedência.
Os benchmarks podem parecer fortes, enquanto o desempenho no mundo real é irregular.
Ignorar a qualidade dos dados e os planos de avaliação cria frequentemente resultados frágeis.
Roteiro de implementação
Comece com uma definição em linguagem simples do resultado que você precisa.
Escolha uma métrica de sucesso e uma condição de falha antes de testar.
Execute um pequeno piloto com dados representativos, não um conjunto de demonstração sofisticado.
Documente onde o Support Vector Machines ajuda e onde os métodos mais simples são melhores.
Continue explorando
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Support Vector Machines quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Próximo guia
Noções básicas de aprendizado de máquina
Perguntas frequentes
O que são Máquinas de Vetores de Suporte?
Uma máquina de vetores de suporte (SVM) é um algoritmo clássico que separa dois grupos desenhando o limite mais amplo possível entre eles. Foi um dos classificadores mais poderosos antes do aprendizado profundo e ainda é forte em conjuntos de dados pequenos e limpos.
O que uma máquina de vetores de suporte tenta maximizar?
Um SVM encontra o hiperplano que maximiza a margem, a distância aos pontos mais próximos de cada classe, para a separação mais robusta.
Quais são os 'vetores de suporte' em um SVM?
Apenas os pontos mais próximos da fronteira, os vetores de suporte, determinam o hiperplano; outros pontos podem se mover sem alterá-lo.
Que problema o truque do kernel resolve?
O truque do kernel mapeia implicitamente os dados em um espaço de dimensão superior onde funciona um limite reto, permitindo separações curvas de maneira barata.
O que o parâmetro C controla em um SVM de margem flexível?
C equilibra ter uma grande margem para não permitir alguns erros de treinamento; C pequeno significa uma margem mais ampla e mais tolerante.
Qual kernel é comumente usado para criar limites curvos e flexíveis?
O kernel RBF (Gaussiano) é um padrão popular que mede a similaridade com base na distância, permitindo limites não lineares suaves.