Wsparcie maszyn wektorowych
Maszyna wektorów nośnych (SVM) to klasyczny algorytm oddzielający dwie grupy poprzez narysowanie między nimi możliwie najszerszej granicy.
Przegląd
Był to jeden z najpotężniejszych klasyfikatorów przed głębokim uczeniem się i nadal świetnie sprawdza się w przypadku małych, czystych zbiorów danych.
Głębokie nurkowanie
SVM znajduje granicę decyzyjną, zwaną hiperpłaszczyzną, która maksymalizuje margines, czyli odstęp między granicą a najbliższymi punktami danych każdej klasy. Te najbliższe punkty to „wektory wsparcia” i one same definiują granicę, co sprawia, że model jest zwarty i odporny na wartości odstające daleko od krawędzi. Kiedy danych nie można podzielić linią prostą, sztuczka jądra odwzorowuje je w przestrzeni o wyższych wymiarach, w której istnieje czysta separacja, bez bezpośredniego obliczania tych współrzędnych. Miękki margines pozwala na pewne błędne klasyfikacje, kontrolowane przez parametr C, więc model równoważy szeroki margines z błędami uczenia. Maszyny SVM wyróżniają się, gdy funkcji jest wiele, ale przykładów jest niewiele, na przykład w klasyfikacji tekstu i bioinformatyce.
Wgląd techniczny
Maksymalizacja marginesu jest problemem optymalizacji wypukłej, dlatego maszyny SVM mają jedno globalne maksimum, w przeciwieństwie do sieci neuronowych. Sztuczka z jądrem zastępuje iloczyny skalarne między punktami danych funkcją jądra, taką jak radialna funkcja bazowa (RBF) lub jądro wielomianowe, które w sposób ukryty oblicza podobieństwo w przestrzeni o wyższych wymiarach. Dzięki temu metoda liniowa pozwala tanio rysować zakrzywione granice. W tuningu dominują dwa hiperparametry: C, który uwzględnia szerokość marginesu w stosunku do błędów, oraz gamma w jądrze RBF, które określa, jak daleko sięga wpływ każdego punktu.
Wpływ strategiczny
Jaśniejsze decyzje
Pomaga oddzielić jasne twierdzenia techniczne od języka marketingowego.
Koszt i budżet
Możesz zadawać pytania dotyczące lepszego wdrożenia, zanim wydasz pieniądze lub czas.
Zespół i przepływ pracy
Zespoły charakteryzujące się wspólnym zrozumieniem podejmują lepsze decyzje dotyczące produktów, zasad i uczenia się.
Przyszłość maszyn wektorów nośnych
Maszyny SVM zostały w dużej mierze wyprzedzone przez głębokie uczenie się i drzewa wzmocnione gradientem dla dużych, złożonych zbiorów danych, ale pozostają niezawodnym wyborem, gdy danych jest mało, są one wielowymiarowe lub wymagają silnej, dobrze zrozumiałej linii bazowej. Są one powszechnie stosowane w nauczaniu, w zadaniach z zakresu bioinformatyki i tekstu, a także w środowiskach o ograniczonych zasobach, gdzie mały, szybki model pokonuje ciężką sieć. Można się spodziewać, że SVM pozostaną niezawodnym, klasycznym narzędziem i punktem odniesienia, a nie granicą nowych badań.
Implementacja w świecie rzeczywistym
Klasyfikacja tekstu i spamu, gdzie dokumenty zawierają tysiące elementów słownych, ale ograniczoną liczbę przykładów.
Klasyfikacja obrazów w małych zbiorach danych, zanim dominowało głębokie uczenie się.
Klasyfikacja nowotworów i ekspresji genów w bioinformatyce z wieloma cechami i kilkoma próbkami.
Rozpoznawanie cyfr odręcznych, klasyczny test porównawczy SVM w zbiorze danych MNIST.
Zagrożenia i poręcze
Różne zespoły mogą odmiennie używać tego samego terminu, dlatego należy wcześniej zdefiniować zakres.
Testy porównawcze mogą wyglądać dobrze, podczas gdy wydajność w świecie rzeczywistym jest nierówna.
Ignorowanie planów dotyczących jakości danych i oceny często skutkuje kruchymi wynikami.
Plan wdrożenia
Zacznij od jasnej definicji potrzebnego wyniku.
Przed testowaniem wybierz jedną metrykę sukcesu i jeden warunek niepowodzenia.
Przeprowadź mały pilotaż z reprezentatywnymi danymi, a nie dopracowanym zestawem demonstracyjnym.
Dokument, w którym pomagają maszyny wektorów nośnych i gdzie lepsze są prostsze metody.
Odkrywaj dalej
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Support Vector Machines quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Następny poradnik
Podstawy uczenia maszynowego
Często zadawane pytania
Co to są maszyny wektorów nośnych?
Maszyna wektorów nośnych (SVM) to klasyczny algorytm oddzielający dwie grupy poprzez narysowanie między nimi możliwie najszerszej granicy. Był to jeden z najpotężniejszych klasyfikatorów przed głębokim uczeniem się i nadal świetnie sprawdza się w przypadku małych, czystych zbiorów danych.
Co maszyna wektorów nośnych stara się maksymalizować?
SVM znajduje hiperpłaszczyznę, która maksymalizuje margines, czyli odległość do najbliższych punktów każdej klasy, w celu uzyskania najbardziej niezawodnej separacji.
Jakie są „wektory wsparcia” w SVM?
Tylko punkty najbliższe granicy, wektory podporowe, wyznaczają hiperpłaszczyznę; inne punkty mogą się przesuwać bez zmiany tego.
Jaki problem rozwiązuje sztuczka z jądrem?
Sztuczka jądra pośrednio odwzorowuje dane na przestrzeń o wyższych wymiarach, w której działa prosta granica, umożliwiając tanio zakrzywione separacje.
Co kontroluje parametr C w maszynie SVM z miękką marżą?
C równoważy mający duży margines przed dopuszczaniem pewnych błędów szkoleniowych; małe C oznacza szerszy, bardziej tolerancyjny margines.
Które jądro jest powszechnie używane do tworzenia elastycznych, zakrzywionych granic?
Jądro RBF (Gaussa) to popularne rozwiązanie domyślne, które mierzy podobieństwo na podstawie odległości, umożliwiając gładkie nieliniowe granice.