PANDUAN Dasar

Mendukung Mesin Vektor

Mesin vektor dukungan (SVM) adalah algoritma klasik yang memisahkan dua kelompok dengan menggambar batas seluas mungkin di antara keduanya.

2 min readTerakhir diperbarui

Ikhtisar

It was one of the most powerful classifiers before deep learning and is still strong on small, clean datasets.

Menyelam Lebih Dalam

SVM menemukan batas keputusan, yang disebut hyperplane, yang memaksimalkan margin, kesenjangan antara batas dan titik data terdekat dari setiap kelas. Titik-titik terdekat tersebut adalah 'vektor pendukung', dan titik-titik tersebutlah yang menentukan batasnya, sehingga membuat model menjadi kompak dan tahan terhadap outlier yang jauh dari tepinya. Ketika data tidak dapat dipisahkan berdasarkan garis lurus, trik kernel memetakannya ke dalam ruang berdimensi lebih tinggi di mana terdapat pemisahan yang bersih, tanpa pernah menghitung koordinat tersebut secara langsung. Margin lunak memungkinkan beberapa kesalahan klasifikasi, dikontrol oleh parameter C, sehingga model menyeimbangkan margin lebar terhadap kesalahan pelatihan. SVM unggul ketika fiturnya banyak tetapi contohnya sedikit, seperti dalam klasifikasi teks dan bioinformatika.

Wawasan Teknis

Memaksimalkan margin adalah masalah optimasi cembung, sehingga SVM memiliki satu optimal global, tidak seperti jaringan saraf. Trik kernel menggantikan perkalian titik antara titik data dengan fungsi kernel, seperti fungsi basis radial (RBF) atau kernel polinomial, yang menghitung kesamaan dalam ruang berdimensi lebih tinggi secara implisit. Hal ini memungkinkan metode linier menggambar batas lengkung dengan biaya murah. Dua hyperparameter mendominasi penyetelan: C, yang memperdagangkan lebar margin dengan kesalahan, dan gamma di kernel RBF, yang menentukan seberapa jauh jangkauan pengaruh setiap titik.

Dampak Strategis

Clearer decisions

Ini membantu Anda memisahkan klaim teknis yang jelas dari bahasa pemasaran.

Cost and budget

Anda dapat mengajukan pertanyaan implementasi yang lebih baik sebelum mengeluarkan uang atau waktu.

Team and workflow

Tim dengan pemahaman bersama membuat keputusan produk, kebijakan, dan pembelajaran yang lebih baik.

Masa Depan Mesin Vektor Dukungan

SVM sebagian besar telah digantikan oleh pembelajaran mendalam dan pohon yang ditingkatkan gradien untuk kumpulan data yang besar dan kompleks, namun SVM tetap menjadi pilihan yang dapat diandalkan ketika data langka, berdimensi tinggi, atau memerlukan dasar yang kuat dan dipahami dengan baik. Mereka tetap umum dalam pengajaran, dalam bioinformatika dan tugas teks, dan dalam lingkungan terbatas sumber daya di mana model yang kecil dan cepat mengalahkan jaringan yang berat. Harapkan SVM untuk bertahan sebagai alat klasik yang andal dan tolok ukur, bukan sebagai garda depan penelitian baru.

Implementasi Dunia Nyata

Klasifikasi teks dan spam, di mana dokumen memiliki ribuan fitur kata tetapi contohnya terbatas.

Klasifikasi gambar pada kumpulan data kecil sebelum pembelajaran mendalam menjadi dominan.

Klasifikasi kanker dan ekspresi gen dalam bioinformatika dengan banyak fitur dan sedikit sampel.

Pengenalan digit tulisan tangan, tolok ukur SVM klasik pada kumpulan data MNIST.

Risiko & Pagar Pembatas

Tim yang berbeda mungkin menggunakan istilah yang sama secara berbeda, jadi tentukan cakupannya sejak dini.

Tolok ukur dapat terlihat kuat sementara kinerja di dunia nyata tidak merata.

Mengabaikan kualitas data dan rencana evaluasi sering kali menimbulkan hasil yang rapuh.

Peta Jalan Implementasi

1

Mulailah dengan definisi bahasa sederhana tentang hasil yang Anda butuhkan.

2

Pilih satu metrik keberhasilan dan satu kondisi kegagalan sebelum pengujian.

3

Jalankan uji coba kecil dengan data yang representatif, bukan kumpulan demo yang disempurnakan.

4

Dokumentasikan di mana Support Vector Machines membantu dan di mana metode yang lebih sederhana lebih baik.

Terus Menjelajah

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Support Vector Machines quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Mulai kuis

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Next guide

Dasar-dasar Pembelajaran Mesin

Pertanyaan yang sering diajukan

What is Support Vector Machines?

Mesin vektor dukungan (SVM) adalah algoritma klasik yang memisahkan dua kelompok dengan menggambar batas seluas mungkin di antara keduanya. Ini adalah salah satu pengklasifikasi paling kuat sebelum pembelajaran mendalam dan masih kuat pada kumpulan data kecil dan bersih.

Apa yang coba dimaksimalkan oleh mesin vektor dukungan?

SVM menemukan hyperplane yang memaksimalkan margin, yaitu jarak ke titik terdekat dari setiap kelas, untuk pemisahan yang paling kuat.

Apa yang dimaksud dengan 'vektor dukungan' dalam SVM?

Hanya titik-titik yang paling dekat dengan batas, yaitu vektor-vektor pendukung, yang menentukan hyperplane; titik lain dapat berpindah tanpa mengubahnya.

Masalah apa yang dipecahkan oleh trik kernel?

Trik kernel secara implisit memetakan data ke dalam ruang berdimensi lebih tinggi tempat batas lurus berfungsi, memungkinkan pemisahan melengkung dengan biaya murah.

Apa yang dikontrol parameter C dalam SVM margin lunak?

Saldo C memiliki margin besar untuk tidak membiarkan beberapa kesalahan pelatihan; C kecil berarti margin yang lebih luas dan lebih toleran.

Kernel manakah yang biasa digunakan untuk membuat batas yang fleksibel dan melengkung?

Kernel RBF (Gaussian) adalah default populer yang mengukur kesamaan berdasarkan jarak, memungkinkan batas nonlinier yang mulus.