PANDUAN Dasar

Matriks Kebingungan

Matriks konfusi adalah tabel sederhana yang memecah prediksi pengklasifikasi menjadi hitungan benar dan salah untuk setiap kelas.

2 min readTerakhir diperbarui

Ikhtisar

It is the raw scoreboard from which nearly every other classification metric is calculated.

Menyelam Lebih Dalam

Matriks konfusi adalah kisi yang membandingkan label prediksi dengan label sebenarnya. Untuk klasifikasi biner, ia mempunyai empat sel: True Positives (prediksi positif yang benar), True Negatives (negatif yang diprediksi dengan benar), False Positives (negatif yang salah ditandai sebagai positif, 'kesalahan Tipe I'), dan False Negatives (positif yang terlewat, 'kesalahan Tipe II'). Dari keempat angka ini Anda memperoleh akurasi ((TP+TN)/total), presisi (TP/(TP+FP)), perolehan atau sensitivitas (TP/(TP+FN)), spesifisitas (TN/(TN+FP)), dan skor F1 (rata-rata harmonik dari presisi dan perolehan). Untuk soal dengan lebih dari dua kelas, matriksnya menjadi N-kali-N, dengan diagonal yang menyimpan prediksi yang benar dan sel di luar diagonal menunjukkan dengan tepat kelas mana yang membingungkan kelas mana yang lain.

Wawasan Teknis

Kekuatan matriks adalah mempertahankan struktur kesalahan yang disembunyikan oleh satu angka akurasi. Dua model dengan akurasi 90% yang identik dapat memiliki tingkat negatif palsu yang sangat berbeda, yang sangat penting ketika diagnosis kanker yang terlewat membutuhkan biaya yang lebih besar daripada alarm palsu. Berdasarkan konvensi, baris sering kali mewakili kelas yang sebenarnya dan kolom kelas yang diprediksi (walaupun beberapa perpustakaan membaliknya), jadi selalu periksa label sumbu sebelum menghitung presisi versus perolehan dari sel.

Dampak Strategis

Clearer decisions

Ini membantu Anda memisahkan klaim teknis yang jelas dari bahasa pemasaran.

Cost and budget

Anda dapat mengajukan pertanyaan implementasi yang lebih baik sebelum mengeluarkan uang atau waktu.

Team and workflow

Tim dengan pemahaman bersama membuat keputusan produk, kebijakan, dan pembelajaran yang lebih baik.

Matriks Kebingungan Masa Depan

Matriks kebingungan akan tetap menjadi dasar, namun perkakas membuatnya lebih kaya: peta panas yang interaktif dan dinormalisasi, pengelompokan per kelas untuk kumpulan label besar, dan matriks tertimbang biaya yang mengalikan setiap jenis kesalahan dengan penalti sebenarnya. Dalam audit keadilan, para praktisi sekarang menghitung matriks kebingungan yang terpisah per subkelompok demografis untuk mengungkap tingkat kesalahan yang tidak sama. Harapkan integrasi berkelanjutan ke dasbor model di mana mengklik sel akan memunculkan contoh sebenarnya yang salah klasifikasi untuk diperiksa.

Implementasi Dunia Nyata

Mendiagnosis kegagalan pengklasifikasi gambar dengan melihat bahwa pengklasifikasi gambar sering membingungkan husky dengan serigala di sel di luar diagonal

Mengaudit alat pemeriksaan medis dengan memeriksa negatif palsu — pasien dengan penyakit yang dinyatakan sehat oleh model

Membandingkan dua filter spam email yang memiliki akurasi yang sama tetapi berbeda dalam jumlah email asli yang salah diblokir (positif palsu)

Mengevaluasi pengenal digit tulisan tangan kelas jamak untuk menemukan bahwa angka 4 dan 9 paling sering disalahartikan satu sama lain

Risiko & Pagar Pembatas

Tim yang berbeda mungkin menggunakan istilah yang sama secara berbeda, jadi tentukan cakupannya sejak dini.

Tolok ukur dapat terlihat kuat sementara kinerja di dunia nyata tidak merata.

Mengabaikan kualitas data dan rencana evaluasi sering kali menimbulkan hasil yang rapuh.

Peta Jalan Implementasi

1

Mulailah dengan definisi bahasa sederhana tentang hasil yang Anda butuhkan.

2

Pilih satu metrik keberhasilan dan satu kondisi kegagalan sebelum pengujian.

3

Jalankan uji coba kecil dengan data yang representatif, bukan kumpulan demo yang disempurnakan.

4

Dokumentasikan di mana Confusion Matrices membantu dan di mana metode yang lebih sederhana lebih baik.

Terus Menjelajah

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Confusion Matrices quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Mulai kuis

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Next guide

Validasi Silang

Pertanyaan yang sering diajukan

What is Confusion Matrices?

Matriks konfusi adalah tabel sederhana yang memecah prediksi pengklasifikasi menjadi hitungan benar dan salah untuk setiap kelas. Ini adalah papan skor mentah tempat hampir semua metrik klasifikasi lainnya dihitung.

Dalam matriks kebingungan biner, apa yang dimaksud dengan False Negative?

False Negative adalah positif aktual yang dilewatkan oleh model dengan memberi label negatif — misalnya, pasien yang sakit dinyatakan sehat.

Metrik manakah yang mengukur proporsi positif aktual yang diidentifikasi dengan benar oleh model?

Penarikan kembali (juga disebut sensitivitas atau tingkat positif sebenarnya) adalah TP / (TP + FN) — bagian dari hal positif nyata yang ditangkap oleh model.

Dalam matriks konfusi untuk masalah dengan 5 kelas, apa yang diwakili oleh sel diagonal?

Dalam matriks N-kali-N, diagonalnya menampung kasus-kasus di mana kelas yang diprediksi cocok dengan kelas sebenarnya — yaitu prediksi yang benar.

Mengapa akurasi saja bisa menyesatkan tanpa matriks kebingungan?

Dua model dengan akurasi yang sama dapat mendistribusikan kesalahannya dengan sangat berbeda; matriks kebingungan memperlihatkan apakah sebagian besar kesalahan merupakan alarm palsu atau kesalahan positif yang terlewat.

Skor F1 merupakan rata-rata harmonis dari dua metrik yang mana?

F1 menggabungkan presisi dan perolehan menjadi satu angka menggunakan mean harmonik, yang menyebabkan ketidakseimbangan besar di antara keduanya.