बुनियादी गाइड

कन्फ्यूजन मैट्रिक्स

कन्फ्यूजन मैट्रिक्स एक सरल तालिका है जो क्लासिफायरियर की भविष्यवाणियों को प्रत्येक वर्ग के लिए सही और गलत गणनाओं में तोड़ देती है।

2 मिनट लालअंतिम बार अद्यतन किया गया

सिंहावलोकन

It is the raw scoreboard from which nearly every other classification metric is calculated.

गहरा गोता

कन्फ्यूजन मैट्रिक्स एक ग्रिड है जो पूर्वानुमानित लेबलों की तुलना वास्तविक लेबलों से करता है। बाइनरी वर्गीकरण के लिए इसमें चार सेल हैं: सही सकारात्मक (सही ढंग से अनुमानित सकारात्मक), सही नकारात्मक (सही ढंग से अनुमानित नकारात्मक), गलत सकारात्मक (नकारात्मक को गलत तरीके से चिह्नित सकारात्मक, एक 'टाइप I त्रुटि'), और गलत नकारात्मक (सकारात्मक जो छूट गए, एक 'टाइप II त्रुटि')। इन चार नंबरों से आप सटीकता ((टीपी+टीएन)/कुल), सटीकता (टीपी/(टीपी+एफपी)), रिकॉल या संवेदनशीलता (टीपी/(टीपी+एफएन)), विशिष्टता (टीएन/(टीएन+एफपी)), और एफ1 स्कोर (परिशुद्धता और रिकॉल का हार्मोनिक माध्य) प्राप्त करते हैं। दो से अधिक वर्गों वाली समस्याओं के लिए, मैट्रिक्स एन-बाय-एन बन जाता है, जहां विकर्ण सही भविष्यवाणियां रखता है और ऑफ-विकर्ण कोशिकाएं वास्तव में बताती हैं कि कौन से वर्ग दूसरों के लिए भ्रमित हो जाते हैं।

तकनीकी अंतर्दृष्टि

मैट्रिक्स की शक्ति यह है कि यह त्रुटियों की संरचना को संरक्षित करता है जिसे एक सटीकता संख्या छुपाती है। समान 90% सटीकता वाले दो मॉडलों में बेतहाशा भिन्न गलत-नकारात्मक दरें हो सकती हैं, जो तब बहुत मायने रखती है जब कैंसर के गलत निदान की लागत गलत अलार्म से अधिक हो। परंपरा के अनुसार पंक्तियाँ अक्सर वास्तविक वर्गों और स्तंभों द्वारा अनुमानित वर्गों का प्रतिनिधित्व करती हैं (हालाँकि कुछ पुस्तकालय इसे उलट देते हैं), इसलिए कोशिकाओं से सटीकता बनाम रिकॉल की गणना करने से पहले हमेशा अक्ष लेबल की जाँच करें।

सामरिक प्रभाव

स्पष्ट निर्णय

यह आपको स्पष्ट तकनीकी दावों को मार्केटिंग भाषा से अलग करने में मदद करता है।

लागत और बजट

आप पैसा या समय खर्च करने से पहले बेहतर कार्यान्वयन संबंधी प्रश्न पूछ सकते हैं।

टीम और वर्कफ़्लो

साझा समझ वाली टीमें बेहतर उत्पाद, नीति और सीखने के निर्णय लेती हैं।

कन्फ्यूजन मैट्रिसेस का भविष्य

कन्फ्यूजन मैट्रिक्स मूलभूत बने रहेंगे, लेकिन टूलींग उन्हें समृद्ध बना रही है: इंटरैक्टिव, सामान्यीकृत हीटमैप, बड़े लेबल सेट के लिए प्रति-वर्ग ब्रेकडाउन, और लागत-भारित मैट्रिक्स जो प्रत्येक त्रुटि प्रकार को उसके वास्तविक-विश्व दंड से गुणा करते हैं। निष्पक्षता ऑडिटिंग में, व्यवसायी अब असमान त्रुटि दरों को उजागर करने के लिए प्रति जनसांख्यिकीय उपसमूह में अलग-अलग भ्रम मैट्रिक्स की गणना करते हैं। मॉडल डैशबोर्ड में निरंतर एकीकरण की अपेक्षा करें जहां सेल पर क्लिक करने से निरीक्षण के लिए वास्तविक गलत वर्गीकृत उदाहरण सामने आते हैं।

वास्तविक विश्व कार्यान्वयन

यह देखकर निदान करना कि एक छवि वर्गीकरणकर्ता विफल हो जाता है, यह अक्सर ऑफ-विकर्ण कोशिकाओं में भेड़ियों के साथ पतियों को भ्रमित करता है

झूठी नकारात्मकताओं की जांच करके एक मेडिकल स्क्रीनिंग टूल का ऑडिट करना - जिस बीमारी से ग्रस्त मरीजों को मॉडल ने स्वस्थ घोषित किया है

दो ईमेल स्पैम फ़िल्टर की तुलना करना जो समान सटीकता साझा करते हैं लेकिन कितने वास्तविक ईमेल को गलत तरीके से ब्लॉक करते हैं, इसमें भिन्नता है (झूठी सकारात्मक)

बहु-श्रेणी हस्तलिखित-अंक पहचानकर्ता का मूल्यांकन करके यह पता लगाना कि 4s और 9s को अक्सर एक-दूसरे के लिए गलत माना जाता है

जोखिम और रेलिंग

अलग-अलग टीमें एक ही शब्द का अलग-अलग इस्तेमाल कर सकती हैं, इसलिए दायरे को पहले ही परिभाषित कर लें।

बेंचमार्क मजबूत दिख सकते हैं जबकि वास्तविक दुनिया का प्रदर्शन असमान है।

डेटा गुणवत्ता और मूल्यांकन योजनाओं की अनदेखी अक्सर नाजुक परिणाम पैदा करती है।

कार्यान्वयन रोडमैप

1

आपको जिस परिणाम की आवश्यकता है उसकी सरल भाषा में परिभाषा से शुरुआत करें।

2

परीक्षण से पहले एक सफलता मीट्रिक और एक विफलता स्थिति चुनें।

3

प्रतिनिधि डेटा के साथ एक छोटा पायलट चलाएँ, न कि एक परिष्कृत डेमो सेट।

4

दस्तावेज़ जहां कन्फ्यूजन मैट्रिसेस मदद करता है और जहां सरल तरीके बेहतर हैं।

अन्वेषण करते रहें

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Confusion Matrices quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

प्रश्नोत्तरी प्रारंभ करें

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

अक्सर पूछे जाने वाले प्रश्नों

What is Confusion Matrices?

कन्फ्यूजन मैट्रिक्स एक सरल तालिका है जो क्लासिफायरियर की भविष्यवाणियों को प्रत्येक वर्ग के लिए सही और गलत गणनाओं में तोड़ देती है। यह कच्चा स्कोरबोर्ड है जिससे लगभग हर अन्य वर्गीकरण मीट्रिक की गणना की जाती है।

बाइनरी कन्फ्यूजन मैट्रिक्स में, गलत नकारात्मक क्या है?

एक गलत नकारात्मक एक वास्तविक सकारात्मक है जिसे मॉडल नकारात्मक लेबल करने से चूक गया - उदाहरण के लिए, एक बीमार रोगी को स्वस्थ घोषित किया गया।

कौन सा मीट्रिक वास्तविक सकारात्मकता के अनुपात को मापता है जिसे मॉडल सही ढंग से पहचानता है?

स्मरण करो (जिसे संवेदनशीलता या वास्तविक सकारात्मक दर भी कहा जाता है) टीपी / (टीपी + एफएन) है - मॉडल द्वारा पकड़ी गई वास्तविक सकारात्मकता का हिस्सा।

5 वर्गों वाली किसी समस्या के लिए भ्रम मैट्रिक्स में, विकर्ण कोशिकाएँ क्या दर्शाती हैं?

एन-बाय-एन मैट्रिक्स में विकर्ण उन मामलों को रखता है जहां अनुमानित वर्ग वास्तविक वर्ग से मेल खाता है - यानी, सही भविष्यवाणियां।

भ्रम मैट्रिक्स के बिना अकेले सटीकता भ्रामक क्यों हो सकती है?

समान सटीकता वाले दो मॉडल अपनी त्रुटियों को बहुत अलग तरीके से वितरित कर सकते हैं; भ्रम मैट्रिक्स यह उजागर करता है कि क्या त्रुटियाँ अधिकतर गलत अलार्म हैं या छूटी हुई सकारात्मकताएँ हैं।

F1 स्कोर किन दो मेट्रिक्स का हार्मोनिक माध्य है?

एफ1 हार्मोनिक माध्य का उपयोग करके सटीकता और रिकॉल को एक संख्या में जोड़ता है, जो दोनों के बीच बड़े असंतुलन को दंडित करता है।