Als nächstesNächster Leitfaden
Siamesische Netzwerke und Triplettverlust
Technisch
Technischer Leitfaden
Der Fokusverlust ist eine modifizierte Verlustfunktion, die einfache Beispiele herabsetzt, sodass sich ein Detektor auf die schwierigen, seltenen Beispiele konzentrieren kann.
It solved the extreme background-versus-object imbalance that crippled one-stage object detectors.
Bei der Objekterkennung enthält ein Bild möglicherweise nur wenige reale Objekte, aber Zehntausende Kandidatenorte, von denen fast alle einfache Hintergrundobjekte sind. Bei der Standard-Kreuzentropie dominiert diese Flut einfacher Negative den Gradienten und übertönt die seltenen Positiven. Der im RetinaNet-Artikel 2017 von Lin und Kollegen von Facebook AI eingeführte Fokusverlust behebt dieses Problem durch Multiplikation der Kreuzentropie mit einem Faktor (1 – p_t)^gamma. Wenn eine Stichprobe sicher und korrekt klassifiziert wird, liegt p_t nahe 1, sodass der Faktor gegen Null schrumpft und das gut klassifizierte Beispiel kaum einen Beitrag leistet. Harte, falsch klassifizierte Beispiele behalten nahezu ihr volles Gewicht. Mit einem Gammawert von etwa 2 konnte RetinaNet langsamere zweistufige Detektoren wie Faster R-CNN erreichen oder sogar übertreffen, blieb aber ein einfaches Single-Pass-Netzwerk.
Architekturentscheidungen beeinflussen über Jahre hinweg die Leistung und die Betriebskosten.
Technische Schulungen helfen Teams dabei, den richtigen Stack auszuwählen, nicht nur den neuesten.
Bessere technische Entscheidungen reduzieren Zuverlässigkeitsvorfälle in der Produktion.
Der Fokusverlust ist weit über RetinaNet hinaus zu einem Standardbestandteil geworden und tritt in Detektoren wie FCOS, bei der Segmentierung und bei der Long-Tail-Klassifizierung auf. Varianten wie Qualitätsfokusverlust, Verteilungsfokusverlust und Varifokalverlust verfeinern es für moderne ankerfreie und transformatorbasierte Detektoren. Da sich die Erkennung hin zu Set-Prediction-Modellen wie DETR verlagert, die bipartite Matchings verwenden, bleibt die fokale Neugewichtung ein praktisches Werkzeug, wenn die Klassenhäufigkeiten stark verzerrt sind.
Erkennen kleiner Verkehrsschilder oder entfernter Fußgänger in autonomen Fahrbildern, in denen die meisten Pixel im Hintergrund liegen.
Auffinden seltener Tumore oder Läsionen in medizinischen Scans, bei denen gesundes Gewebe vorherrscht.
Erkennen von Mängeln an einer Fertigungslinie, bei der die überwiegende Mehrheit der geprüften Teile normal ist.
Identifizieren kleiner Schiffe oder Fahrzeuge in großen Satelliten- und Luftbildern.
Die Optimierung eines Benchmarks kann umfassendere Systemschwächen verbergen.
Infrastruktur- und Wartungskosten werden oft unterschätzt.
Sicherheits- und Beobachtbarkeitslücken können größer werden, wenn die Systeme komplexer werden.
Definieren Sie vor der Implementierung Latenz-, Qualitäts- und Kostenziele.
Benchmark unter realistischen Last- und Datenbedingungen.
Instrumentenüberwachung auf Fehler, Drift und Benutzereinflüsse.
Bereiten Sie vor der Skalierung Rollback- und Incident-Response-Pfade vor.
Free newsletter
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Der Fokusverlust ist eine modifizierte Verlustfunktion, die einfache Beispiele herabsetzt, sodass sich ein Detektor auf die schwierigen, seltenen Beispiele konzentrieren kann. Es löste das extreme Ungleichgewicht zwischen Hintergrund und Objekt, das einstufige Objektdetektoren lahmlegte.
Bei der dichten Erkennung sind einfache Hintergrundbeispiele weitaus zahlreicher als reale Objekte und dominieren den Standard-Kreuzentropiegradienten. Fokusverluste werden so selten neu gewichtet, dass harte Beispiele mehr zählen.
Der Fokusverlust beträgt -(1 - p_t)^gamma * log(p_t). Für zuverlässig korrekte Vorhersagen schrumpft der (1 - p_t)^Gamma-Term gegen Null.
Bei Gamma = 0 ist der Faktor (1 - p_t)^0 gleich 1, sodass der Fokusverlust genau auf die Standard-Kreuzentropie reduziert wird.
Ein höherer Gammawert führt dazu, dass der (1 - p_t)^Gamma-Term bei hohem p_t schneller schrumpft, sodass einfache Beispiele noch weniger zum Verlust und zum Gradienten beitragen.
Der Fokusverlust wurde im RetinaNet-Artikel von 2017 eingeführt, wodurch ein einstufiger Detektor mit präzisen zweistufigen Methoden konkurrieren kann.
Lerne weiter
Weitere Leitfäden zu diesem Thema ausgewählt
Als nächstesNächster Leitfaden
Siamesische Netzwerke und Triplettverlust
Technisch