Kostenlose KI-Bibliothek

Visuelle KI FührerFür immer kostenlos.

133 Leitfäden in einfachem Englisch, strukturierte Lernpfade und eine offene Bibliothek – erstellt von einer unabhängigen gemeinnützigen Organisation 501(c)(3), damit jeder moderne KI verstehen kann.

133Kostenlose Reiseführer
1Themenspuren
~2 minPro Reiseführer
~4hLesezeit

Beginnen Sie hier

Fünf ergebnisorientierte Kurse

Jeder Kurs umfasst explizite Ergebnisse, abgebildete Kompetenzen, Übungsaktivitäten und einen angewandten Schlussstein.

Themenspuren

Nach Titel durchsuchen

Springen Sie in den Bereich, der Ihnen am Herzen liegt. Zu jedem Titel gibt es mehrere leicht verständliche Anleitungen.

Vollständige Bibliothek

Alle Führer

133 von 1019 Anleitungen angezeigt. Filtern Sie nach Titel oder suchen Sie oben.

Visuelle KI

Ungepaarte CycleGAN-Übersetzung

CycleGAN lernt, Bilder zwischen zwei visuellen Bereichen (z. B. Pferden in Zebras oder Fotos in Gemälden) zu übersetzen, ohne dass jemals ein Vorher-Nachher-Abgleich erforderlich ist ...

2 Min. gelesenLesen
Visuelle KI

SPADE Semantische Bildsynthese

SPADE (Räumlich-Adaptive Normalisierung) verwandelt ein einfaches beschriftetes Layout, wie eine Malbuchkarte für Kinder mit „Himmel hier, Gras dort, Baum hier“ …

2 Min. gelesenLesen
Visuelle KI

Interaktive DragGAN-Bearbeitung

Mit DragGAN können Sie ein Bild bearbeiten, indem Sie buchstäblich Punkte ziehen: Nehmen Sie einen Punkt und ziehen Sie ihn zu einem Ziel, und das Bild verformt sich realistisch und ändert seine Pose ...

2 Min. gelesenLesen
Visuelle KI

Diffusionstransformatoren

Diffusion Transformers (DiTs) tauschen das Faltungs-U-Net, das Herzstück von Bild- und Videogeneratoren, gegen ein Transformer-Backbone.

2 Min. gelesenLesen
Visuelle KI

Feature-Pyramiden-Netzwerke

Feature Pyramid Networks (FPN) ermöglichen es Detektoren, Objekte in völlig unterschiedlichen Größen zu erkennen, indem sie kostengünstig eine mehrskalige „Pyramide“ von Features aufbauen.

2 Min. gelesenLesen
Visuelle KI

Nicht maximale Unterdrückung

Non-Maximum Suppression (NMS) ist der Bereinigungsschritt, der einen unordentlichen Stapel überlappender Erkennungsboxen in eine aufgeräumte Box pro Objekt verwandelt.

2 Min. gelesenLesen
Visuelle KI

Räumliche Transformatornetzwerke

Spatial Transformer Networks (STNs) sind erlernbare Module, die es einem neuronalen Netzwerk ermöglichen, seine Eingaben aktiv zu verzerren, zu drehen, zuzuschneiden oder neu zu skalieren, um sich auf das zu konzentrieren, was…

2 Min. gelesenLesen
Visuelle KI

Schätzung der Stereotiefe

Die Stereo-Tiefenschätzung stellt die Entfernung von Objekten wieder her, indem sie zwei leicht versetzte Kameraansichten vergleicht, genau wie Ihre beiden Augen.

2 Min. gelesenLesen
Visuelle KI

Punktwolkenverarbeitung

Eine Punktwolke ist eine Reihe von 3D-Punkten (X, Y, Z), die die Form realer Objekte und Räume erfassen, häufig von LiDAR oder Tiefensensoren.

2 Min. gelesenLesen
Visuelle KI

Vorzeichenbehaftete Distanzfunktionen

Eine vorzeichenbehaftete Distanzfunktion (SDF) beschreibt eine 3D-Form, indem sie Ihnen für jeden Punkt im Raum angibt, wie weit er von der nächsten Oberfläche entfernt ist, mit einem Vorzeichen, das besagt ...

2 Min. gelesenLesen
Visuelle KI

Verformbare Windungen

Durch verformbare Faltungen kann ein neuronales Netzwerk sein Abtastgitter biegen, um der tatsächlichen Form von Objekten zu folgen, anstatt es durch ein starres quadratisches Fenster zu zwingen.

2 Min. gelesenLesen
Visuelle KI

DINO Selbstdestillation

DINO ist eine selbstüberwachte Methode, die einem Vision-Transformer beibringt, Bilder ohne jegliche Beschriftung zu verstehen, indem das Netzwerk sich selbst beibringt.

2 Min. gelesenLesen

Mit dem Lesen fertig? Beweisen Sie es.

Überprüfen Sie anhand von Themenquiz, was Sie gelernt haben, und erkunden Sie anschließend unsere strukturierten Kurse und aktuellen Zertifizierungsanforderungen. Die wichtigsten Leitfäden bleiben weiterhin frei lesbar.

Visual AI AI Guides — Page 3 of 12 | AI Understanding