Kostenlose KI-Bibliothek

Visuelle KI FührerFür immer kostenlos.

133 Leitfäden in einfachem Englisch, strukturierte Lernpfade und eine offene Bibliothek – erstellt von einer unabhängigen gemeinnützigen Organisation 501(c)(3), damit jeder moderne KI verstehen kann.

133Kostenlose Reiseführer
1Themenspuren
~2 minPro Reiseführer
~4hLesezeit

Beginnen Sie hier

Fünf ergebnisorientierte Kurse

Jeder Kurs umfasst explizite Ergebnisse, abgebildete Kompetenzen, Übungsaktivitäten und einen angewandten Schlussstein.

Themenspuren

Nach Titel durchsuchen

Springen Sie in den Bereich, der Ihnen am Herzen liegt. Zu jedem Titel gibt es mehrere leicht verständliche Anleitungen.

Vollständige Bibliothek

Alle Führer

133 von 1019 Anleitungen angezeigt. Filtern Sie nach Titel oder suchen Sie oben.

Visuelle KI

Neuronale Strahlungsfelder

Neural Radiance Fields (NeRF) rekonstruieren eine vollständige 3D-Szene aus einer Handvoll gewöhnlicher Fotos und ermöglichen es Ihnen, die Kamera zu völlig neuen Blickwinkeln zu fliegen.

2 Min. gelesenLesen
Visuelle KI

Gaußsches Splatting

Gaussian Splatting stellt eine 3D-Szene als Millionen winziger, farbiger, halbtransparenter Kleckse dar, die in Echtzeit gerendert werden können.

2 Min. gelesenLesen
Visuelle KI

Maskierte Autoencoder

Maskierte Autoencoder (MAE) sind eine selbstüberwachte Methode, die einem Sehmodell beibringt, Bilder zu rekonstruieren, nachdem der größte Teil des Bildes ausgeblendet wurde.

2 Min. gelesenLesen
Visuelle KI

Bildunterschrift

Bei der Bildunterschrift handelt es sich um die Aufgabe, automatisch einen Satz in natürlicher Sprache zu generieren, der den Inhalt eines Bildes beschreibt.

2 Min. gelesenLesen
Visuelle KI

Visuelle Beantwortung von Fragen

Visual Question Answering (VQA) ermöglicht es einem System, frei formulierte Fragen zu einem Bild in natürlicher Sprache zu beantworten, z. B. „Wie viele Personen tragen Hüte?“

2 Min. gelesenLesen
Visuelle KI

YOLO-Echtzeiterkennung

YOLO (You Only Look Once) ist eine Familie von Objekterkennungsmodellen, die jedes Objekt in einem Bild mit einem einzigen neuronalen Netzwerkdurchgang schnell genug finden und kennzeichnen.

2 Min. gelesenLesen
Visuelle KI

Panoptische Segmentierung

Die panoptische Segmentierung gibt jedem einzelnen Pixel in einem Bild eine Bezeichnung, die „Was ist dieser Bereich“ mit „Welches spezifische Objekt ist das?“ vereinheitlicht.

2 Min. gelesenLesen
Visuelle KI

Schätzung der menschlichen Pose

Die Schätzung der menschlichen Pose erkennt die Positionen von Körpergelenken wie Ellbogen, Knien und Schultern, um aus Bildern ein digitales Skelett einer Person zu erstellen.

2 Min. gelesenLesen
Visuelle KI

FLUX-Bildmodelle

FLUX ist eine Familie offener Text-zu-Bild-Modelle von Black Forest Labs, die für scharfe Details, starke Eingabeaufforderungen und überraschend genau gerenderten Text bekannt sind.

2 Min. gelesenLesen
Visuelle KI

Restnetzwerke

Residual Networks (ResNets) sind tiefe neuronale Netzwerke, die „Skip-Verbindungen“ hinzufügen, sodass Schichten kleine Anpassungen anstelle vollständiger Transformationen lernen können.

2 Min. gelesenLesen
Visuelle KI

Regionsbasierte CNNs

Regionsbasierte CNNs (R-CNNs) sind eine Familie von Objektdetektoren, die zunächst Kandidatenregionen in einem Bild vorschlagen und dann mithilfe eines CNN klassifizieren und präzise einordnen.

2 Min. gelesenLesen
Visuelle KI

Swin-Transformator

Der Swin Transformer ist ein Vision Transformer, der Bilder in verschobenen, hierarchischen Fenstern verarbeitet und so die Aufmerksamkeit effizient genug macht, um über … zu skalieren.

2 Min. gelesenLesen

Mit dem Lesen fertig? Beweisen Sie es.

Überprüfen Sie anhand von Themenquiz, was Sie gelernt haben, und erkunden Sie anschließend unsere strukturierten Kurse und aktuellen Zertifizierungsanforderungen. Die wichtigsten Leitfäden bleiben weiterhin frei lesbar.

Visual AI AI Guides — Page 9 of 12 | AI Understanding