Kostenlose KI-Bibliothek

Visuelle KI FührerFür immer kostenlos.

133 Leitfäden in einfachem Englisch, strukturierte Lernpfade und eine offene Bibliothek – erstellt von einer unabhängigen gemeinnützigen Organisation 501(c)(3), damit jeder moderne KI verstehen kann.

133Kostenlose Reiseführer
1Themenspuren
~2 minPro Reiseführer
~4hLesezeit

Beginnen Sie hier

Fünf ergebnisorientierte Kurse

Jeder Kurs umfasst explizite Ergebnisse, abgebildete Kompetenzen, Übungsaktivitäten und einen angewandten Schlussstein.

Themenspuren

Nach Titel durchsuchen

Springen Sie in den Bereich, der Ihnen am Herzen liegt. Zu jedem Titel gibt es mehrere leicht verständliche Anleitungen.

Vollständige Bibliothek

Alle Führer

133 von 1019 Anleitungen angezeigt. Filtern Sie nach Titel oder suchen Sie oben.

Visuelle KI

Videoverständnis

Video understanding analyzes visual and sometimes audio information across time.

2 Min. gelesenLesen
Visuelle KI

Multimodale Suche

Multimodal search retrieves information across forms such as text, images, audio, and video.

2 Min. gelesenLesen
Visuelle KI

Dokumenten-KI

Document AI extracts and interprets information from files such as forms, reports, invoices, and scanned pages.

2 Min. gelesenLesen
Visuelle KI

Wasserstein GAN

Wasserstein GAN (WGAN) ist eine Neugestaltung des GAN-Trainingsziels, das die Wasserstein-Distanz anstelle des ursprünglichen Min-Max-Verlusts verwendet.

2 Min. gelesenLesen
Visuelle KI

Bedingte GANs

Bedingte GANs (cGANs) erweitern gewöhnliche GANs, indem sie zusätzliche Informationen, wie eine Klassenbezeichnung oder Text, sowohl in den Generator als auch in den Diskriminator einspeisen.

2 Min. gelesenLesen
Visuelle KI

Pix2Pix Bild-zu-Bild-Übersetzung

Pix2Pix ist ein bedingtes GAN, das lernt, einen Bildtyp in einen anderen zu übersetzen, beispielsweise eine Skizze in ein Foto oder eine Karte in eine Satellitenansicht umzuwandeln.

2 Min. gelesenLesen
Visuelle KI

Bildkolorierung

Die Bildkolorierung nutzt KI, um Schwarzweißfotos und -filmen plausible, realistische Farben hinzuzufügen.

2 Min. gelesenLesen
Visuelle KI

Struktur aus Bewegung

Structure from Motion (SfM) rekonstruiert die 3D-Szenengeometrie und Kamerapositionen aus einer Reihe überlappender 2D-Fotos, die aus verschiedenen Blickwinkeln aufgenommen wurden.

2 Min. gelesenLesen
Visuelle KI

Multi-View-Stereo

Multi-View Stereo (MVS) nimmt viele kalibrierte Fotos einer Szene auf und erzeugt eine dichte 3D-Rekonstruktion, indem die Tiefe bei nahezu jedem Pixel geschätzt wird.

2 Min. gelesenLesen
Visuelle KI

DDPM- und DDIM-Sampler

DDPM und DDIM sind zwei Möglichkeiten, den umgekehrten Prozess eines Diffusionsmodells auszuführen und zufälliges Rauschen Schritt für Schritt in ein Bild umzuwandeln.

2 Min. gelesenLesen
Visuelle KI

Punktebasierte generative Modelle

Score-basierte generative Modelle erstellen Daten, indem sie den Gradienten der Datenverteilung lernen – die Richtung, die jede verrauschte Probe eher wie real aussehen lässt …

2 Min. gelesenLesen
Visuelle KI

Fréchet-Anfangsdistanz

Die Fréchet Inception Distance (FID) ist die Standardmetrik zur Beurteilung, wie realistisch und abwechslungsreich eine Reihe generierter Bilder ist.

2 Min. gelesenLesen

Mit dem Lesen fertig? Beweisen Sie es.

Überprüfen Sie anhand von Themenquiz, was Sie gelernt haben, und erkunden Sie anschließend unsere strukturierten Kurse und aktuellen Zertifizierungsanforderungen. Die wichtigsten Leitfäden bleiben weiterhin frei lesbar.