Kostenlose KI-Bibliothek

Visuelle KI FührerFür immer kostenlos.

133 Leitfäden in einfachem Englisch, strukturierte Lernpfade und eine offene Bibliothek – erstellt von einer unabhängigen gemeinnützigen Organisation 501(c)(3), damit jeder moderne KI verstehen kann.

133Kostenlose Reiseführer
1Themenspuren
~2 minPro Reiseführer
~4hLesezeit

Beginnen Sie hier

Fünf ergebnisorientierte Kurse

Jeder Kurs umfasst explizite Ergebnisse, abgebildete Kompetenzen, Übungsaktivitäten und einen angewandten Schlussstein.

Themenspuren

Nach Titel durchsuchen

Springen Sie in den Bereich, der Ihnen am Herzen liegt. Zu jedem Titel gibt es mehrere leicht verständliche Anleitungen.

Vollständige Bibliothek

Alle Führer

133 von 1019 Anleitungen angezeigt. Filtern Sie nach Titel oder suchen Sie oben.

Visuelle KI

Bildmattierung

Bei der Bildmattierung handelt es sich um die Kunst, ein Motiv mit pixelgenauen, halbtransparenten Kanten aus einem Foto auszuschneiden – und dabei jede dünne Haarsträhne oder Bewegungsunschärfe einzufangen.

2 Min. gelesenLesen
Visuelle KI

IP-Adapter für Bildansagen

IP-Adapter ist ein leichtes Add-on, das es Diffusionsmodellen wie Stable Diffusion ermöglicht, ein Bild als Eingabeaufforderung zu akzeptieren, nicht nur Text.

2 Min. gelesenLesen
Visuelle KI

Bild Text-zu-Bild

Imagen ist das Text-zu-Bild-System von Google, das geschriebene Beschreibungen in fotorealistische Bilder umwandelt.

2 Min. gelesenLesen
Visuelle KI

GLIDE-Diffusionsmodell

GLIDE war ein frühes OpenAI-Text-zu-Bild-Diffusionsmodell, das Eingabeaufforderungen und eine „klassifikatorfreie Anleitung“ zeigte und frühere GAN-basierte Systeme schlagen konnte.

2 Min. gelesenLesen
Visuelle KI

Wahrnehmungsverlust und LPIPS

Der Wahrnehmungsverlust misst, wie ähnlich zwei Bilder für Menschen aussehen, indem er die Merkmale eines tiefen neuronalen Netzwerks anstelle von Rohpixeln vergleicht.

2 Min. gelesenLesen
Visuelle KI

StyleGAN-Architektur

StyleGAN ist ein generatives kontradiktorisches Netzwerk von NVIDIA, das auffallend realistische Gesichter und Objekte erzeugt, indem es Stilinformationen auf jeder Ebene einfügt.

2 Min. gelesenLesen
Visuelle KI

Progressives Wachstum von GANs

Progressives Wachstum trainiert ein GAN, indem es mit winzigen Auflösungen beginnt und nach und nach Schichten hinzufügt, um hochauflösende Bilder zu erreichen.

2 Min. gelesenLesen
Visuelle KI

AnimateDiff-Bewegungserzeugung

AnimateDiff ist eine Technik, die bestehenden Text-zu-Bild-Diffusionsmodellen wie Stable Diffusion Bewegung hinzufügt und Standbildgeneratoren in kurze Videos verwandelt.

2 Min. gelesenLesen
Visuelle KI

DETR-Transformatorerkennung

DETR (DEtection TRansformer) definiert die Objekterkennung als direktes Mengenvorhersageproblem, das mit einem Transformator gelöst wird, und entfernt manuell entworfene Schritte wie Anker…

2 Min. gelesenLesen
Visuelle KI

Objekterkennung mit offenem Vokabular

Die Objekterkennung mit offenem Vokabular ermöglicht es einem Modell, durch beliebigen Text beschriebene Objekte zu finden und einzuordnen, einschließlich Kategorien, die während des Trainings nie beschriftet wurden.

2 Min. gelesenLesen
Visuelle KI

Photogrammetrie

Die Photogrammetrie verwandelt gewöhnliche überlappende Fotos in genaue 3D-Modelle, Karten und Messungen.

2 Min. gelesenLesen
Visuelle KI

Visuelle Odometrie

Die visuelle Odometrie schätzt, wie sich eine Kamera durch die Welt bewegt, indem sie verfolgt, wie sich das Bild von Bild zu Bild ändert.

2 Min. gelesenLesen

Mit dem Lesen fertig? Beweisen Sie es.

Überprüfen Sie anhand von Themenquiz, was Sie gelernt haben, und erkunden Sie anschließend unsere strukturierten Kurse und aktuellen Zertifizierungsanforderungen. Die wichtigsten Leitfäden bleiben weiterhin frei lesbar.

Visual AI AI Guides — Page 4 of 12 | AI Understanding