Kostenlose KI-Bibliothek

Visuelle KI FührerFür immer kostenlos.

133 Leitfäden in einfachem Englisch, strukturierte Lernpfade und eine offene Bibliothek – erstellt von einer unabhängigen gemeinnützigen Organisation 501(c)(3), damit jeder moderne KI verstehen kann.

133Kostenlose Reiseführer
1Themenspuren
~2 minPro Reiseführer
~4hLesezeit

Beginnen Sie hier

Fünf ergebnisorientierte Kurse

Jeder Kurs umfasst explizite Ergebnisse, abgebildete Kompetenzen, Übungsaktivitäten und einen angewandten Schlussstein.

Themenspuren

Nach Titel durchsuchen

Springen Sie in den Bereich, der Ihnen am Herzen liegt. Zu jedem Titel gibt es mehrere leicht verständliche Anleitungen.

Vollständige Bibliothek

Alle Führer

133 von 1019 Anleitungen angezeigt. Filtern Sie nach Titel oder suchen Sie oben.

Visuelle KI

Magic3D Text-zu-3D-Pipeline

Magic3D ist NVIDIAs zweistufige Antwort auf DreamFusion, die schneller hochauflösende und detailliertere 3D-Inhalte produziert.

2 Min. gelesenLesen
Visuelle KI

Entrauschen und Entschärfen von Netzwerken

Rauschunterdrückungs- und Unschärfenetzwerke sind neuronale Modelle, die verrauschte oder verschwommene Bilder bereinigen und scharfe Details aus unordentlichen Eingaben wiederherstellen.

2 Min. gelesenLesen
Visuelle KI

GFPGAN-Gesichtswiederherstellung

GFPGAN ist ein spezielles Modell, das minderwertige, verschwommene oder alte Gesichtsfotos in scharfe, realistische Porträts umwandelt.

2 Min. gelesenLesen
Visuelle KI

CodeFormer Robuste Gesichtswiederherstellung

CodeFormer ist ein Gesichtswiederherstellungsmodell, das für die Bewältigung extremer Verschlechterungen entwickelt wurde und erkennbare Gesichter aus stark beschädigten, winzigen oder verschwommenen Eingaben wiederherstellt.

2 Min. gelesenLesen
Visuelle KI

GigaGAN-skalierte Generatoren

GigaGAN ist ein Milliarden-Parameter-GAN, das beweist, dass generative gegnerische Netzwerke auf die Text-zu-Bild-Generierung skaliert werden können und damit mit Diffusionsmodellen konkurrieren …

2 Min. gelesenLesen
Visuelle KI

VQGAN und Codebook-Bildsynthese

VQGAN komprimiert Bilder in ein Raster diskreter Token, die aus einem erlernten Codebuch stammen, und lässt einen Transformator Bilder auf die gleiche Weise generieren wie Sprachmodelle …

2 Min. gelesenLesen
Visuelle KI

MaskGIT Parallele Token-Dekodierung

MaskGIT generiert Bilder, indem es viele Token auf einmal vorhersagt und die sichersten zuerst ausfüllt, wodurch die langsame Erzeugung von links nach rechts ersetzt wird …

2 Min. gelesenLesen
Visuelle KI

Null-1-zu-3-Novel-View-Diffusion

Zero-1-to-3 wandelt ein einzelnes Foto eines Objekts in Bilder desselben Objekts um, die aus einem neuen Blickwinkel gesehen werden, und zwar mithilfe eines auf der Kamera konditionierten Diffusionsmodells …

2 Min. gelesenLesen
Visuelle KI

DMTet Hybrid 3D-Darstellung

DMTet (Deep Marching Tetrahedra) ist eine hybride 3D-Formdarstellung, die ein verformbares tetraedrisches Gitter mit einem vorzeichenbehafteten Distanzfeld kombiniert, sodass neuronale…

2 Min. gelesenLesen
Visuelle KI

Instant-NGP-Hash-Kodierung

Instant-NGP ist NVIDIAs Technik, die neuronale Strahlungsfelder und andere neuronale Grafikprimitive in Sekunden statt in Stunden trainiert, indem sie lernbare… speichert.

2 Min. gelesenLesen
Visuelle KI

DepthAnything Monokulare Tiefe

DepthAnything ist ein Basismodell, das ohne spezielle Hardware schätzt, wie weit jedes Pixel von einem einzelnen gewöhnlichen Foto entfernt ist.

2 Min. gelesenLesen
Visuelle KI

Schätzung der Ringelblumendiffusionstiefe

Marigold nutzt ein vorab trainiertes Diffusionsmodell zur Bilderzeugung (Stabile Diffusion) für die Vorhersage hochdetaillierter Tiefenkarten.

2 Min. gelesenLesen

Mit dem Lesen fertig? Beweisen Sie es.

Überprüfen Sie anhand von Themenquiz, was Sie gelernt haben, und erkunden Sie anschließend unsere strukturierten Kurse und aktuellen Zertifizierungsanforderungen. Die wichtigsten Leitfäden bleiben weiterhin frei lesbar.

Visual AI AI Guides — Page 6 of 12 | AI Understanding