Kostenlose KI-Bibliothek

Visuelle KI FührerFür immer kostenlos.

133 Leitfäden in einfachem Englisch, strukturierte Lernpfade und eine offene Bibliothek – erstellt von einer unabhängigen gemeinnützigen Organisation 501(c)(3), damit jeder moderne KI verstehen kann.

133Kostenlose Reiseführer
1Themenspuren
~2 minPro Reiseführer
~4hLesezeit

Beginnen Sie hier

Fünf ergebnisorientierte Kurse

Jeder Kurs umfasst explizite Ergebnisse, abgebildete Kompetenzen, Übungsaktivitäten und einen angewandten Schlussstein.

Themenspuren

Nach Titel durchsuchen

Springen Sie in den Bereich, der Ihnen am Herzen liegt. Zu jedem Titel gibt es mehrere leicht verständliche Anleitungen.

Vollständige Bibliothek

Alle Führer

133 von 1019 Anleitungen angezeigt. Filtern Sie nach Titel oder suchen Sie oben.

Visuelle KI

Neuartige Ansichtssynthese

Die neuartige Ansichtssynthese erzeugt fotorealistische Bilder einer Szene aus Blickwinkeln, die nie tatsächlich fotografiert wurden.

2 Min. gelesenLesen
Visuelle KI

Muse Masked Generative Bildgebung

Muse ist ein Text-zu-Bild-Modell von Google, das Bilder generiert, indem es maskierte Bild-Tokens auf einmal ausfüllt, was viel schneller ist als Schritt-für-Schritt …

2 Min. gelesenLesen
Visuelle KI

Parti Pathways Autoregressive Bildgebung

Parti (Pathways Autoregressive Text-to-Image) generiert Bilder auf die Art und Weise, wie Sprachmodelle Sätze schreiben: ein Bild-Token nach dem anderen, um das nächste vorherzusagen …

2 Min. gelesenLesen
Visuelle KI

Bild 2 und belohnungsgesteuerte Verbreitung

Imagen 2 ist das fotorealistische, auf Diffusion basierende Text-zu-Bild-Modell von Google, das durch Belohnungsoptimierung verfeinert wurde, damit seine Ausgaben besser den tatsächlichen Wünschen der Menschen entsprechen.

2 Min. gelesenLesen
Visuelle KI

LaMa Resolution – Robustes Inpainting

LaMa (Large Mask Inpainting) ist ein schnelles, leichtes neuronales Netzwerk, das fehlende oder entfernte Bereiche eines Bildes sauber füllt, selbst wenn das Loch sehr groß ist.

2 Min. gelesenLesen
Visuelle KI

Stabile Videoverbreitung

Stable Video Diffusion (SVD) ist das offene Basismodell von Stability AI, das ein einzelnes Standbild in einen kurzen, sich fließend bewegenden Videoclip umwandelt.

2 Min. gelesenLesen
Visuelle KI

Lumiere Raum-Zeit-Videoerzeugung

Lumiere ist ein Text-zu-Video-Diffusionsmodell von Google Research, das mithilfe eines Raum-Zeit-U-Nets einen gesamten Videoclip auf einmal generiert.

2 Min. gelesenLesen
Visuelle KI

Mip-NeRF und Anti-Aliased-Radiance-Felder

Mip-NeRF behebt die verschwommenen, gezackten Artefakte, die beim Original-NeRF auftreten, wenn Sie Szenen mit unterschiedlichen Entfernungen oder Auflösungen rendern.

2 Min. gelesenLesen
Visuelle KI

Plenoxel und Voxel-Strahlungsfelder

Plenoxels hat gezeigt, dass man eine 3D-Szene mit Ergebnissen in NeRF-Qualität rekonstruieren kann, ganz ohne ein neuronales Netzwerk – nur ein Raster aus Voxeln, die Farbe speichern …

2 Min. gelesenLesen
Visuelle KI

DUSt3R Dichte 3D-Rekonstruktion

DUSt3R rekonstruiert dichte 3D-Geometrie aus einer Handvoll gewöhnlicher Fotos, ohne dass bekannte Kamerapositionen oder Kalibrierung erforderlich sind.

2 Min. gelesenLesen
Visuelle KI

Tune-A-Video One-Shot-Bearbeitung

Tune-A-Video optimiert ein vorab trainiertes Text-zu-Bild-Diffusionsmodell für ein einzelnes Video, sodass dieser Clip anhand neuer Textaufforderungen erneut bearbeitet werden kann.

2 Min. gelesenLesen
Visuelle KI

DreamFusion und Score Distillation Sampling

DreamFusion generiert 3D-Objekte aus Text, indem es ein 2D-Bilddiffusionsmodell als Kritiker verwendet und niemals auf 3D-Daten trainiert.

2 Min. gelesenLesen

Mit dem Lesen fertig? Beweisen Sie es.

Überprüfen Sie anhand von Themenquiz, was Sie gelernt haben, und erkunden Sie anschließend unsere strukturierten Kurse und aktuellen Zertifizierungsanforderungen. Die wichtigsten Leitfäden bleiben weiterhin frei lesbar.

Visual AI AI Guides — Page 5 of 12 | AI Understanding