Kostenlose KI-Bibliothek

Visuelle KI FührerFür immer kostenlos.

133 Leitfäden in einfachem Englisch, strukturierte Lernpfade und eine offene Bibliothek – erstellt von einer unabhängigen gemeinnützigen Organisation 501(c)(3), damit jeder moderne KI verstehen kann.

133Kostenlose Reiseführer
1Themenspuren
~2 minPro Reiseführer
~4hLesezeit

Beginnen Sie hier

Fünf ergebnisorientierte Kurse

Jeder Kurs umfasst explizite Ergebnisse, abgebildete Kompetenzen, Übungsaktivitäten und einen angewandten Schlussstein.

Themenspuren

Nach Titel durchsuchen

Springen Sie in den Bereich, der Ihnen am Herzen liegt. Zu jedem Titel gibt es mehrere leicht verständliche Anleitungen.

Vollständige Bibliothek

Alle Führer

133 von 1019 Anleitungen angezeigt. Filtern Sie nach Titel oder suchen Sie oben.

Visuelle KI

LoRA-Schieberegler für die Bildbearbeitung

LoRA-Schieberegler sind winzige Zusatzmodule, mit denen Sie ein einzelnes Attribut eines Bildes kontinuierlich nach oben oder unten verschieben können, z. B. Alter, Lächeln oder Rost, ohne…

2 Min. gelesenLesen
Visuelle KI

InstructPix2Pix-Anweisungsbearbeitung

Mit InstructPix2Pix können Sie ein Foto bearbeiten, indem Sie einen einfachen Befehl wie „Mach es winterlich“ oder „Verwandle die Katze in einen Hund“ eingeben, ohne dass Masken oder Auswahlwerkzeuge erforderlich sind.

2 Min. gelesenLesen
Visuelle KI

Prompt-to-Prompt-Cross-Attention-Editing

Prompt-to-Prompt bearbeitet ein generiertes Bild, indem es seine Textaufforderung optimiert und gleichzeitig die internen Aufmerksamkeitskarten des Modells wiederverwendet, sodass die Änderung eines Wortes vertauscht wird …

2 Min. gelesenLesen
Visuelle KI

ESRGAN und GAN Super-Resolution

ESRGAN nutzt einen Generator-gegen-Diskriminator-Wettbewerb, um beim Hochskalieren von Bildern realistische Details zu erfinden, die über die verschwommene Interpolation hinausgehen.

2 Min. gelesenLesen
Visuelle KI

Praktische Wiederherstellung von Real-ESRGAN

Real-ESRGAN erweitert ESRGAN, um die chaotischen, unbekannten Verschlechterungen realer Fotos zu bewältigen, anstatt saubere synthetische Unschärfe.

2 Min. gelesenLesen
Visuelle KI

Wiederherstellung des SwinIR-Transformators

SwinIR wendet die verschobene Fensteraufmerksamkeit des Swin Transformer auf Bildwiederherstellungsaufgaben wie Superauflösung, Rauschunterdrückung und Entfernung von JPEG-Artefakten an.

2 Min. gelesenLesen
Visuelle KI

Latente Konsistenzmodelle

Latent Consistency Models (LCMs) sind eine Technik, mit der Diffusionsbildgeneratoren stattdessen in nur ein bis vier Schritten qualitativ hochwertige Bilder erzeugen können.

2 Min. gelesenLesen
Visuelle KI

Visionstransformatoren

Vision Transformers (ViTs) wenden die Transformer-Architektur, die ChatGPT antreibt, auf Bilder an und behandeln ein Bild als eine Folge von Patches statt als Raster …

2 Min. gelesenLesen
Visuelle KI

Stable Diffusion

Stable Diffusion ist ein Open-Source-Text-zu-Bild-Modell, das 2022 von Stability AI veröffentlicht wurde und Bilder generiert, indem es schrittweise Rauschen aus einem zufälligen… entfernt.

2 Min. gelesenLesen
Visuelle KI

Midjourney

Midjourney ist ein beliebter kommerzieller Text-zu-Bild-Dienst, der für seine beeindruckenden, hochästhetischen Ergebnisse und seine Ursprünge als Discord-Bot bekannt ist.

2 Min. gelesenLesen
Visuelle KI

DALL-E

DALL-E ist die Familie von Text-zu-Bild-Modellen von OpenAI, die eine schriftliche Beschreibung in ein Originalbild umwandeln.

2 Min. gelesenLesen
Visuelle KI

CLIP- und Vision-Language-Modelle

CLIP ist ein Modell von OpenAI, das lernt, Bilder und Text zu verbinden, indem es beide im gleichen mathematischen Raum platziert.

2 Min. gelesenLesen

Mit dem Lesen fertig? Beweisen Sie es.

Überprüfen Sie anhand von Themenquiz, was Sie gelernt haben, und erkunden Sie anschließend unsere strukturierten Kurse und aktuellen Zertifizierungsanforderungen. Die wichtigsten Leitfäden bleiben weiterhin frei lesbar.

Visual AI AI Guides — Page 8 of 12 | AI Understanding