Kostenlose KI-Bibliothek

Lernen Sie KI.Für immer kostenlos.

1019 Leitfäden in einfachem Englisch, strukturierte Lernpfade und eine offene Bibliothek – erstellt von einer unabhängigen gemeinnützigen Organisation 501(c)(3), damit jeder moderne KI verstehen kann.

1019Kostenlose Reiseführer
9Themenspuren
~2 minPro Reiseführer
~34hLesezeit

Beginnen Sie hier

Fünf ergebnisorientierte Kurse

Jeder Kurs umfasst explizite Ergebnisse, abgebildete Kompetenzen, Übungsaktivitäten und einen angewandten Schlussstein.

Themenspuren

Nach Titel durchsuchen

Springen Sie in den Bereich, der Ihnen am Herzen liegt. Zu jedem Titel gibt es mehrere leicht verständliche Anleitungen.

Vollständige Bibliothek

Alle Führer

1019 von 1019 Anleitungen angezeigt. Filtern Sie nach Titel oder suchen Sie oben.

Sprach-KI

Lemmatisierung und Stemming

Stemming und Lemmatisierung reduzieren beide Wörter auf eine Grundform, sodass „running“, „ran“ und „runs“ als ein Konzept behandelt werden können.

2 Min. gelesenLesen
Sprach-KI

TF-IDF- und Bag-of-Words-Modelle

Bag-of-Words wandelt Text in Wortzählungen um, ohne die Reihenfolge zu berücksichtigen, und TF-IDF gewichtet diese Zählungen, sodass seltene, charakteristische Wörter wichtiger sind als gebräuchliche.

2 Min. gelesenLesen
Visuelle KI

Vision-Sprache-Aktionsmodelle für die Robotik

Vision-Language-Action (VLA)-Modelle sind große neuronale Netze, die Kamerabilder sowie eine schriftliche Anweisung aufnehmen und direkt Motorbefehle des Roboters ausgeben.

2 Min. gelesenLesen
Visuelle KI

Verbreitungspolitik für Robotersteuerung

Diffusion Policy wendet die gleiche Entrauschungsidee wie Bildgeneratoren wie Stable Diffusion auf die Robotersteuerung an: Anstatt eine einzige nächste Aktion vorherzusagen ...

2 Min. gelesenLesen
Grundlagen

Weltmodelle und erlernte Simulatoren

Ein Weltmodell ist ein neuronales Netzwerk, das lernt, vorherzusagen, wie sich eine Umgebung im Laufe der Zeit verändert, und es einer KI ermöglicht, sich zukünftige Ergebnisse „vorzustellen“, bevor sie handelt.

2 Min. gelesenLesen
Sprach-KI

Cross-Encoder vs. Bi-Encoder

Neuronale Modelle vergleichen Text auf zwei Arten: Bi-Encoder betten jedes Stück separat ein, um eine schnelle Suche zu ermöglichen, während Cross-Encoder beide Texte zusammen lesen, um eine bessere…

2 Min. gelesenLesen
Sprach-KI

Abstraktive vs. extraktive Zusammenfassung

Zwei Strategien zur Textverkleinerung: Die extraktive Zusammenfassung kopiert die wichtigsten Sätze wörtlich, während die abstrakte Zusammenfassung neue schreibt.

2 Min. gelesenLesen
Technisch

ROUGE- und BLEU-Bewertungsmetriken

ROUGE und BLEU sind die leistungsstarken automatischen Metriken für den Vergleich von maschinengeneriertem Text mit menschlichen Referenzen.

2 Min. gelesenLesen
Visuelle KI

Make-A-Video Text-to-Video

Make-A-Video ist das 2022-System von Meta, das eine Textaufforderung in einen kurzen Videoclip umwandelt, ohne jemals an beschrifteten Text-Video-Paaren zu trainieren.

2 Min. gelesenLesen
Visuelle KI

Bild-Video-Kaskaden

Imagen Video ist das Text-zu-Video-System 2022 von Google, das einen Clip durch eine Kaskade von sieben Diffusionsmodellen erstellt, die jeweils mehr Frames oder eine höhere Auflösung hinzufügen.

2 Min. gelesenLesen
Visuelle KI

CogVideo und CogVideoX

CogVideo (2022) war das erste groß angelegte offene Text-zu-Video-Modell, und CogVideoX (2024) ist der weitaus leistungsfähigere Open-Source-Nachfolger von Tsinghua/Zhipu AI.

2 Min. gelesenLesen
Anwendungen

KI im Musik-Mastering und -Mixing

KI-Mastering- und Mixing-Tools analysieren die Frequenzbalance, Lautstärke und Dynamik eines Tracks und wenden dann automatisch EQ, Komprimierung und Begrenzung an, um ihn …

2 Min. gelesenLesen

Mit dem Lesen fertig? Beweisen Sie es.

Überprüfen Sie anhand von Themenquiz, was Sie gelernt haben, und erkunden Sie anschließend unsere strukturierten Kurse und aktuellen Zertifizierungsanforderungen. Die wichtigsten Leitfäden bleiben weiterhin frei lesbar.