Kostenlose KI-Bibliothek

Lernen Sie KI.Für immer kostenlos.

1019 Leitfäden in einfachem Englisch, strukturierte Lernpfade und eine offene Bibliothek – erstellt von einer unabhängigen gemeinnützigen Organisation 501(c)(3), damit jeder moderne KI verstehen kann.

1019Kostenlose Reiseführer
9Themenspuren
~2 minPro Reiseführer
~34hLesezeit

Beginnen Sie hier

Fünf ergebnisorientierte Kurse

Jeder Kurs umfasst explizite Ergebnisse, abgebildete Kompetenzen, Übungsaktivitäten und einen angewandten Schlussstein.

Themenspuren

Nach Titel durchsuchen

Springen Sie in den Bereich, der Ihnen am Herzen liegt. Zu jedem Titel gibt es mehrere leicht verständliche Anleitungen.

Vollständige Bibliothek

Alle Führer

1019 von 1019 Anleitungen angezeigt. Filtern Sie nach Titel oder suchen Sie oben.

Technisch

KServe und Model Serving auf Kubernetes

KServe ist eine standardisierte, Kubernetes-native Plattform zur Bereitstellung von Modellen für maschinelles Lernen in großem Maßstab.

2 Min. gelesenLesen
Technisch

Seldon-Kern- und Inferenzdiagramme

Seldon Core ist eine Open-Source-Plattform für die Bereitstellung von Modellen für maschinelles Lernen auf Kubernetes mit einer herausragenden Funktion: Inferenzdiagrammen.

2 Min. gelesenLesen
Visuelle KI

IP-Adapter für Bildansagen

IP-Adapter ist ein leichtes Add-on, das es Diffusionsmodellen wie Stable Diffusion ermöglicht, ein Bild als Eingabeaufforderung zu akzeptieren, nicht nur Text.

2 Min. gelesenLesen
Visuelle KI

Bild Text-zu-Bild

Imagen ist das Text-zu-Bild-System von Google, das geschriebene Beschreibungen in fotorealistische Bilder umwandelt.

2 Min. gelesenLesen
Visuelle KI

GLIDE-Diffusionsmodell

GLIDE war ein frühes OpenAI-Text-zu-Bild-Diffusionsmodell, das Eingabeaufforderungen und eine „klassifikatorfreie Anleitung“ zeigte und frühere GAN-basierte Systeme schlagen konnte.

2 Min. gelesenLesen
Audio-KI

Automatisches Tagging von Musik

Das automatische Tagging von Musik nutzt maschinelles Lernen, um einen Song anzuhören und automatisch beschreibende Labels wie Genre, Stimmung, Instrumente und Tempo hinzuzufügen.

2 Min. gelesenLesen
Audio-KI

Musikalische Klangfarbenübertragung

Die Klangfarbenübertragung formt die „Klangfarbe“ von Audio um, sodass ein Instrument wie ein anderes klingt, und verwandelt eine gesummte Melodie in eine Geigen- oder Trompetenlinie …

2 Min. gelesenLesen
Audio-KI

Akustische Szenenklassifizierung

Die akustische Szenenklassifizierung (ASC) trainiert Maschinen, die Umgebung zu erkennen, in der eine Aufnahme gemacht wurde, eine belebte Straße, einen ruhigen Park, einen Zug, ein Café …

2 Min. gelesenLesen
Audio-KI

NVIDIA Riva und NeMo Speech

NVIDIA Riva ist ein GPU-beschleunigtes SDK für Sprach-KI in der Produktion (ASR, TTS und Übersetzung), während NeMo das Open-Source-Toolkit für Training und Feinabstimmung ist …

2 Min. gelesenLesen
Audio-KI

DeepSpeech-Architektur

DeepSpeech ist ein von Baidu im Jahr 2014 eingeführtes End-to-End-Spracherkennungsmodell, das Rohaudiomerkmale mithilfe eines wiederkehrenden neuronalen Verfahrens direkt dem Text zuordnet.

2 Min. gelesenLesen
Audio-KI

Einbettungen von X-Vector-Lautsprechern

X-Vektoren sind numerische Fingerabdrücke fester Länge der Stimme eines Sprechers, die von einem neuronalen Netzwerk erzeugt werden und dazu dienen, zu erkennen, wer spricht, unabhängig davon, was er sagt.

2 Min. gelesenLesen
Sprach-KI

Suche nach dichten Passagen

Dense Passage Retrieval (DPR) findet relevanten Text, indem es die Bedeutung einer Frage und Passagen als numerische Vektoren vergleicht, nicht als übereinstimmende Wörter.

2 Min. gelesenLesen

Mit dem Lesen fertig? Beweisen Sie es.

Überprüfen Sie anhand von Themenquiz, was Sie gelernt haben, und erkunden Sie anschließend unsere strukturierten Kurse und aktuellen Zertifizierungsanforderungen. Die wichtigsten Leitfäden bleiben weiterhin frei lesbar.

Learn AI — Free Guides, Courses and Learning Paths — Page 36 of 85 | AI Understanding