Kostenlose KI-Bibliothek

Lernen Sie KI.Für immer kostenlos.

1019 Leitfäden in einfachem Englisch, strukturierte Lernpfade und eine offene Bibliothek – erstellt von einer unabhängigen gemeinnützigen Organisation 501(c)(3), damit jeder moderne KI verstehen kann.

1019Kostenlose Reiseführer
9Themenspuren
~2 minPro Reiseführer
~34hLesezeit

Beginnen Sie hier

Fünf ergebnisorientierte Kurse

Jeder Kurs umfasst explizite Ergebnisse, abgebildete Kompetenzen, Übungsaktivitäten und einen angewandten Schlussstein.

Themenspuren

Nach Titel durchsuchen

Springen Sie in den Bereich, der Ihnen am Herzen liegt. Zu jedem Titel gibt es mehrere leicht verständliche Anleitungen.

Vollständige Bibliothek

Alle Führer

1019 von 1019 Anleitungen angezeigt. Filtern Sie nach Titel oder suchen Sie oben.

Grundlagen

Chinchilla Compute-Optimales Training

Chinchilla ist ein DeepMind-Ergebnis aus dem Jahr 2022, das besagt, dass die meisten großen Sprachmodelle stark untertrainiert waren: Für ein festes Rechenbudget sollten Sie Parameter skalieren …

2 Min. gelesenLesen
Grundlagen

Gruppierte Belohnungsnormalisierung in RLHF

Die gruppierte Belohnungsnormalisierung standardisiert die Belohnungen eines Modells innerhalb einer Reihe von Antworten auf dieselbe Eingabeaufforderung und verwandelt verrauschte Ergebnisse in ein stabiles Training …

2 Min. gelesenLesen
Visuelle KI

Mip-NeRF und Anti-Aliased-Radiance-Felder

Mip-NeRF behebt die verschwommenen, gezackten Artefakte, die beim Original-NeRF auftreten, wenn Sie Szenen mit unterschiedlichen Entfernungen oder Auflösungen rendern.

2 Min. gelesenLesen
Visuelle KI

Plenoxel und Voxel-Strahlungsfelder

Plenoxels hat gezeigt, dass man eine 3D-Szene mit Ergebnissen in NeRF-Qualität rekonstruieren kann, ganz ohne ein neuronales Netzwerk – nur ein Raster aus Voxeln, die Farbe speichern …

2 Min. gelesenLesen
Visuelle KI

DUSt3R Dichte 3D-Rekonstruktion

DUSt3R rekonstruiert dichte 3D-Geometrie aus einer Handvoll gewöhnlicher Fotos, ohne dass bekannte Kamerapositionen oder Kalibrierung erforderlich sind.

2 Min. gelesenLesen
Audio-KI

Bewertung des durchschnittlichen Meinungswerts

Der Mean Opinion Score (MOS) ist eine durchschnittliche Bewertung von 1 bis 5 durch menschliche Zuhörer, die misst, wie gut synthetisierte oder übertragene Audiotöne klingen.

2 Min. gelesenLesen
Audio-KI

Constant-Q-Transformation für Audio

Die Constant-Q-Transformation (CQT) ist eine Frequenzanalyse, die anstelle der gleichmäßig verteilten Bins logarithmisch beabstandete Bins verwendet, die an die Tonhöhe der Musik angepasst sind.

2 Min. gelesenLesen
Audio-KI

Filterbank- und PLP-Funktionen

Filterbank- und Perceptual Linear Prediction (PLP)-Funktionen sind Möglichkeiten, ein Sprachsignal in kompakte, wahrnehmungsbedeutsame Zahlen zusammenzufassen, die maschinell…

2 Min. gelesenLesen
Unternehmen

Comma.ai und Openpilot

Comma.ai ist ein heruntergekommenes Startup aus San Diego, das vom iPhone-Hacker George Hotz gegründet wurde und gewöhnliche Autos mithilfe eines kleinen… in halbautonome Fahrzeuge verwandelt.

2 Min. gelesenLesen
Unternehmen

Skild AI- und Robotics Foundation-Modelle

Erfahren Sie mehr über Skild AI und Robotik-Grundlagenmodelle: Was Skild Brain ist, warum Allzweck-Robotermodelle wichtig sind und wie das Unternehmen eine Richtlinie wiederverwenden möchte …

2 Min. gelesenLesen
Unternehmen

Körperliche Intelligenz und Pi-Null

Physical Intelligence (oft mit dem Pi-Symbol gekennzeichnet) ist ein Startup aus San Francisco, das Allzweck-KI für Roboter entwickelt, und Pi-Zero ist sein Flaggschiff …

2 Min. gelesenLesen
Visuelle KI

Tune-A-Video One-Shot-Bearbeitung

Tune-A-Video optimiert ein vorab trainiertes Text-zu-Bild-Diffusionsmodell für ein einzelnes Video, sodass dieser Clip anhand neuer Textaufforderungen erneut bearbeitet werden kann.

2 Min. gelesenLesen

Mit dem Lesen fertig? Beweisen Sie es.

Überprüfen Sie anhand von Themenquiz, was Sie gelernt haben, und erkunden Sie anschließend unsere strukturierten Kurse und aktuellen Zertifizierungsanforderungen. Die wichtigsten Leitfäden bleiben weiterhin frei lesbar.