KI-Grundlagen
Verstehen Sie, was KI ist, wie Systeme lernen, wo sie versagen und wie Sie Ansprüche ohne Aufregung beurteilen können.
Kostenlose KI-Bibliothek
133 Leitfäden in einfachem Englisch, strukturierte Lernpfade und eine offene Bibliothek – erstellt von einer unabhängigen gemeinnützigen Organisation 501(c)(3), damit jeder moderne KI verstehen kann.
Beginnen Sie hier
Jeder Kurs umfasst explizite Ergebnisse, abgebildete Kompetenzen, Übungsaktivitäten und einen angewandten Schlussstein.
Verstehen Sie, was KI ist, wie Systeme lernen, wo sie versagen und wie Sie Ansprüche ohne Aufregung beurteilen können.
Nutzen Sie KI produktiv und schützen Sie gleichzeitig die Privatsphäre, überprüfen Sie die Ergebnisse und wahren Sie die menschliche Verantwortung.
Bewerten Sie Anwendungsfälle am Arbeitsplatz, führen Sie sichere Pilotprojekte durch, messen Sie den Wert und kommunizieren Sie Änderungen verantwortungsbewusst.
Analysieren Sie KI-Systeme anhand von Rechten, Gerechtigkeit, Governance, Sicherheit und Ergebnissen im öffentlichen Interesse.
Verstehen Sie Sprachmodelle, Abruf, Agenten, Bewertung, Kosten und Bereitstellungsschutz durch praktisches Systemdesign.
Themenspuren
Springen Sie in den Bereich, der Ihnen am Herzen liegt. Zu jedem Titel gibt es mehrere leicht verständliche Anleitungen.
Vollständige Bibliothek
133 von 1019 Anleitungen angezeigt. Filtern Sie nach Titel oder suchen Sie oben.
Die optische Zeichenerkennung (OCR) wandelt Textbilder – gescannte Dokumente, Fotos von Schildern, PDFs – in maschinenlesbaren, bearbeitbaren Text um.
Visuelle KIDer optische Fluss schätzt, wie sich jedes Pixel zwischen aufeinanderfolgenden Videobildern bewegt, und erstellt so eine dichte Karte von Bewegungsvektoren.
Visuelle KIDie monokulare Tiefenschätzung sagt voraus, wie weit jedes Pixel von einem einzelnen gewöhnlichen Foto entfernt ist – keine Stereokamera, kein Lidar oder Tiefensensor erforderlich.
Visuelle KIModelle mit latenter Diffusion erzeugen Bilder, indem sie den Diffusionsprozess in einem komprimierten latenten Raum statt in Rohpixeln ausführen, wodurch die Rechenkosten drastisch gesenkt werden.
Visuelle KIControlNet ist ein Add-on, das Bildgenerierungsmodellen eine präzise Strukturkontrolle ermöglicht und es Ihnen ermöglicht, die Ausgabe mit Kanten, Posen, Tiefenkarten oder Skizzen zu steuern.
Visuelle KIDie klassifikatorfreie Führung ist die Technik, die dafür sorgt, dass Diffusionsmodelle Ihrer Aufforderung tatsächlich folgen und dabei etwas Diversität gegen eine viel stärkere Einhaltung eintauschen.
Visuelle KIMit Visual SLAM kann eine sich bewegende Kamera eine Karte eines unbekannten Raums erstellen und gleichzeitig ihre eigene Position innerhalb dieser Karte verfolgen.
Visuelle KISora ist das Text-zu-Video-Modell von OpenAI, das eine schriftliche Aufforderung in einen kurzen, hochauflösenden Videoclip umwandelt.
Visuelle KIVideodiffusionsmodelle erzeugen bewegte Bilder, indem sie zufälliges Rauschen schrittweise in kohärente Bilder umwandeln und so die Diffusionsidee von Bildern auf die Zeit erweitern.
Visuelle KIDie Text-zu-3D-Generierung verwandelt eine schriftliche Aufforderung wie „einen Vintage-Ledersessel“ in ein vollständiges 3D-Modell, das Sie drehen, beleuchten und in ein Spiel oder eine Szene einfügen können.
Visuelle KIDurch differenzierbares Rendering ist der Prozess der Umwandlung einer 3D-Szene in ein 2D-Bild vollständig differenzierbar, sodass Sie Farbverläufe aus den gerenderten Pixeln berechnen können …
Visuelle KIU-Net ist ein Faltungs-Neuronales Netzwerk in Form eines „U“, das sich durch die Erzeugung pixelgenauer Ausgaben auszeichnet, ursprünglich für die Segmentierung biomedizinischer Bilder.
Überprüfen Sie anhand von Themenquiz, was Sie gelernt haben, und erkunden Sie anschließend unsere strukturierten Kurse und aktuellen Zertifizierungsanforderungen. Die wichtigsten Leitfäden bleiben weiterhin frei lesbar.