KI-Grundlagen
Verstehen Sie, was KI ist, wie Systeme lernen, wo sie versagen und wie Sie Ansprüche ohne Aufregung beurteilen können.
Kostenlose KI-Bibliothek
117 Leitfäden in einfachem Englisch, strukturierte Lernpfade und eine offene Bibliothek – erstellt von einer unabhängigen gemeinnützigen Organisation 501(c)(3), damit jeder moderne KI verstehen kann.
Beginnen Sie hier
Jeder Kurs umfasst explizite Ergebnisse, abgebildete Kompetenzen, Übungsaktivitäten und einen angewandten Schlussstein.
Verstehen Sie, was KI ist, wie Systeme lernen, wo sie versagen und wie Sie Ansprüche ohne Aufregung beurteilen können.
Nutzen Sie KI produktiv und schützen Sie gleichzeitig die Privatsphäre, überprüfen Sie die Ergebnisse und wahren Sie die menschliche Verantwortung.
Bewerten Sie Anwendungsfälle am Arbeitsplatz, führen Sie sichere Pilotprojekte durch, messen Sie den Wert und kommunizieren Sie Änderungen verantwortungsbewusst.
Analysieren Sie KI-Systeme anhand von Rechten, Gerechtigkeit, Governance, Sicherheit und Ergebnissen im öffentlichen Interesse.
Verstehen Sie Sprachmodelle, Abruf, Agenten, Bewertung, Kosten und Bereitstellungsschutz durch praktisches Systemdesign.
Themenspuren
Springen Sie in den Bereich, der Ihnen am Herzen liegt. Zu jedem Titel gibt es mehrere leicht verständliche Anleitungen.
Vollständige Bibliothek
117 von 1019 Anleitungen angezeigt. Filtern Sie nach Titel oder suchen Sie oben.
EnCodec ist der hochauflösende neuronale Audio-Codec von Meta, der Sprache und Musik mit sehr niedrigen Bitraten komprimiert und dessen Qualität weitaus schwereren Formaten Konkurrenz macht.
Audio-KIResidual Vector Quantization (RVQ) ist die Technik, die kontinuierliche Audioeinbettungen durch wiederholte Quantisierung in einen kompakten Stapel diskreter Codes umwandelt.
Audio-KIECAPA-TDNN ist eine neuronale Netzwerkarchitektur, die jeden Sprachclip in eine kompakte „Sprachabdruck“-Einbettung umwandelt, sodass Maschinen erkennen können, wer spricht.
Audio-KIAnti-Spoofing ist die Verteidigungsschicht, die gefälschte oder wiedergegebene Stimmen erkennt, die versuchen, Sprachauthentifizierungssysteme zu täuschen.
Audio-KIRNNoise ist ein kleines, schnelles neuronales Netzwerk, das Hintergrundgeräusche in Echtzeit aus Sprache entfernt.
Audio-KIAudio-Einbettungen wandeln Schall in kompakte numerische Vektoren um, die Bedeutung erfassen, sodass Maschinen Audio so vergleichen, suchen und klassifizieren können, wie Menschen es erkennen.
Audio-KIAkustische Echounterdrückung (AEC) ist die Technologie, die verhindert, dass Ihre eigene Stimme während eines Anrufs zurückgeworfen wird.
Audio-KIUnter Sprachtrennung versteht man die Aufgabe, einzelne Stimmen aus einer Aufnahme herauszutrennen, in der mehrere Personen gleichzeitig sprechen.
Audio-KIPermutationsinvariantes Training (PIT) ist ein cleverer Trainingstrick, der es einem Modell ermöglicht, mehrere Stimmen zu trennen, ohne sich darum zu kümmern, in welchem Ausgabeslot jede Stimme landet …
Audio-KIMusic Information Retrieval (MIR) ist der Bereich, der Computern beibringt, Musik anhand von Audiosignalen und Partituren zu analysieren, zu verstehen und zu durchsuchen.
Audio-KIErfahren Sie, wie Demucs und HT-Demucs Musik mithilfe von Wellenform-, Spektrogramm- und Transformatormodellierung in Gesang und Instrumentenstämme aufteilen.
Audio-KIBei der Audio-Akkorderkennung handelt es sich um die Aufgabe, die in einem Song gespielten Akkorde automatisch direkt aus dem Audio zu kennzeichnen.
Überprüfen Sie anhand von Themenquiz, was Sie gelernt haben, und erkunden Sie anschließend unsere strukturierten Kurse und aktuellen Zertifizierungsanforderungen. Die wichtigsten Leitfäden bleiben weiterhin frei lesbar.