Podstawy AI
Zrozum, czym jest AI, jak systemy się uczą, gdzie zawodzą i jak oceniać twierdzenia bez zamieszania.
Bezpłatna biblioteka AI
117 przewodniki w prostym języku angielskim, ustrukturyzowane ścieżki edukacyjne i otwarta biblioteka — stworzone przez niezależną organizację non-profit 501(c)(3), aby każdy mógł zrozumieć współczesną sztuczną inteligencję.
Zacznij tutaj
Każdy kurs zawiera wyraźne wyniki, zmapowane kompetencje, ćwiczenia oraz praktyczny projekt końcowy.
Zrozum, czym jest AI, jak systemy się uczą, gdzie zawodzą i jak oceniać twierdzenia bez zamieszania.
Korzystaj z AI produktywnie, jednocześnie chroniąc prywatność, kontrolując wyniki i dbając o odpowiedzialność człowieka.
Oceniaj przypadki użycia w miejscu pracy, realizuj bezpieczne pilotażowe testy, mierz wartość i odpowiedzialnie komunikuj zmiany.
Analizuj systemy AI przez pryzmat praw, równości, zarządzania, bezpieczeństwa oraz efektów w interesie publicznym.
Zrozum modele językowe, wyszukiwanie, agenty, ocenę, koszty oraz zabezpieczenia wdrożenia poprzez praktyczne projektowanie systemów.
Ścieżki tematyczne
Wskocz w obszar, na którym Ci zależy. Do każdego utworu dołączono wiele przewodników w języku angielskim.
Pełna biblioteka
117 z 1019 pokazane przewodniki. Filtruj według utworu lub wyszukaj powyżej.
Spleeter to narzędzie typu open source firmy Deezer, które dzieli gotowy utwór na osobne ścieżki (wokal, perkusja, bas i inne) przy użyciu głębokiego uczenia.
Dźwiękowa sztuczna inteligencjaCREPE to model głębokiego uczenia się, który szacuje częstotliwość podstawową (wysokość) monofonicznego sygnału audio bezpośrednio na podstawie jego surowego kształtu fali.
Dźwiękowa sztuczna inteligencjaPESQ i STOI to standardowe obiektywne wskaźniki, które oceniają, jak dobrze brzmi przetworzona mowa i jak bardzo jest ona zrozumiała, bez konieczności stosowania ludzkich słuchaczy.
Dźwiękowa sztuczna inteligencjaWokoder to narzędzie, które rozkłada mowę na elementy składowe i rekonstruuje ją.
Dźwiękowa sztuczna inteligencjaŚredni wynik opinii (MOS) to średnia ocena od 1 do 5 wystawiana przez słuchaczy, która mierzy, jak dobrze brzmi syntetyzowany lub transmitowany dźwięk.
Dźwiękowa sztuczna inteligencjaTransformacja Constant-Q (CQT) to analiza częstotliwości, która wykorzystuje logarytmicznie rozmieszczone przedziały dopasowane do wysokości dźwięku, zamiast równomiernie rozmieszczonych przedziałów…
Dźwiękowa sztuczna inteligencjaFunkcje banku filtrów i percepcyjnego przewidywania liniowego (PLP) to sposoby podsumowywania sygnału mowy w zwarte, percepcyjnie znaczące liczby, które maszyny…
Dźwiękowa sztuczna inteligencjaStyleTTS 2 to model zamiany tekstu na mowę, który traktuje „styl” głosu – prozodię, emocje i barwę głośnika – jako zmienną losową próbkowaną za pomocą modelu dyfuzji…
Dźwiękowa sztuczna inteligencjaFastPitch to szybki, nieautoregresywny model zamiany tekstu na mowę, który wyraźnie przewiduje wysokość (częstotliwość podstawową) każdego tokena wejściowego, umożliwiając…
Dźwiękowa sztuczna inteligencjaVoicebox to model generowania mowy sterowany tekstem firmy Meta, przeszkolony pod kątem dopasowania przepływu, aby „wypełnić” zamaskowany dźwięk, umożliwiając jednemu modelowi wykonywanie głosu zero-shot…
Dźwiękowa sztuczna inteligencjaWyzwanie Deep Noise Suppression (DNS) to konkurs organizowany przez Microsoft, który motywuje badaczy do budowania sieci neuronowych usuwających szum tła…
Dźwiękowa sztuczna inteligencjaOdejmowanie widmowe i filtrowanie Wienera to klasyczne, poprzedzające głębokie uczenie się, podstawowe narzędzia redukcji szumów.
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.