Podstawy AI
Zrozum, czym jest AI, jak systemy się uczą, gdzie zawodzą i jak oceniać twierdzenia bez zamieszania.
Bezpłatna biblioteka AI
117 przewodniki w prostym języku angielskim, ustrukturyzowane ścieżki edukacyjne i otwarta biblioteka — stworzone przez niezależną organizację non-profit 501(c)(3), aby każdy mógł zrozumieć współczesną sztuczną inteligencję.
Zacznij tutaj
Każdy kurs zawiera wyraźne wyniki, zmapowane kompetencje, ćwiczenia oraz praktyczny projekt końcowy.
Zrozum, czym jest AI, jak systemy się uczą, gdzie zawodzą i jak oceniać twierdzenia bez zamieszania.
Korzystaj z AI produktywnie, jednocześnie chroniąc prywatność, kontrolując wyniki i dbając o odpowiedzialność człowieka.
Oceniaj przypadki użycia w miejscu pracy, realizuj bezpieczne pilotażowe testy, mierz wartość i odpowiedzialnie komunikuj zmiany.
Analizuj systemy AI przez pryzmat praw, równości, zarządzania, bezpieczeństwa oraz efektów w interesie publicznym.
Zrozum modele językowe, wyszukiwanie, agenty, ocenę, koszty oraz zabezpieczenia wdrożenia poprzez praktyczne projektowanie systemów.
Ścieżki tematyczne
Wskocz w obszar, na którym Ci zależy. Do każdego utworu dołączono wiele przewodników w języku angielskim.
Pełna biblioteka
117 z 1019 pokazane przewodniki. Filtruj według utworu lub wyszukaj powyżej.
Technologia Beamforming wykorzystuje wiele mikrofonów do nasłuchu w wybranym kierunku, wzmacniając dźwięk dochodzący z celu, jednocześnie tłumiąc wszystko inne.
Dźwiękowa sztuczna inteligencjaRiffusion to sprytny trik, który generuje muzykę, traktując dźwięk jak obraz: dostraja model obrazu Stable Diffusion, aby malować spektrogramy, a następnie…
Dźwiękowa sztuczna inteligencjaDowiedz się, jak Google MusicLM wykorzystuje hierarchiczne tokeny semantyczne i akustyczne, SoundStream i MuLan, aby przekształcać podpowiedzi tekstowe w spójną muzykę.
Dźwiękowa sztuczna inteligencjaNoise2Noise to sztuczka szkoleniowa, która pozwala modelowi nauczyć się usuwać szum bez zobaczenia czystego odniesienia, poprzez uczenie się od par różnie zaszumionych…
Dźwiękowa sztuczna inteligencjaConv-TasNet to sieć neuronowa, która oddziela zmieszany dźwięk (jak dwie osoby rozmawiające jednocześnie), pracując bezpośrednio na surowym przebiegu dźwiękowym…
Dźwiękowa sztuczna inteligencjaDual-Path RNN (DPRNN) to architektura separacji dźwięku, która dzieli bardzo długą sekwencję funkcji audio na krótkie, nakładające się fragmenty i przetwarza je…
Dźwiękowa sztuczna inteligencjaOpen-Unmix (UMX) to system głębokiego uczenia się typu open source, który dzieli utwór na części: wokal, perkusję, bas i inne instrumenty.
Dźwiękowa sztuczna inteligencjaWyrównanie słów szeptanych przypina każde transkrybowane słowo do dokładnego czasu rozpoczęcia i zakończenia w dźwięku.
Dźwiękowa sztuczna inteligencjaTagowanie muzyki wykorzystuje modele transformatorów do słuchania utworu i przewidywania opisowych etykiet, takich jak gatunek, nastrój, instrumenty i tempo.
Dźwiękowa sztuczna inteligencjaWykrywanie początku znajduje dokładne momenty, w których rozpoczynają się nuty, uderzenia lub dźwięki w sygnale audio.
Dźwiękowa sztuczna inteligencjaMelGAN to wokoder w pełni splotowy oparty na GAN, który zamienia spektrogramy mel w surowe przebiegi audio w jednym szybkim przebiegu do przodu.
Dźwiękowa sztuczna inteligencjaUnivNet to wokoder GAN, który ocenia wygenerowany dźwięk na podstawie wielu spektrogramów obliczonych w różnych rozdzielczościach STFT, wyostrzając szczegóły wysokich częstotliwości.
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.