Podstawy AI
Zrozum, czym jest AI, jak systemy się uczą, gdzie zawodzą i jak oceniać twierdzenia bez zamieszania.
Bezpłatna biblioteka AI
117 przewodniki w prostym języku angielskim, ustrukturyzowane ścieżki edukacyjne i otwarta biblioteka — stworzone przez niezależną organizację non-profit 501(c)(3), aby każdy mógł zrozumieć współczesną sztuczną inteligencję.
Zacznij tutaj
Każdy kurs zawiera wyraźne wyniki, zmapowane kompetencje, ćwiczenia oraz praktyczny projekt końcowy.
Zrozum, czym jest AI, jak systemy się uczą, gdzie zawodzą i jak oceniać twierdzenia bez zamieszania.
Korzystaj z AI produktywnie, jednocześnie chroniąc prywatność, kontrolując wyniki i dbając o odpowiedzialność człowieka.
Oceniaj przypadki użycia w miejscu pracy, realizuj bezpieczne pilotażowe testy, mierz wartość i odpowiedzialnie komunikuj zmiany.
Analizuj systemy AI przez pryzmat praw, równości, zarządzania, bezpieczeństwa oraz efektów w interesie publicznym.
Zrozum modele językowe, wyszukiwanie, agenty, ocenę, koszty oraz zabezpieczenia wdrożenia poprzez praktyczne projektowanie systemów.
Ścieżki tematyczne
Wskocz w obszar, na którym Ci zależy. Do każdego utworu dołączono wiele przewodników w języku angielskim.
Pełna biblioteka
117 z 1019 pokazane przewodniki. Filtruj według utworu lub wyszukaj powyżej.
Napisy dźwiękowe generują zdanie w języku naturalnym opisujące zawartość klipu audio, na przykład „trąbi klakson pociągu przejeżdżającego przez przejazd kolejowy”.
Dźwiękowa sztuczna inteligencjaWhisper to system automatycznego rozpoznawania mowy typu open source firmy OpenAI, który zamienia dźwięk na tekst w ponad 90 językach.
Dźwiękowa sztuczna inteligencjaWav2Vec 2.0 to Meta samonadzorowany model mowy sztucznej inteligencji, który uczy się potężnych reprezentacji audio z surowych, nieoznaczonych nagrań.
Dźwiękowa sztuczna inteligencjaHuBERT (ukryta jednostka BERT) to Meta samonadzorowany model mowy sztucznej inteligencji, który uczy się poprzez przewidywanie klastrowych jednostek audio dla zamaskowanych segmentów, w stylu BERT.
Dźwiękowa sztuczna inteligencjaWokoder neuronowy to model, który przekształca zwartą reprezentację akustyczną, zwykle spektrogram melowy, w rzeczywisty kształt fali słyszalnej.
Dźwiękowa sztuczna inteligencjaNeuralne kodeki audio wykorzystują głębokie uczenie się do kompresowania dźwięku w maleńkie strumienie dyskretnych tokenów i rekonstruowania go z wysoką wiernością.
Dźwiękowa sztuczna inteligencjaVALL-E przeformułował zamianę tekstu na mowę jako problem modelowania języka za pomocą tokenów kodeków audio, umożliwiając klonowanie głosu z zaledwie trzech sekund próbki.
Dźwiękowa sztuczna inteligencjaWhisper to system automatycznego rozpoznawania mowy typu open source firmy OpenAI, który transkrybuje i tłumaczy dźwięk mówiony na dziesiątki języków.
Dźwiękowa sztuczna inteligencjaAutomatyczna transkrypcja muzyki (AMT) przekształca surowe nagranie audio muzyki w zapis symboliczny, taki jak nuty, MIDI lub rolka fortepianu.
Dźwiękowa sztuczna inteligencjaŚledzenie rytmu i tempa to zadanie polegające na znalezieniu stałego pulsu w muzyce: miejsca, w którym przypada każde uderzenie i szybkości poruszania się utworu w uderzeniach na minutę (BPM).
Dźwiękowa sztuczna inteligencjaOdcisk palca audio tworzy zwartą, odporną na zakłócenia cyfrową sygnaturę dźwięku, dzięki czemu można go później rozpoznać, nawet poprzez szum tła…
Dźwiękowa sztuczna inteligencjaJukebox to sieć neuronowa OpenAI na rok 2020, która generuje surowy dźwięk muzyczny — wraz ze śpiewającymi głosami, instrumentami, a nawet tekstami w stylu określonych…
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.