Podstawy AI
Zrozum, czym jest AI, jak systemy się uczą, gdzie zawodzą i jak oceniać twierdzenia bez zamieszania.
Bezpłatna biblioteka AI
117 przewodniki w prostym języku angielskim, ustrukturyzowane ścieżki edukacyjne i otwarta biblioteka — stworzone przez niezależną organizację non-profit 501(c)(3), aby każdy mógł zrozumieć współczesną sztuczną inteligencję.
Zacznij tutaj
Każdy kurs zawiera wyraźne wyniki, zmapowane kompetencje, ćwiczenia oraz praktyczny projekt końcowy.
Zrozum, czym jest AI, jak systemy się uczą, gdzie zawodzą i jak oceniać twierdzenia bez zamieszania.
Korzystaj z AI produktywnie, jednocześnie chroniąc prywatność, kontrolując wyniki i dbając o odpowiedzialność człowieka.
Oceniaj przypadki użycia w miejscu pracy, realizuj bezpieczne pilotażowe testy, mierz wartość i odpowiedzialnie komunikuj zmiany.
Analizuj systemy AI przez pryzmat praw, równości, zarządzania, bezpieczeństwa oraz efektów w interesie publicznym.
Zrozum modele językowe, wyszukiwanie, agenty, ocenę, koszty oraz zabezpieczenia wdrożenia poprzez praktyczne projektowanie systemów.
Ścieżki tematyczne
Wskocz w obszar, na którym Ci zależy. Do każdego utworu dołączono wiele przewodników w języku angielskim.
Pełna biblioteka
117 z 1019 pokazane przewodniki. Filtruj według utworu lub wyszukaj powyżej.
DiffWave to wokoder oparty na dyfuzji, który syntetyzuje dźwięk poprzez iteracyjne odszumianie losowego szumu w kształt fali, uwarunkowany spektrogramem mel.
Dźwiękowa sztuczna inteligencjaBark to model typu open source firmy Suno zajmujący się przetwarzaniem tekstu na dźwięk, który generuje nie tylko mowę, ale także śmiech, westchnienia, muzykę i efekty dźwiękowe bezpośrednio z komunikatów tekstowych.
Dźwiękowa sztuczna inteligencjaTortoise TTS to system zamiany tekstu na mowę o otwartym kodzie źródłowym, ceniony za niezwykle naturalne, bogate emocjonalnie głosy i silne klonowanie głosu z zaledwie kilku krótkich…
Dźwiękowa sztuczna inteligencjaXTTS to wielojęzyczny model zamiany tekstu na mowę firmy Coqui, który może sklonować głos z krótkiego klipu, a następnie mówić w wielu różnych językach, zachowując…
Dźwiękowa sztuczna inteligencjaSoundStorm to Google model generowania dźwięku, który generuje mowę i dźwięk równolegle, a nie pojedynczo, co zapewnia wysokiej jakości syntezę dźwięku…
Dźwiękowa sztuczna inteligencjaAudioGen to model Meta, który zamienia opisy tekstowe w realistyczne dźwięki otoczenia i efekty dźwiękowe, takie jak szczekanie psa i ćwierkanie ptaków.
Dźwiękowa sztuczna inteligencjaStable Audio to system zamiany tekstu na dźwięk opracowany przez Stability AI, który wykorzystuje utajoną dyfuzję do generowania muzyki i efektów dźwiękowych, z wyraźną kontrolą długości klipu.
Dźwiękowa sztuczna inteligencjaKaldi to darmowy zestaw narzędzi typu open source, który stał się dominującą platformą badawczą do tworzenia systemów rozpoznawania mowy.
Dźwiękowa sztuczna inteligencjaWav2Letter to kompleksowy system rozpoznawania mowy opracowany przez sztuczną inteligencję Facebooka, który wykorzystuje wyłącznie splotowe sieci neuronowe, bez powtarzalności.
Dźwiękowa sztuczna inteligencjaJasper i QuartzNet to kompleksowe modele splotowego rozpoznawania mowy firmy NVIDIA, przy czym QuartzNet to znacznie mniejszy, wydajny, przeprojektowany…
Dźwiękowa sztuczna inteligencjaModele dyfuzji generują dźwięk, ucząc się odwracać krok po kroku proces szumu, zamieniając przypadkowy szum w spójną mowę, muzykę lub efekty dźwiękowe.
Dźwiękowa sztuczna inteligencjaWykrywanie zdarzeń dźwiękowych (SED) identyfikuje, jakie dźwięki pojawiają się w strumieniu audio oraz dokładnie kiedy się rozpoczynają i kończą.
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.