Podstawy AI
Zrozum, czym jest AI, jak systemy się uczą, gdzie zawodzą i jak oceniać twierdzenia bez zamieszania.
Bezpłatna biblioteka AI
117 przewodniki w prostym języku angielskim, ustrukturyzowane ścieżki edukacyjne i otwarta biblioteka — stworzone przez niezależną organizację non-profit 501(c)(3), aby każdy mógł zrozumieć współczesną sztuczną inteligencję.
Zacznij tutaj
Każdy kurs zawiera wyraźne wyniki, zmapowane kompetencje, ćwiczenia oraz praktyczny projekt końcowy.
Zrozum, czym jest AI, jak systemy się uczą, gdzie zawodzą i jak oceniać twierdzenia bez zamieszania.
Korzystaj z AI produktywnie, jednocześnie chroniąc prywatność, kontrolując wyniki i dbając o odpowiedzialność człowieka.
Oceniaj przypadki użycia w miejscu pracy, realizuj bezpieczne pilotażowe testy, mierz wartość i odpowiedzialnie komunikuj zmiany.
Analizuj systemy AI przez pryzmat praw, równości, zarządzania, bezpieczeństwa oraz efektów w interesie publicznym.
Zrozum modele językowe, wyszukiwanie, agenty, ocenę, koszty oraz zabezpieczenia wdrożenia poprzez praktyczne projektowanie systemów.
Ścieżki tematyczne
Wskocz w obszar, na którym Ci zależy. Do każdego utworu dołączono wiele przewodników w języku angielskim.
Pełna biblioteka
117 z 1019 pokazane przewodniki. Filtruj według utworu lub wyszukaj powyżej.
Identyfikacja utworu coverowego pozwala wykryć, kiedy dwa bardzo różnie brzmiące nagrania to w rzeczywistości ten sam utwór bazowy — akustyczna wersja na żywo, remiks…
Dźwiękowa sztuczna inteligencjaDDSP (Differentiable Digital Signal Processing) łączy klasyczne elementy składowe syntezatorów z sieciami neuronowymi, dzięki czemu głębokie uczenie się może kontrolować oscylatory…
Dźwiękowa sztuczna inteligencjaVITS to model zamiany tekstu na mowę, który zamienia tekst bezpośrednio na surowe przebiegi audio w jednym wytrenowanym systemie, z pominięciem zwykłego dwuetapowego potoku.
Dźwiękowa sztuczna inteligencjaFastSpeech generuje równolegle cały spektrogram mowy, a nie jedną klatkę na raz, dzięki czemu synteza jest znacznie szybsza i stabilniejsza.
Dźwiękowa sztuczna inteligencjaNaturalSpeech to linia badań Microsoft TTS, których celem jest jakość mowy na poziomie ludzkim, przy czym późniejsze wersje wykorzystują utajoną dyfuzję w celu generowania bogatych, naturalnych…
Dźwiękowa sztuczna inteligencjaRozpoznawanie emocji mowy (SER) to sztuczna inteligencja, która wykrywa stan emocjonalny osoby mówiącej – złość, radość, smutek, frustrację – na podstawie dźwięku jej głosu, a nie tylko…
Dźwiękowa sztuczna inteligencjaMoshi to oparta na otwartym kodzie źródłowym sztuczna inteligencja głosowa firmy Kyutai działająca w czasie rzeczywistym, która mówi i słucha w tym samym czasie — w trybie pełnego dupleksu — zamiast działać po kolei.
Dźwiękowa sztuczna inteligencjaTłumaczenie mowy na mowę (S2ST) polega na przetwarzaniu słów mówionych w jednym języku i tworzeniu słów mówionych w innym — idealnie zachowując głos i ton mówiącego…
Dźwiękowa sztuczna inteligencjaHiFi-GAN to wokoder generatywno-kontradyktoryjny, który niemal natychmiast przekształca spektrogram mel w surową falę audio, tworząc mowę o studyjnej jakości daleko…
Dźwiękowa sztuczna inteligencjaKonwersja grafemu na fonem (G2P) przekłada pisane litery na dźwięki, które system mowy powinien faktycznie wymawiać.
Dźwiękowa sztuczna inteligencjaNormalizacja tekstu to etap początkowy, który polega na przepisaniu surowego tekstu na w pełni wypowiadane słowa, zanim system mowy je wypowie.
Dźwiękowa sztuczna inteligencjaSoundStream to kompleksowy neuronowy kodek audio firmy Google, który kompresuje mowę i muzykę do wyjątkowo niskiej przepływności, zachowując jednocześnie jakość.
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.