AI Foundations
Understand what AI is, how systems learn, where they fail, and how to judge claims without hype.
Free AI library
117 plain-English guides, structured learning paths, and an open library — built by an independent 501(c)(3) nonprofit so anyone can understand modern AI.
Börja här
Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.
Understand what AI is, how systems learn, where they fail, and how to judge claims without hype.
Use AI productively while protecting privacy, checking outputs, and preserving human accountability.
Evaluate workplace use cases, run safe pilots, measure value, and communicate changes responsibly.
Analyze AI systems through rights, equity, governance, safety, and public-interest outcomes.
Understand language models, retrieval, agents, evaluation, cost, and deployment safeguards through practical system design.
Topic tracks
Jump into the area you care about. Every track has multiple plain-English guides.
Full library
117 av 1019 guides shown. Filter by track or search above.
Identifiering av coverlåtar upptäcker när två mycket olika ljudinspelningar faktiskt är samma underliggande låt - en liveakustisk version, en remix...
Audio AIDDSP (Differentiable Digital Signal Processing) förenar klassiska synthesizerbyggstenar med neurala nätverk, så att djupinlärning kan styra oscillatorer...
Audio AIVITS är en text-till-tal-modell som omvandlar text direkt till råa ljudvågformer i ett enda tränat system, och hoppar över den vanliga tvåstegspipen.
Audio AIFastSpeech genererar ett helt talspektrogram parallellt snarare än en bildruta åt gången, vilket gör syntesen dramatiskt snabbare och mer stabil.
Audio AINaturalSpeech är en linje av Microsoft TTS-forskning som syftar till talkvalitet på mänsklig nivå, med senare versioner som använder latent diffusion för att generera rik, naturlig...
Audio AISpeech Emotion Recognition (SER) är AI som upptäcker en talares känslomässiga tillstånd – ilska, glädje, sorg, frustration – från ljudet av deras röst, inte bara...
Audio AIMoshi är en öppen källkod, realtidsröst-AI från Kyutai som pratar och lyssnar samtidigt – full-duplex – istället för att ta strikta svängar.
Audio AISpeech-to-Speech Translation (S2ST) tar talade ord på ett språk och producerar talade ord på ett annat — idealiskt bevara talarens röst, ton...
Audio AIHiFi-GAN är en generativ-motstridig vokoder som förvandlar ett mel-spektrogram till en rå ljudvågform nästan omedelbart och producerar tal i studiokvalitet långt...
Audio AIGrafe-till-fonem-konvertering (G2P) översätter skrivna bokstäver till de ljud som ett talsystem faktiskt borde uttala.
Audio AITextnormalisering är det första steget som skriver om rå skriven text till helt uttalade ord innan ett talsystem säger det.
Audio AISoundStream är Googles end-to-end neurala ljudcodec som komprimerar tal och musik till extremt låga bithastigheter samtidigt som kvaliteten bevaras.
Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.