Gratis AI-bibliotek

Lär dig AI.Fri för alltid.

1019 enkla guider, strukturerade inlärningsvägar och ett öppet bibliotek — byggt av en oberoende 501(c)(3) ideell organisation så att vem som helst kan förstå modern AI.

1019Gratis guider
9Ämnesspår
~2 minEnligt guide
~34hLästid

Börja här

Fem Resultatbaserade kurser

Varje kurs innehåller explicita resultat, kartlagda kompetenser, övningsaktiviteter och en tillämpad capstone.

Ämnesspår

Bläddra efter spår

Hoppa in i det område du bryr dig om. Varje bana har flera enkla guider.

Fullständigt bibliotek

Alla guider

1019 av 1019 Guider visas. Filtrera efter spår eller sök ovan.

Visuell AI

DreamFusion och Score Destillation Sampling

DreamFusion genererar 3D-objekt från text genom att använda en 2D-bildspridningsmodell som kritiker, aldrig träna på någon 3D-data.

2 min-läsningLäs
Visuell AI

Magic3D text-till-3D pipeline

Magic3D är NVIDIAs tvåstegssvar på DreamFusion, som producerar högre upplösning och mer detaljerat 3D-innehåll snabbare.

2 min-läsningLäs
Språk AI

Tokenizer-fria modeller på bytenivå

Tokenizer-fria modeller släpper det fasta ordförrådet för ordbitar och arbetar direkt på råbytes, vilket låter en modell hantera alla språk, kod eller till och med bullriga...

2 min-läsningLäs
Språk AI

Funktionsvektorer och uppgiftsrepresentationer

Funktionsvektorer är kompakta riktningar inuti en språkmodells dolda tillstånd som kodar en hel uppgift, som "översätt till franska" eller "retur tillbaka antonymen".

2 min-läsningLäs
Språk AI

Best-of-N-sampling och omrankning

Best-of-N-sampling genererar flera kandidatsvar från en modell och väljer sedan det bästa med hjälp av ett separat poängsteg.

2 min-läsningLäs
Ljud-AI

StyleTTS 2 Style Diffusion

StyleTTS 2 är en text-till-tal-modell som behandlar röstens "stil" - prosodi, känsla och högtalares klang - som en slumpmässig variabel samplade med en diffusionsmodell...

2 min-läsningLäs
Ljud-AI

FastPitch Pitch-kontrollerbar TTS

FastPitch är en snabb, icke-autoregressiv text-till-tal-modell som explicit förutsäger tonhöjden (grundfrekvensen) för varje inmatningstoken, vilket låter dig...

2 min-läsningLäs
Ljud-AI

Röstboxs-flödesmatchande talgenerering

Voicebox är Metas textstyrda talgenereringsmodell tränad med ett flödesmatchande mål att "fylla i" maskerat ljud, så att en modell kan göra noll-shot-röst...

2 min-läsningLäs
Tekniskt

SmoothQuant och Activation Quantization

SmoothQuant är en teknik som gör det möjligt att komprimera stora språkmodeller ner till 8-bitars heltal för både vikter och aktiveringar utan...

2 min-läsningLäs
Tekniskt

Strukturerad beskärning och lagerborttagning

Strukturerad beskärning tar bort hela komponenter i ett neuralt nätverk, såsom uppmärksamhetshuvuden, neuroner eller hela lager, så den smalare modellen går snabbare...

2 min-läsningLäs
Tekniskt

Spekulativ streaming och Multi-Token Prediction

Spekulativ streaming och förutsägelse av flera tokens påskyndar generering av språkmodeller genom att gissa flera framtida tokens samtidigt och verifiera dem i en enda...

2 min-läsningLäs
Företag

OpenAI GPT-4.5 och GPT-5

GPT-4.5 och GPT-5 är OpenAIs flaggskepp för stora språkmodeller som driver ChatGPT och dess API.

2 min-läsningLäs

Färdigläst? Bevisa det.

Kontrollera vad du lärt dig med ämnesquiz, och utforska sedan våra strukturerade kurser och aktuella certifieringskrav. Kärnguider är fortfarande gratis att läsa.

Learn AI — Free Guides, Courses and Learning Paths — Page 45 of 85 | AI Understanding