Gratis AI-bibliotek

Lær AI.Fri for alltid.

1019 enkle guider, strukturerte læringsveier og et åpent bibliotek — bygget av en uavhengig 501(c)(3) ideell organisasjon slik at alle kan forstå moderne AI.

1019Gratis guider
9Temaspor
~2 minIfølge veiledning
~34hLesetid

Start her

Fem Resultatbaserte kurs

Hvert kurs inkluderer eksplisitte resultater, kartlagte kompetanser, øvingsaktiviteter og en anvendt avsluttende oppgave.

Temaspor

Bla gjennom etter spor

Hopp inn i området du bryr deg om. Hver bane har flere enkle guider.

Fullstendig bibliotek

Alle guider

1019 av 1019 Guider vist. Filtrer etter spor eller søk ovenfor.

Visuell AI

DreamFusion og Score Destillation Sampling

DreamFusion genererer 3D-objekter fra tekst ved å bruke en 2D-bildediffusjonsmodell som kritiker, og trener aldri på 3D-data.

2 Min lesningLes
Visuell AI

Magic3D tekst-til-3D-pipeline

Magic3D er NVIDIAs to-trinns svar på DreamFusion, og produserer høyere oppløsning og mer detaljert 3D-innhold raskere.

2 Min lesningLes
Språk AI

Tokenizer-frie modeller på bytenivå

Tokenizer-frie modeller slipper det faste vokabularet til ordbiter og opererer direkte på råbyte, og lar én modell håndtere et hvilket som helst språk, kode eller til og med støyende ...

2 Min lesningLes
Språk AI

Funksjonsvektorer og oppgaverepresentasjoner

Funksjonsvektorer er kompakte retninger inne i en språkmodells skjulte tilstander som koder for en hel oppgave, som "oversett til fransk" eller "retur tilbake antonymet".

2 Min lesningLes
Språk AI

Best-of-N Sampling og omrangering

Best-of-N-utvalg genererer flere kandidatsvar fra en modell og velger deretter den beste ved å bruke et separat poengstrinn.

2 Min lesningLes
Audio AI

StyleTTS 2 Style Diffusion

StyleTTS 2 er en tekst-til-tale-modell som behandler stemme-"stil" - prosodi, følelser og høyttalerklang - som en tilfeldig variabel samplet med en diffusjonsmodell ...

2 Min lesningLes
Audio AI

FastPitch Pitch-kontrollerbar TTS

FastPitch er en rask, ikke-autoregressiv tekst-til-tale-modell som eksplisitt forutsier tonehøyden (fundamental frekvens) for hvert inndatatoken, slik at du...

2 Min lesningLes
Audio AI

Talegenerering med flyt-matching av stemmeboks

Voicebox er Metas tekststyrte talegenereringsmodell som er trent med et flyt-matchende mål for å "fylle ut" maskert lyd, slik at én modell kan gjøre null-shot-stemme...

2 Min lesningLes
Teknisk

SmoothQuant og Activation Quantization

SmoothQuant er en teknikk som gjør det mulig å komprimere store språkmodeller ned til 8-bits heltall for både vekter og aktiveringer uten...

2 Min lesningLes
Teknisk

Strukturert beskjæring og lagslipp

Strukturert beskjæring fjerner hele komponenter i et nevralt nettverk, for eksempel oppmerksomhetshoder, nevroner eller hele lag, slik at den slankere modellen kjører raskere...

2 Min lesningLes
Teknisk

Spekulativ streaming og Multi-Token Prediction

Spekulativ strømming og prediksjon av flere tokener fremskynder generering av språkmodeller ved å gjette flere fremtidige tokens på en gang og verifisere dem i en enkelt...

2 Min lesningLes
Selskaper

OpenAI GPT-4.5 og GPT-5

GPT-4.5 og GPT-5 er OpenAIs flaggskip for store språkmodeller som driver ChatGPT og dets API.

2 Min lesningLes

Ferdig med å lese? Bevis det.

Sjekk hva du har lært med temaquizzer, og utforsk deretter våre strukturerte kurs og gjeldende sertifiseringskrav. Kjerneguidene er fortsatt gratis å lese.