Bezpłatna biblioteka AI

Techniczne przewodnikiZa darmo na zawsze.

177 przewodniki w prostym języku angielskim, ustrukturyzowane ścieżki edukacyjne i otwarta biblioteka — stworzone przez niezależną organizację non-profit 501(c)(3), aby każdy mógł zrozumieć współczesną sztuczną inteligencję.

177Bezpłatne przewodniki
1Ścieżki tematyczne
~2 minWedług przewodnika
~6hCzas czytania

Zacznij tutaj

Pięć Kursy oparte na wynikach

Każdy kurs zawiera wyraźne wyniki, zmapowane kompetencje, ćwiczenia oraz praktyczny projekt końcowy.

Ścieżki tematyczne

Przeglądaj według utworu

Wskocz w obszar, na którym Ci zależy. Do każdego utworu dołączono wiele przewodników w języku angielskim.

Pełna biblioteka

Wszystkie przewodniki

177 z 1019 pokazane przewodniki. Filtruj według utworu lub wyszukaj powyżej.

Techniczne

Spekulacyjne przesyłanie strumieniowe i przewidywanie wielu tokenów

Spekulacyjne przesyłanie strumieniowe i przewidywanie wielu tokenów przyspieszają generowanie modelu językowego, odgadując kilka przyszłych tokenów jednocześnie i weryfikując je w jednym…

2 min. przeczytajPrzeczytaj
Techniczne

BERTScore i ocena semantyczna

BERTScore mierzy, jak dobrze tekst wygenerowany maszynowo pasuje do odniesienia, porównując znaczenie, a nie dokładne słowa.

2 min. przeczytajPrzeczytaj
Techniczne

Liniowa uwaga i jądra wykonawcze

Uwaga liniowa zastępuje kwadratową uwagę softmax w Transformersach sztuczką matematyczną, która skaluje się liniowo wraz z długością sekwencji.

2 min. przeczytajPrzeczytaj
Techniczne

Rozszerzenie długości przędzy i kontekstu

YaRN (jeszcze kolejne rozszerzenie RoPE) to wydajna technika rozciągania użytecznego okna kontekstowego modelu daleko poza to, na czym został on przeszkolony.

2 min. przeczytajPrzeczytaj
Techniczne

Interpolacja pozycyjna dla długiego kontekstu

Interpolacja pozycyjna (PI) to prosta, wpływowa technika, która rozszerza okno kontekstowe Transformatora poprzez wciśnięcie nowych indeksów pozycji do zakresu…

2 min. przeczytajPrzeczytaj
Techniczne

Mieszanka ekspertów LoRA

Mieszanka ekspertów LoRA (MoLE) łączy wiele małych, niedrogich adapterów z wyuczonym routerem, dzięki czemu pojedynczy model podstawowy może elastycznie specjalizować się w…

2 min. przeczytajPrzeczytaj
Techniczne

Spekulatywne edycje modeli kodu

Edycje spekulatywne sprawiają, że edycja kodu AI jest natychmiastowa, ponieważ przewiduje, że większość pliku pozostanie niezmieniona i weryfikuje jedynie małe, różniące się części.

2 min. przeczytajPrzeczytaj
Techniczne

Inżynieria sterowania i reprezentacji aktywacji

Sterowanie aktywacją wpływa na zachowanie modelu poprzez bezpośrednie dodawanie lub odejmowanie wektorów wewnątrz jego ukrytych aktywacji w czasie wykonywania, bez konieczności ponownego uczenia.

2 min. przeczytajPrzeczytaj
Techniczne

Rzadkie autoenkodery zapewniające interpretację

Rzadkie autoenkodery (SAE) to narzędzie, które rozdziela splątane wewnętrzne aktywacje sieci neuronowej w znacznie większy zestaw czystszych…

2 min. przeczytajPrzeczytaj
Techniczne

Superpozycja i polisemantyczność w interpretacji AI

Naucz się superpozycji i polisemantyczności w interpretacji sztucznej inteligencji: dlaczego modele łączą cechy we wspólne kierunki, dlaczego neurony stają się polisemantyczne…

2 min. przeczytajPrzeczytaj
Techniczne

Obiektyw Logit i dostrojony obiektyw

Soczewka logitowa i soczewka dostrojona to techniki interpretacji, które pozwalają zajrzeć do ukrytych stanów transformatora warstwa po warstwie, aby zobaczyć, co model „myśli”…

2 min. przeczytajPrzeczytaj
Techniczne

Stosy szkoleniowe DeepSpeed i Megatron

DeepSpeed (Microsoft) i Megatron-LM (NVIDIA) to stosy oprogramowania, które tworzą modele szkoleniowe z miliardami parametrów na tysiącach procesorów graficznych…

2 min. przeczytajPrzeczytaj

Skończyłeś czytać? Udowodnij to.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Technical AI Guides — Page 10 of 15 | AI Understanding